تواصل OpenAI كشف أوراقها في سباق العتاد. في مؤتمر Hot Chips، عرضت الشركة لأول مرة بالتفصيل رقاقتها للاستدلال — Jalapeño — وشاركت نتائج اختبارات حديثة فاجأت الكثيرين. إذا تأكدت هذه الأرقام في الأحمال الحقيقية، فقد يتغير توازن القوى في سوق استخراج النماذج بشكل ملحوظ.

ما أظهرته الاختبارات
في معيار SemiAnalysis InferenceX، تفوق المعالج الجديد على حلول الاستدلال المتاحة اليوم بمستوى أحدث ما توصلت إليه التقنية في مقياسين مهمين: عدد الرموز المميزة (التوكنز) لكل مستخدم، وسعة الإنتاجية لكل كيلوواط من الطاقة المستهلكة. تمت المقارنة مع نظام NVIDIA Blackwell، الذي يُعتبر حاليًا أحد المعايير المرجعية في مهام استخراج الشبكات العصبية.
وصف رئيس قسم العتاد في OpenAI، ريتشارد هو، النتائج بأنها تحسن كبير مقارنة بالمستوى الحالي. لكنه أضاف على الفور تحفظًا مهمًا: بحلول الوقت الذي يظهر فيه Jalapeño بكميات كبيرة، قد يتمكن المنافسون من تحديث منصاتهم بشكل جدي. لذا فإن الفجوة الحالية ليست ضمانًا للمستقبل.
ومع ذلك، فإن اختيار المقاييس يدل على الكثير. بالنسبة لمراكز البيانات التي تعمل في الاستدلال، فإن الأهم ليس الأداء الأقصى، بل تكلفة كل رمز مميز وسلوك النظام تحت ضغط العديد من المستخدمين. هنا تحديدًا يريد الرقاقة الجديدة إظهار قوتها.
على ماذا يستند التفوق
Jalapeño ليست محاولة لصنع GPU عالمي آخر. تم الإعلان عن الرقاقة في أكتوبر من العام الماضي، وطُوّرت بالتعاون مع Broadcom وباستخدام نماذج OpenAI الخاصة. هذا النهج سمح للمهندسين برؤية "الاختناقات" الحقيقية في مرحلة التصميم.
المشاكل الرئيسية لا تتعلق بالحسابات نفسها، بل بالتأخيرات في المراحل التحضيرية وأثناء تبادل البيانات بين الوحدات. على سبيل المثال، مرحلة prefill — حيث تعالج النموذج البيانات المدخلة وتشكل السياق — غالبًا ما تستغرق وقتًا أطول بكثير مما هو مرغوب. يحاول Jalapeño تقليل هذه التأخيرات تحديدًا، كما يقلل من نقل البيانات بين الذاكرة ونوى الحوسبة.
توضح OpenAI أن الرقاقة قادرة على وضع حالة النموذج والاحتفاظ بها محليًا بشكل صريح، بما في ذلك KV cache. في كل مرحلة من مراحل الاستدلال، يتم تفعيل التركيبة المناسبة من الحوسبة والذاكرة والشبكة، بدلاً من تشغيل النظام بأكمله دفعة واحدة. هذا يشبه إلى حد ما خط تجميع حيث تكون كل محطة مجهزة خصيصًا لعمليتها.

متى تتوفر في الأسواق
لا تخفي OpenAI أنها تتعامل مع الرقاقة كمنصة طويلة الأمد: وفقًا لهو، تخطط الشركة لتطوير Jalapeño عبر عدة أجيال. هذا يعني أن البنية الحالية ليست تجربة لمرة واحدة، بل أساس لتكرارات مستقبلية.
لكن الطريق إلى الاستخدام الواسع لا يزال طويلًا. وفقًا لتقديرات OpenAI، في نهاية عام 2026 ستظهر الرقاقة بكميات صغيرة جدًا — أشبه بشحنة تجريبية. ومن المتوقع نشر أكثر وضوحًا في عام 2027.
بحلول ذلك الوقت، من المرجح أن NVIDIA لن تبقى مكتوفة الأيدي وقد تطلق إصدارات محدثة من Blackwell. لذا فإن المركز الأول في المعايير اليوم هو مجرد سلفة. الأكثر إثارة للاهتمام هو معرفة ما إذا كان Jalapeño سيتمكن من الحفاظ على تفوقه عندما يتعلق الأمر بالتشغيل الجماعي.



