وضع "Ultrafast" من OpenAI يرفع سرعة GPT-5.6 Sol إلى 750 توكن في الثانية

LLMsHardware
صورة توضيحية مُولّدة بالذكاء الاصطناعي: Editorial image for OpenAI's Ultrafast Mode Pushes GPT-5.6 Sol to 750 Tokens a Second

الزبدة

  • OpenAI تطلق وضع Ultrafast الذي يشغّل GPT-5.6 Sol بسرعة 14 ضعفاً، ليصل الإخراج إلى 750 توكن في الثانية.
  • السرعة مصدرها شريحة Wafer-Scale Engine من Cerebras بذاكرة 44 غيغابايت مدمجة، لا تحسينات برمجية فقط.
  • في اختبار Humanity's Last Exam أنهى Sol Ultrafast 2500 سؤال خلال 11 ساعة و11 دقيقة، مقابل 78 ساعة و27 دقيقة لنموذج Fable 5.

أعلنت OpenAI في 13 أغسطس 2026 عن وضع معالجة جديد باسم "Ultrafast"، يشغّل نموذج GPT-5.6 Sol بسرعة تعادل 14 ضعف سرعته المعتادة. النتيجة: معدل إخراج يصل إلى 750 توكن (Token) في الثانية، وهو رقم يحوّل مهام كانت تُقاس بالساعات إلى مهام تُقاس بالدقائق.

القفزة هنا مصدرها العتاد لا البرمجيات وحدها. يعمل "Ultrafast" على معالج "Wafer-Scale Engine" من شركة Cerebras، وهو تصميم يعتمد على 44 غيغابايت من ذاكرة SRAM المدمجة التي تُبقي البيانات قريبة من وحدة المعالجة بدلاً من نقلها بين شبكة من معالجات الرسوميات (GPUs).

لماذا يهم هذا العتاد تحديداً

هذا التصميم وحده يفسّر حجم القفزة في السرعة أكثر من أي حيلة في صياغة الموجّهات. أنفقت Cerebras سنوات في الترويج لشرائحها كمسرّع للاستنتاج (Inference)، واعتماد OpenAI عليها في نموذج رئيسي يُعد رهاناً عملياً على أن هذه التقنية باتت جاهزة لخدمة حركة الاستخدام الفعلية على نطاق واسع.

الأرقام في الاختبارات المعيارية

تُظهر الاختبارات المعيارية (Benchmarks) حجم الفارق بوضوح. في اختبار "Humanity's Last Exam" المكوّن من 2500 سؤال، أنهى Sol Ultrafast المهمة خلال 11 ساعة و11 دقيقة، مقابل 78 ساعة و27 دقيقة استغرقها نموذج Fable 5 التابع لـ OpenAI نفسها.

بيانات رصد مستقلة من منصة Artificial Analysis تضع Sol Ultrafast عند سرعة تعادل نحو 11 ضعف سرعة Fable 5، ونحو 5 أضعاف سرعة نموذج Opus 4.8 من Anthropic عند تشغيله في وضعه السريع الخاص به. هذه المقارنة تضع أفضلية OpenAI في زمن الاستجابة (Latency) في مواجهة مباشرة مع أقرب منافس تجاري لها، لا مع جيلها السابق فقط.

أين تصنع السرعة فرقاً

تروّج OpenAI لوضع Ultrafast في المهام التي يكلّف فيها الانتظار مالاً أو هامش أمان: الاستجابة للحوادث، تحليل الأسواق المالية، خدمة العملاء، التجارة الإلكترونية، تطبيقات الصوت، البرمجة، وسير عمل البحث العلمي. القيمة هنا ليست في إجابات أذكى، بل في إجابات أسرع تصل والموقف لا يزال قائماً.

بالنسبة لطاولة تداول أو مهندس مناوب، فإن نموذجاً يجيب في أجزاء من الثانية يغيّر ما هو قابل للاستخدام فعلياً ضمن سير العمل، لا ما هو ممكن نظرياً فحسب.

إتاحة محدودة حالياً

يبقى الوصول إلى الميزة محدوداً في هذه المرحلة. فوضع Ultrafast لا يزال في طور المعاينة، ومتاح لمجموعة صغيرة من العملاء، وتقول OpenAI إنها ستوسّع إتاحته مع نمو قدرة Cerebras الإنتاجية.

هذا التحفظ يهم كل من يقيّم الميزة اليوم. فأرقام السرعة المعلنة تصف ما يستطيعه النظام في ظل الظروف الحالية، لا ما يمكن لكل مطوّر حجزه فوراً، والتوسع الأوسع سيتوقف على سرعة إضافة قدرة استنتاج جديدة قائمة على تقنية الشريحة الكاملة (Wafer-Scale).

واكب

فريق تحرير واكب

تم إعداد هذه المراجعة وتلخيصها بواسطة محرك الذكاء الاصطناعي الخاص بواكب ومراجعتها وتدقيقها من قبل فريقنا التحريري لضمان الدقة والموثوقية.

اشترك في النشرة البريدية

احصل على ملخص أسبوعي لأبرز أبحاث وأدوات الذكاء الاصطناعي مباشرة في بريدك.

قناة التليجرام

تابع تغطيتنا اللحظية ونقاشاتنا حول آخر مستجدات وأنظمة الذكاء الاصطناعي.

انضم إلينا على تليجرام