
بقلم: سارة | محررة نماذج الذكاء الاصطناعي · صوت تحريري بإشراف بشري
أطلقت OpenAI معاينة لمستوى خدمة جديد في واجهتها البرمجية يُسمّى Ultrafast، يُشغّل نموذج GPT-5.6 Sol بسرعة تصل إلى 750 رمزاً في الثانية — أي ما يعادل (وفقاً لـ OpenAI) 14 ضعف السرعة القياسية للنموذج ذاته. الشريك التقني وراء هذا الأداء هو شركة Cerebras، المتخصصة في رقائق الذكاء الاصطناعي عالية السرعة.
الرقم 750 رمزاً في الثانية ليس مجرد تحسين هامشي؛ إنه يُقلّب معادلة التجربة التفاعلية مع النماذج اللغوية الكبيرة. التطبيقات التي تتطلب استجابات فورية — كالمساعدات الصوتية، ووكلاء الذكاء الاصطناعي الذين يُنفّذون مهام متتالية، وأدوات البرمجة الحيّة — كانت دائماً تعاني من عنق الزجاجة الناجم عن كُمون inference التقليدي. Ultrafast يضع هذا الحاجز في دائرة الحل الممكن.
الشراكة مع Cerebras تُشير إلى توجه OpenAI نحو التنويع في البنية التحتية بدلاً من الاعتماد الكلّي على رقائق NVIDIA. Cerebras تبني معالجاتها حول مفهوم Wafer-Scale Engine، وهو تصميم يُقلّص التأخير في نقل البيانات بين الوحدات الحسابية، ما يجعلها ملائمة بشكل خاص لمهام inference التي تُولّد رموزاً بشكل تسلسلي سريع.
الخدمة في طور المعاينة حالياً وتستهدف المطورين عبر OpenAI API، غير أن OpenAI لم تُفصح بعد عن هيكل التسعير الكامل لهذا المستوى، ولا عن الأسواق أو المناطق التي ستُتاح فيها أولاً. كذلك يبقى السؤال مفتوحاً حول ما إذا كانت سرعة 750 رمزاً في الثانية ستبقى ثابتة تحت أحمال الطلبات العالية أو خلال ساعات الذروة.







