تُحدَّث يومياً

مصدرُك العربي
لمستقبل الذكاء الاصطناعي

أخبار، تقارير، أدوات وتحليلات يومية — كل ما تحتاجه لمتابعة ثورة الذكاء الاصطناعي باللغة العربية

✅ تم الاشتراك!
أخبار الذكاء الاصطناعي

Snowflake وNVIDIA تراهنان على توجيه النماذج لخفض كلفة وكلاء الذكاء الاصطناعي

أرقام معلنة من Snowflake: كفاءة توكن أعلى 3 أضعاف في بناء خط بيانات dbt و25% في طلبات السحب مقابل مسار النماذج الحدودية.

ضمن ملف: نماذج الذكاء الاصطناعي، إنفيديا

بقلم: نور | محررة الأبحاث والدراسات · صوت تحريري بإشراف بشري

المصدر الأساسي: The Deep View

لماذا يهم

فرق الهندسة التي تشغّل وكلاء إنتاجيين تستطيع خفض فاتورة التوكن دون إعادة بناء تطبيقاتها، لكنها تتنازل مقابل ذلك عن جزء من التحكم في أي نموذج نفّذ الطلب.

ليست كل مهمة يؤديها وكيل ذكاء اصطناعي تستحق نموذجاً حدودياً باهظ الثمن. هذه الفكرة البسيطة هي جوهر ما يُعرف بـتوجيه النماذج (model routing): طبقة تقرأ تعقيد المهمة ثم تُرسلها إلى النموذج المناسب، فتذهب الطلبات البسيطة إلى نماذج أصغر وأرخص، وتُحجز النماذج الأغلى للحالات التي تستحقها فعلاً. وبحسب The Deep View، أصبحت Snowflake آخر شركة تعلن حلها الخاص للتوجيه الديناميكي داخل Cortex AI Gateway ومنتجيها الرئيسيين CoCo وCoWork.

المكسب الذي تروّج له Snowflake ليس السعر وحده. الوعد الأهم للمطوّرين هو التخلص من إعادة بناء الوكلاء والتطبيقات في كل مرة يتغيّر فيها النموذج الأساسي. يقول باريس غولتكين، نائب رئيس الذكاء الاصطناعي في Snowflake، لـThe Deep View إن «الذكاء الاصطناعي المؤسسي يتجه نحو عالم تستطيع فيه الشركات الاعتماد على أفضل ذكاء متاح لكل مهمة دون أن تدير مشهد النماذج بنفسها»، مضيفاً أن هذه المرونة ستقلّص الكلفة وتحوّل التحسينات المتلاحقة في النماذج إلى قيمة تجارية مستمرة. الترجمة العملية: النموذج يصبح تفصيلاً قابلاً للاستبدال خلف واجهة ثابتة، لا قراراً معمارياً تدفع ثمنه مرتين.

الأرقام التي عرضتها الشركة أرقام معلنة من Snowflake نفسها ولم يتسنَّ التحقق منها بشكل مستقل. ففي تقييمات داخلية، حقق وكلاء يستخدمون التوجيه الديناميكي عبر Cortex AI Gateway لبناء خط بيانات dbt كفاءة توكن أعلى بما يصل إلى 3 أضعاف مقارنة بمسار يعتمد على النماذج الحدودية وحدها، دون تراجع في الجودة (وفقاً لـ The Deep View). وفي اختبار آخر، أنجز مهندسون العدد نفسه من طلبات السحب بكفاءة توكن أعلى بنسبة 25% (وفقاً لـ The Deep View). لاحظ أن المقياس هنا هو كفاءة التوكن لا الفاتورة النهائية، وهما ليسا الشيء نفسه بالضرورة حين تختلف أسعار النماذج المستهدفة.

Snowflake ليست وحدها. فقد أطلقت NVIDIA قبل أسبوع حلها الخاص، NeMo Switchyard، وهي مكتبة مفتوحة المصدر للتوجيه الذكي داخل أدوات الوكلاء الشائعة، تتيح للشركات بناء موجّهات خاصة بها بالمنطق نفسه: كلفة أقل بلا تضحية بالأداء وبلا إعادة بناء التطبيقات. وتضيف كاري بريسكي، نائبة رئيس برمجيات الذكاء التوليدي للمؤسسات في NVIDIA، بُعداً لا يتعلق بالمال: إعادة توجيه المهام إلى نماذج متخصصة بمجال أو مهمة بعينها تعطي «استجابات أسرع لأنك ترسل إلى نماذج أصغر وأكفأ، وكفاءة توكن أعلى، وفي بعض الحالات دقة أعلى بحسب مجالك»، كما قالت لـThe Deep View. الدقة هنا هي الورقة الأقوى: من السهل بيع خفض الكلفة، لكن من الصعب رفضه حين يأتي مع نتائج أفضل في مجال متخصص.

ما يفسّر هذا السباق المفاجئ بين مزوّدَين بهذا الحجم هو منحنى الكلفة. تتوقع Gartner في تقرير نُشر هذا الأسبوع أن ترتفع كلفة الاستدلال لكل تدفق عمل وكيلي بأكثر من خمسة أضعاف حتى عام 2028 (وفقاً لـ The Deep View). وحين سُئل سكوت بيكلي، الزميل الاستشاري في Info-Tech Research Group، عمّا إذا كانت هذه الكلفة ستُضعف الطلب، أجاب بأن الاستجابة الأولى ستكون التركيز على الكفاءة والاستهلاك الأذكى عبر ترسانة من التقنيات: نماذج مضبوطة بالـfine-tuning، ونماذج LLM صغيرة، وتوجيه النماذج، والتخزين المؤقت (caching)، والتقطير (distillation)، وضغط الموجّهات (prompt compression)، «بدلاً من هجر جماعي للذكاء الاصطناعي». هذه القائمة، لا التوجيه وحده، هي خارطة طريق الكفاءة في 2026.

لكن ثمة ثمناً لا تذكره المدوّنات الترويجية: عندما تسلّم قرار «أي نموذج يعالج طلبي» إلى بوابة يديرها مزوّد سحابي، تفقد جزءاً من قابلية التتبع والتكرار. لماذا أعطاك الوكيل إجابة مختلفة اليوم عن الأمس؟ ربما لأن الموجّه قرر أن المهمة «بسيطة». وفي بيئات التدقيق والامتثال، هذه ليست تفصيلة هامشية. الأهم أن طبقة التوجيه نفسها تتحول إلى نقطة ارتباط جديدة بالمزوّد، وهو ما يفسّر لماذا تسارع الشركات إلى امتلاكها الآن، ولماذا اختارت NVIDIA مسار المصدر المفتوح لتكسر هذا الاحتكار مبكراً. من زاوية الأعمال، هذه المعركة على من يملك عدّاد التوكن، وهي المعركة ذاتها التي دفعت Stripe إلى شراء OpenRouter. نصيحتنا للفرق التقنية: قبل تفعيل التوجيه، ثبّت مجموعة تقييم خاصة بك وقِس الجودة قبل وبعد، لأن «دون تضحية بالجودة» في اختبار داخلي ليس وعداً بالجودة في تدفق عملك أنت.

مقالات ذات صلة

زر الذهاب إلى الأعلى