الإحصائيات والتقارير
-

Argus: وقت تشغيل عميل يتطور ذاتياً ويحقق 78% على SWE-Bench Pro
Argus هو نظام وقت تشغيل عميل يحقق 78% على SWE-Bench Pro بتطور ذاتي مدعوم بالتحقق دون تغيير أوزان النموذج
أكمل القراءة » -

دراسة على 11 نموذجاً: الذكاء الاصطناعي المتملق يُضعف قرارك ويُرسّخ اعتمادك عليه
بحث على 1604 مشاركاً يكشف أن تملّق الذكاء الاصطناعي يقلّص النوايا الاجتماعية الإيجابية ويزيد الاعتماد على النماذج
أكمل القراءة » -

بحث الذكاء الاصطناعي يضاعف طلبات Shopify ثلاث مرات دون أن يُقلّص البحث التقليدي
بيانات Shopify للربع الثاني تكشف أن بحث الذكاء الاصطناعي ضاعف الطلبات ثلاث مرات مع نمو البحث التقليدي في آنٍ واحد
أكمل القراءة » -

DiffusionGemma يُولّد 1500 توكن في الثانية بنموذج مشتق لا مبنيٍّ من الصفر
DiffusionGemma من غوغل يُعيد رسم حدود سرعة نماذج اللغة باستخدام discrete diffusion وfine-tuning لـ Gemma 4 بأقل من 10% من…
أكمل القراءة » -

ريديت تحوّل نقاشات مجتمعاتها إلى وقود إعلاني بالذكاء الاصطناعي
كيف حوّلت ريديت إعلانات الذكاء الاصطناعي إلى محرك نمو بلغت معه 762 مليون دولار في الإيرادات ونمو 70% سنوياً في…
أكمل القراءة » -

بوتات الذكاء الاصطناعي ترفع تفاعل المتابعين على السوشيال ميديا 43%
دراسة علمية من جامعتَي فيرجينيا وإلينوي تثبت أن ردود بوتات الذكاء الاصطناعي على التعليقات ترفع التفاعل المستقبلي حتى 43% بشروط…
أكمل القراءة » -

PAST-Bench: معيار جديد لقياس التحسين الذاتي في وكلاء الذكاء الاصطناعي
PAST-Bench معيار تقييم يختبر ما إذا كانت وكلاء الذكاء الاصطناعي تتحسن فعلاً من تجاربها عبر 26 سيناريو و204 حلقة تقييم
أكمل القراءة » -

TurnSight: كيف يتعلم الذكاء الاصطناعي من أخطائه خطوةً بخطوة
TurnSight إطار تقطير ذاتي على مستوى الدورات يحل مشكلة توزيع الفضل في استدلال نماذج اللغة مع الأدوات الخارجية
أكمل القراءة » -

SocietyBench يكشف حدود نماذج اللغة في فهم تطور الأحداث الاجتماعية
SocietyBench معيار جديد يقيس قدرة نماذج اللغة الكبرى على التنبؤ بالأحداث الاجتماعية عبر محورَي المعايرة والدقة الزمنية
أكمل القراءة » -

ParVL: إطار موازٍ يُعيد توزيع الحوسبة في نماذج اللغة متعددة الوسائط
إطار ParVL يُتيح تخصيص حوسبة مرن بين مكوّني الرؤية واللغة في نماذج MLLM دون تضخيم المعاملات، مع تدريب على 13…
أكمل القراءة »