الإحصائيات والتقارير
-

منهجية جديدة تكشف عيوب تقييم تعلم النماذج اللغوية
منهجية جديدة تكشف عيوب تقييم تعلم النماذج اللغوية وتطور أدوات سببية للقياس الدقيق، مما يشكك في صحة القرارات التقنية الحالية
أكمل القراءة » -

تقنية جديدة تحل مشكلة “البداية الباردة” في التعلم المعزز
باحثون يكشفون عن تقنية نقل الوكالة التدريجي التي تدمج النماذج القاعدية الموجودة لتسريع تدريب نماذج التعلم المعزز الجديدة
أكمل القراءة » -

باحثون يطلقون OmniGameArena لقياس تطور وكلاء الذكاء الاصطناعي في الألعاب
OmniGameArena منصة جديدة تختبر 12 وكيل ذكاء اصطناعي عبر ألعاب Unreal Engine 5 مع نظام تحسين متطور يقيس التطور عبر…
أكمل القراءة » -

DeepSeek V4 Pro يحطم هيمنة GPT-5.5 Pro بنتائج دقة مفاجئة
DeepSeek V4 Pro يتفوق على GPT-5.5 Pro في معايير الدقة مع تحليل مفصل للنتائج التي تعيد تشكيل المشهد التنافسي للذكاء…
أكمل القراءة » -

نبض سوق الذكاء الاصطناعي — أسبوع جوجل تعيد اختراع المستقبل
نبض سوق الذكاء الاصطناعي يشهد تحولاً جذرياً مع 20 تحديثاً من جوجل وثورة الوكلاء الأذكياء التي تعيد تعريف التفاعل التقني
أكمل القراءة » -

آبل تكشف $1.4 تريليون من مبيعات App Store و90% بدون عمولة
آبل تحقق $1.4 تريليون من معاملات App Store في 2025 مع نمو استثنائي لتطبيقات الذكاء الاصطناعي بنسبة 90% بدون عمولة
أكمل القراءة » -

EVA-Bench 2.0 يطلق 213 سيناريو تقييم للعملاء الصوتيين
تقييم العملاء الصوتيين يحصل على أكبر ترقية مع بيانات EVA-Bench 2.0 الجديدة عبر 121 أداة و3 مجالات مؤسسية
أكمل القراءة » -

ستانفورد تقلب التعليم القانوني رأساً على عقب بدراسة مذهلة
دراسة ستانفورد الصادمة تكشف تفوق الذكاء الاصطناعي على أساتذة القانون بنسبة 75% في تقييم جودة الإجابات التعليمية وتعيد تشكيل مستقبل…
أكمل القراءة » -

أقوى النماذج اللغوية تفشل في 69% من القرارات الطبية
أقوى النماذج اللغوية تفشل في 69% من القرارات الطبية عند اختبارها كأطباء حقيقيين في بيئة ClinEnv المبتكرة مع تباين خطير…
أكمل القراءة » -

نبض سوق الذكاء الاصطناعي — أسبوع ثورة الوكلاء والتقييمات الخيالية
نبض سوق الذكاء الاصطناعي يشهد تحولاً جذرياً مع Anthropic تحطم أرقام التقييم و Claude يقود ثورة الوكلاء المتوازيين التي تعيد…
أكمل القراءة »