-
أخبار الذكاء الاصطناعي

GPT-5.6 متاح للجميع مع إطلاق وكيل ChatGPT Work الجديد
أطلقت OpenAI نموذج GPT-5.6 ووكيل ChatGPT Work بعد موافقة حكومية، متاح لمستخدمي سطح المكتب المجانيين فوراً مع دعم Slack وGmail…
أكمل القراءة » -
النظام البيئي والفرص المتاحة

OpenAI تستحوذ على Northslope لنشر مهندسين داخل مؤسساتك
استحواذ OpenAI على Northslope يُضيف مئات المهندسين الميدانيين لنشر الذكاء الاصطناعي داخل المؤسسات بميزانية 4 مليارات دولار
أكمل القراءة » -
الإحصائيات والتقارير

أوبنأي تكشف: 30% من مهام SWE-Bench Pro معطوبة وتُضلّل تقييم النماذج
أوبنأي تُثبت أن 30% من المهام العامة في SWE-Bench Pro معطوبة وتُشوّه قياس قدرات البرمجة والسلامة في نماذج الذكاء الاصطناعي
أكمل القراءة » -
أخبار الذكاء الاصطناعي

Ollama v0.31.2 يُفعّل Flash Attention على بطاقات NVIDIA القديمة بسبع تحسينات
إصدار Ollama v0.31.2 يدعم Flash Attention على GPUs بـ compute capability 6.x ويُصلح Structured Output ويُعطّل Telemetry في Claude Code
أكمل القراءة » -
الإحصائيات والتقارير

Jailbreak: تجاوز قواعد البيانات بسرعة 27 ضعفاً باستخدام الذكاء الاصطناعي
نظام Jailbreak يستخدم LLMs لتوليد قارئات تخزين تتجاوز JDBC وODBC وتحقق تسريعاً 27 ضعفاً في أعباء التحليل
أكمل القراءة » -
الإحصائيات والتقارير

STRACE إطار يكشف الأسباب الجذرية لفشل وكلاء الذكاء الاصطناعي
STRACE إطار بحثي جديد يحلّل آثار تنفيذ الوكلاء سببياً ويرفع معدل النجاح من 42.5% إلى 58.5% على معيار VeruSAGE-Bench
أكمل القراءة » -
الإحصائيات والتقارير

تحويل المحولات الضخمة إلى نماذج خطية دون خسارة الجودة
ورقة بحثية تكشف المفتاح الرياضي لتحويل Transformer إلى نموذج خطي عبر تحليل softmax وتطبيقه على LLaMA وQwen حتى 32 مليار…
أكمل القراءة » -
الإحصائيات والتقارير

Co-LMLM: نموذج 360 مليون معامل يتفوق على بيانات تدريب أضخم بـ 40 مرة
Co-LMLM نموذج لغوي محدود الذاكرة يستخدم استعلامات متجهية مستمرة ويتفوق على GPT-4o-mini بحجم 360 مليون معامل فقط
أكمل القراءة » -
الإحصائيات والتقارير

SciReasoner يُحقق 67 تفوقاً من 86 معياراً في العلوم الجزيئية
SciReasoner نموذج ذكاء اصطناعي متعدد الوسائط يحقق أداءً متصدراً في 67 من 86 معياراً علمياً عبر البيولوجيا والكيمياء وعلم المواد…
أكمل القراءة » -
الإحصائيات والتقارير

Grok 4.5 ضد GPT-5.5 ضد Claude: من يبني التطبيقات أفضل وأسرع؟
مقارنة مباشرة بين Grok 4.5 وGPT-5.5 وClaude Opus 4.8 وFable 5 في بناء تطبيقات HTML حقيقية من مطالبة واحدة، مع…
أكمل القراءة »