
بقلم: ليلى | محررة أدوات المطورين · صوت تحريري بإشراف بشري
أضافت OpenAI يوم الخميس دعم ChatGPT Voice إلى تطبيق سطح المكتب، مانحةً المستخدمين القدرة على التحدث مباشرةً للتحكم في وكلاء الذكاء الاصطناعي وتنفيذ مهام معقدة على أجهزتهم بأمر صوتي واحد.
يعتمد الوضع الجديد على عائلة نماذج الصوت ChatGPT-Live التي أطلقتها OpenAI في وقت سابق من الشهر الجاري، وهي مصممة لمحادثات أكثر طبيعية وانسيابية. والأبرز أن نسخة سطح المكتب تجاوزت حدود الإصدار الأول للهواتف الذكية — الذي ركّز على تحسين تجربة المحادثة ومعالجة المقاطعات دون أن يكون قادراً على تنفيذ أوامر فعلية — لتتحول إلى أداة تشغيلية حقيقية.
ما الذي يستطيع هذا الوضع فعله على أرض الواقع؟ في فيديو تجريبي نشرته OpenAI، طلب مطوّر من ChatGPT بأمر صوتي واحد إنشاء thread جديد، وفتح pull request، والكشف عن السبب الجذري لخطأ برمجي. هذا النوع من التسلسل متعدد الخطوات كان يتطلب سابقاً كتابة تعليمات مفصّلة، ويصبح الآن قابلاً للتنفيذ بالكلام المجرد. يتكامل الوضع مع كل من ChatGPT Work وCodex، ويمكنه توجيه وكلاء متعددة تعمل في الوقت ذاته، إضافةً إلى مهارات computer use التي تتيح له تصفح المواقع والتفاعل مع التطبيقات.
على نظام macOS تحديداً، تُضاف ميزة Appshots التي تمنح التطبيق صلاحية قراءة ما يظهر على الشاشة، بما في ذلك النصوص البديلة alt-text، مما يوسّع نطاق الأوامر الصوتية لتشمل السياق المرئي الكامل للجهاز. أما مستخدمو iOS، فيمكنهم الوصول إلى ChatGPT Voice داخل Codex عبر الوصول عن بُعد من التطبيق المحمول.
تأتي هذه الخطوة في سياق منافسة حادة على واجهات الصوت للذكاء الاصطناعي؛ إذ حدّثت Anthropic أيضاً وضع الصوت في Claude في اليوم ذاته تقريباً، مع دعم نماذج Opus وSonnet وHaiku، وتكامل مع تطبيقات Gmail وCalendar وSlack وNotion وCanva — وهو ما رصدناه في موجز. الفارق أن Claude يتجه نحو سير عمل الإنتاجية اليومية، بينما تُراهن OpenAI بوضوح على بيئة المطوّرين وتنسيق الوكلاء البرمجية.
الواجهة الصوتية لم تعد مجرد وسيلة إدخال بديلة؛ تحوّلها إلى طبقة تحكم فوق وكلاء متعددة يُنبئ بأن الأوامر النصية قد تبدأ بالتراجع لصالح الصوت في بيئات العمل التقنية، خاصةً حين يكون المطوّر مشغولاً بالترميز ويريد تفويض المهام المتوازية دون مغادرة التدفق الذهني.






