الذكاء الاصطناعي
OpenAI تطلق نموذج GPT-5.4 مع إصدارات جديدة للاستدلال والاحتراف
أطلقت شركة OpenAI نموذج GPT-5.4، وهو نموذج أساسي جديد يتميز بكفاءة محسّنة في استخدام الرموز (tokens)، ومعدلات خطأ أقل، ونوافذ سياق لواجهة برمجة التطبيقات تصل إلى 1 مليون رمز.
يوم الخميس، أطلقت OpenAI نموذج GPT-5.4، وهو نموذج أساسي جديد وُصف بأنه الأكثر قدرة وكفاءة للعمل المهني. وبالإضافة إلى الإصدار القياسي، يتوفر GPT-5.4 كنموذج استدلال يُسمى GPT-5.4 Thinking، وإصدار مُحسّن عالي الأداء يُسمى GPT-5.4 Pro. وتدّعي الشركة أن النموذج أكثر موثوقية بشكل ملحوظ من سابقه، GPT 5.2. ووفقاً لـ OpenAI، فإن GPT-5.4 أقل عرضة بنسبة 33٪ لارتكاب أخطاء في المطالبات الفردية مقارنة بـ GPT 5.2، كما أن الردود الإجمالية أقل عرضة بنسبة 18٪ لاحتواء أخطاء.
بالنسبة للمطورين، يقدم إصدار واجهة برمجة التطبيقات (API) من GPT-5.4 نوافذ سياق تصل إلى 1 مليون رمز، وهو ما يمثل أكبر نافذة سياق متاحة من OpenAI. كما يتميز بنظام جديد للبحث عن الأدوات (Tool Search) مصمم لإدارة استدعاء الأدوات. في السابق، كان يتعين على مطالبات النظام تحديد تعريفات لجميع الأدوات المتاحة عند استدعاء نموذج، مما كان يستهلك عدداً كبيراً من الرموز مع نمو مكتبة الأدوات. ويسمح نظام Tool Search الجديد للنموذج بالبحث عن تعريفات الأدوات عند الحاجة فقط، مما يجعل النموذج أكثر كفاءة في استخدام الرموز مقارنة بسابقه. ويؤدي هذا إلى طلبات أسرع وأقل تكلفة في الأنظمة التي تحتوي على العديد من الأدوات المتاحة.
كما أظهر النموذج أداءً قوياً في مقاييس الأداء المهنية، بما في ذلك تسجيل نتائج قياسية في مقاييس استخدام الكمبيوتر OSWorld-Verified وWebArena Verified. وسجل GPT-5.4 نسبة 83٪ في اختبار GDPval، وهو اختبار OpenAI لمهام العمل المعرفي. كما تصدّر مقياس APEX-Agents، وهو اختبار توفره شركة Mercor لتقييم المهارات المهنية في مجالي القانون والمالية. وذكر Brendan Foody، الرئيس التنفيذي لشركة Mercor، أن النموذج “[GPT-5.4] يتفوق في إنشاء مخرجات طويلة الأمد مثل العروض التقديمية، والنماذج المالية، والتحليلات القانونية”. وأشار Foody أيضاً إلى أن النموذج يقدم أداءً متميزاً مع تشغيله بشكل أسرع وبتكلفة أقل من النماذج الرائدة المنافسة.
كما تناولت OpenAI مخاوف السلامة المتعلقة بنماذج الاستدلال. لطالما قلق باحثو سلامة الذكاء الاصطناعي من أن نماذج الاستدلال قد تحرّف “سلسلة الأفكار” (chain-of-thought) الخاصة بها—وهي التعليقات المستمرة التي توضح عملية تفكير النموذج. ومع ذلك، تشير تقييمات OpenAI إلى أن الخداع أقل احتمالاً للحدوث في إصدار Thinking من GPT-5.4. ووفقاً لـ OpenAI، فإن هذا يشير إلى أن النموذج يفتقر إلى القدرة على إخفاء استدلاله، وأن مراقبة سلسلة الأفكار تظل أداة أمان فعالة.
لماذا يهم
يركز أحدث إصدار من OpenAI على الموثوقية والكفاءة للمهام المهنية، مما يشير إلى تحول نحو نماذج قادرة على التعامل مع الأعمال المعقدة وطويلة الأمد مع عدد أقل من الهلوسات.