الاثنين، 3 أغسطس 2026

الذكاء الاصطناعي

Anthropic تعيد تصميم اختبارات التوظيف بعد أن أصبحت نماذج الذكاء الاصطناعي تضاهي أداء البشر

تعيد شركة Anthropic تصميم اختبارات التوظيف التقنية الخاصة بها لأن أحدث نماذج الذكاء الاصطناعي لديها، وتحديداً Claude Opus 4.5، أصبحت قادرة على مضاهاة أداء أفضل المرشحين من البشر.

Anthropic redesigns hiring tests as AI models match human performance
صورة: Anthropic

منذ عام 2024، دأب فريق تحسين الأداء في شركة Anthropic على تقديم اختبار منزلي للمتقدمين للوظائف -وهو تقييم تقني للتوظيف- لتقييم قدراتهم. ومع ذلك، تعيد الشركة الآن تصميم هذا الاختبار بشكل متكرر لأن نماذج الذكاء الاصطناعي الخاصة بها أصبحت تضاهي أداء المرشحين من البشر أو تتفوق عليهم. وقد وصف Tristan Hume، وهو قائد فريق في Anthropic، تاريخ هذا التحدي في تدوينة يوم الأربعاء. وذكر Hume أن كل نموذج جديد من Claude قد أجبر الفريق على إعادة تصميم الاختبار. ووفقاً لـ Hume، فعند منح النموذج نفس الوقت المحدد، تفوق نموذج Claude Opus 4 على معظم المتقدمين من البشر. وفي حين أن ذلك الأداء كان لا يزال يسمح للشركة بتمييز أقوى المرشحين، فإن نموذج Claude Opus 4.5 اللاحق قد ضاهى حتى أداء هؤلاء المرشحين المتميزين من البشر.

وعلى الرغم من أن Anthropic تسمح صراحةً للمرشحين باستخدام أدوات الذكاء الاصطناعي في الاختبار المنزلي، إلا أن التقدم السريع لهذه النماذج قد خلق مشكلة كبيرة في تقييم المرشحين. فإذا لم يعد بإمكان المرشحين من البشر تحسين مخرجات النموذج، فإن الاختبار لا يقيس سوى النماذج المختلفة المستخدمة بدلاً من تحديد أفضل المواهب. وكتب Hume: “في ظل قيود الاختبار المنزلي، لم يعد لدينا طريقة للتمييز بين مخرجات أفضل مرشحينا وأكثر نماذجنا قدرة”.

ولحل هذه المشكلة، صمم Hume اختباراً جديداً يركز بشكل أقل على تحسين الأجهزة، مما يجعله مبتكراً بما يكفي لإرباك أدوات الذكاء الاصطناعي المعاصرة. وكجزء من تدوينته، شارك أيضاً الاختبار الأصلي لمعرفة ما إذا كان بإمكان أي شخص تطوير حل أفضل. وقد وجه Hume تحدياً مفتوحاً للمتقدمين، كاتباً أنه إذا تمكنوا من التفوق على Claude Opus 4.5، فإن الشركة تود التواصل معهم. ويسلط هذا الموقف الضوء على مفارقة أوسع: إذ تعاني مختبرات الذكاء الاصطناعي الآن من نفس مشكلات الاختبارات المدعومة بالذكاء الاصطناعي التي عطلت المدارس والجامعات حول العالم.

لماذا يهم

يخلق التقدم السريع لنماذج الذكاء الاصطناعي مثل Claude Opus 4.5 أزمة تقييم جديدة لأصحاب العمل. لم تعد الاختبارات التقنية القياسية كافية للتمييز بين أفضل المواهب البشرية ومخرجات الآلة، مما يجبر الشركات على تطوير طرق تقييم جديدة تماماً.