الذكاء الاصطناعي
Anthropic تطلق نموذج Claude Sonnet 5 الأرخص والأكثر قدرة على العمل الذاتي
أطلقت شركة Anthropic نموذج Claude Sonnet 5، وهو نموذج أكثر قوة وقدرة على العمل الذاتي، ويعد بأداء يقترب من أداء Opus 4.8 بسعر أقل.
أصدرت شركة Anthropic نموذج Claude Sonnet 5، وهو نموذج جديد متوسط الحجم صُمم ليكون أكثر قوة وقدرة على العمل الذاتي مقارنةً بإصداراتها السابقة. وفي هذا السياق، يشير مصطلح “العمل الذاتي” (agentic) إلى نماذج الذكاء الاصطناعي القادرة على التخطيط، واستخدام أدوات مثل المتصفحات ومحطات العمل، والتصرف بشكل مستقل. ووفقاً لـ Anthropic، يمكن للنموذج وضع الخطط، واستخدام الأدوات، والعمل بشكل مستقل بمستوى كان يتطلب سابقاً نماذج أكبر وأكثر تكلفة. ويوم الثلاثاء، أصبح Claude Sonnet 5 النموذج الافتراضي لخطط الاستخدام المجانية والمدفوعة (Pro).
يتموضع هذا النموذج كبديل فعال من حيث التكلفة للنماذج الأكبر، بما في ذلك نموذج Opus 4.8 الخاص بـ Anthropic، ونموذج GPT-5.5 من OpenAI، ونموذج Gemini 3.1 Pro من Google. وذكرت Anthropic أنه بينما يظل Opus 4.8 هو النموذج المفضل للمهام التي تتطلب دقة أعلى، فإن Sonnet 5 يوفر للمطورين خياراً بسعر أقل وبجودة أعلى مما كان متاحاً في السابق. ويمكن للمستخدمين تعديل مستوى الجهد بين النموذجين لإيجاد التوازن المناسب بين التكلفة والأداء.
تم هيكلة تسعير Claude Sonnet 5 على النحو التالي:
- حتى 31 أغسطس: 2 دولار لكل مليون رمز (token) للإدخال، و10 دولارات لكل مليون رمز للإخراج.
- بعد 31 أغسطس: 3 دولارات لكل مليون رمز للإدخال، و15 دولاراً لكل مليون رمز للإخراج.
تشير تقارير Anthropic إلى تحسينات كبيرة في أداء العمل الذاتي لنموذج Sonnet 5 مقارنة بـ Sonnet 4.6، الذي تم إصداره في فبراير. وفي اختبار قياسي لبرمجة العمل الذاتي، سجل Sonnet 5 نسبة 63.2%، مقارنة بـ 58.1% لـ Sonnet 4.6 و69.2% لـ Opus 4.8. وقد أفاد المختبرون بأن النموذج يكمل بنجاح مهام معقدة ومتعددة الأجزاء كانت تتوقف سابقاً. وقال Daniel Shepard، وهو مهندس أول في شركة Zapier: “لقد أوكلنا إلى Claude Sonnet 5 مهمة من جزأين — تحديث مستويات حسابات Salesforce، وإرسال إعلان إطلاق إلى جهات الاتصال في المؤسسات — وقد أنجزها من البداية إلى النهاية. كانت هذه المهام تتوقف في منتصف الطريق سابقاً. بالنسبة للأتمتة اليومية، فهو خيار لا يحتاج إلى تفكير”.
وفيما يتعلق بالسلامة، تشير تقارير Anthropic إلى أن Sonnet 5 يُظهر معدلاً أقل من السلوكيات غير المرغوب فيها، مثل التعاون مع إساءة الاستخدام والخداع، مقارنة بالإصدارات السابقة. ويعد النموذج أفضل في رفض الطلبات الضارة وتجنب محاولات الاختطاف في هجمات حقن الأوامر (prompt-injection). كما أنه يهلوس وينخرط في سلوك تملقي (sycophantic) بمعدل أقل من Sonnet 4.6. ومع ذلك، فإنه يظل أقل قدرة من Opus 4.8 على تنفيذ مهام الأمن السيبراني الخطيرة، وليس في نفس المستوى فيما يتعلق بالسلوك غير المتوافق (misaligned behavior). وذكر Fabian Hedin، المؤسس المشارك لشركة Lovable، أن Claude Sonnet 5 يرفض الطلبات غير الآمنة بشكل نظيف ومتسق، مضيفاً أن النموذج القادر على رفض الطلبات غير الآمنة لا يقل أهمية عن النموذج الذي يعرف كيفية البناء.
لماذا يهم
يؤكد إطلاق Claude Sonnet 5 أن القدرة على العمل الذاتي أصبحت الآن التوقعات الأساسية لنماذج الذكاء الاصطناعي عبر جميع فئات الأسعار. لقد تحولت المنافسة الأساسية في السوق من أي مزود يمكنه تقديم عمل ذي طابع ذاتي إلى مدى رخص وموثوقية تنفيذ هذا العمل دون إشراف بشري.