أطلقت شركة أنثروبيك رسميًا نموذج Claude Opus 5.5، مع تحسينات في البرمجة والعمل المعرفي والوكلاء والسلامة وكفاءة التشغيل. تمكن نموذج Claude Opus 5.5 خلال ساعات من الإطلاق من تسجيل 58 نقطة على مؤشر Artificial Analysis Intelligence Index المستقل، وهي أعلى نتيجة سجلتها منصة Artificial Analysis حتى الآن.
يتوفر نموذج Claude Opus 5.5 لمستخدمي خطط Pro و Max و Team و Enterprise، كما يمكن للمطورين الوصول إليه عبر منصة Claude Platform وعدد من الخدمات السحابية. حددت شركة أنثروبيك سعر مليون رمز إدخال عند 4 دولارات ومليون رمز إخراج عند 20 دولارًا، بانخفاض 20% عن أسعار نموذج Claude Opus 5، بينما تصل وفورات التشغيل المعتادة إلى نحو 40% بسبب انخفاض استخدام الرموز وتكلفة الذاكرة المؤقتة.
سجل نموذج Claude Opus 5.5 نتيجة 58 على مؤشر Artificial Analysis Intelligence Index عند استخدام أعلى مستوى للاستدلال، مقارنة بنتيجة 53 التي كانت تمثل صدارة المؤشر قبل الإطلاق. يعتمد المؤشر على 10 اختبارات تقيس مجالات تشمل البرمجة والاستدلال العلمي والعمل المعرفي واستخدام الأدوات وتنفيذ المهام باستخدام الوكلاء.
تصدر نموذج Claude Opus 5.5 ستة من الاختبارات العشرة داخل المؤشر المستقل. سجل النموذج 61.4% في اختبار Humanity's Last Exam و66.9% في اختبار SciCode، كما وصل إلى 59.6% في Terminal-Bench 4.0، وهي نتيجة تضعه عند مستوى نموذج GPT-6 Astra في هذا الاختبار.
تعكس النتائج تقدمًا واضحًا مقارنة بنموذج Claude Opus 5 الذي سجل 51 نقطة في نسخة سابقة من المؤشر. تبقى الاختبارات المعيارية أداة لقياس قدرات محددة، لذلك لا تعني الصدارة بالضرورة تقديم أفضل نتيجة في كل نوع من مهام الاستخدام الفعلي.
أشارت أنثروبيك من جانبها إلى تقدم كبير في الأعمال البرمجية طويلة المدى. تمكن أحد المختبرين الأوائل من استخدام نموذج Claude Opus 5.5 لإكمال عملية نقل مشروع برمجي يضم 680 ألف سطر من الشيفرة خلال أقل من يوم، وهي مهمة قدرت الشركة أنها كانت ستحتاج إلى أسابيع من فريق هندسي.
أظهر نموذج Claude Opus 5.5 كذلك قدرة أفضل على اكتشاف مشكلات الأداء في البرمجيات وإصلاحها. نجح النموذج في اختبار داخلي لدى أنثروبيك في تحسين زمن تحميل صفحات تطبيق ويب في 39 حالة من أصل 40، بينما قدم الجيل السابق تحسينات أقل وأثر أحيانًا في سلوك التطبيق.
يبدأ سعر نموذج Claude Opus 5.5 عند 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز إخراج، مقارنة بـ 5 و25 دولارًا في نموذج Claude Opus 5. انخفض سعر قراءة الذاكرة المؤقتة من 0.50 إلى 0.20 دولار لكل مليون رمز، وهو عامل مهم في مهام البرمجة والوكلاء التي تعيد استخدام السياق لفترات طويلة.
أوضحت أنثروبيك أن الجمع بين التسعير الجديد واستخدام رموز نصية أقل يخفض تكلفة تشغيل المهام المعتادة بنحو 40% مقارنة بنموذج Claude Opus 5. ارتفعت سرعة إخراج نموذج Claude Opus 5.5 أيضًا بأكثر من 30%، فيما يتوفر وضع Fast Mode بسرعات تصل إلى 2.5 ضعف مقابل تكلفة أعلى.
ركزت أنثروبيك كذلك على السلامة، حيث سجل نموذج Claude Opus 5.5 أفضل نتيجة حققتها نماذج الشركة في التدقيق السلوكي الآلي. أصبح النموذج أقل ميلًا لتنفيذ إجراءات يصعب التراجع عنها أو التصرف خارج حدود المهمة، مع مقاومة أفضل لهجمات Prompt Injection التي تحاول تغيير تعليماته أثناء استخدام الأدوات.
يمثل نموذج Claude Opus 5.5 بداية عائلة جديدة، إذ أكدت شركة أنثروبيك وصول نموذج Claude Sonnet 5.5 ونموذج Claude Haiku 5.5 خلال الأسابيع المقبلة مع عدد من تحسينات الأداء والكفاءة والسلامة نفسها.
Loading ads...
أرى أن الصدارة المستقلة في مؤشر Artificial Analysis مهمة، لكن خفض تكلفة التشغيل قد يكون العنصر الأكثر تأثيرًا للمستخدمين والشركات. كما أن تقديم أداء أعلى مع استخدام موارد أقل يجعل Claude Opus 5.5 أكثر عملية في المهام الطويلة، بينما ستحدد الاختبارات المستقلة المستمرة مدى حفاظه على هذه الصدارة أمام الإصدارات الجديدة من المنافسين.
لقراءة المقال بالكامل، يرجى الضغط على زر "إقرأ على الموقع الرسمي" أدناه
اقرأ أيضاً




