Anthropic قد أطلقت أحدث نموذج للذكاء الاصطناعي الخاص بها Claude Opus 5.5. تم إصدار هذا الإصدار الجديد بعد حوالي شهرين من الترقية الأخيرة لنموذج Opus، مما يتماشى مع وتيرة التحديثات السابقة لـ Anthropic. تقدم Anthropic حاليًا عدة نماذج مختلفة من الذكاء الاصطناعي، تشمل بشكل رئيسي Haiku (الأصغر والأرخص)، Sonnet (متوسط الحجم والسعر) و Opus (الأكبر والأغلى من بين النماذج الثلاثة). بالإضافة إلى ذلك، هناك Fable/Mythos، وهو خيار متقدم يتمتع بقدرات وتكاليف أعلى.
تقوم هذه الإصدارة بترقية نموذج Opus من الإصدار 5 إلى الإصدار 5.5. وأشارت Anthropic إلى أن Opus 5.5 هو أول نموذج بعد الدعوة للتطورات الرائدة. كما هو الحال مع النماذج السابقة، تم اختباره من قبل مقيمين خارجيين قبل الإصدار، بما في ذلك METR و Frontier Design. في أكثر اختباراتنا شمولاً، حقق أعلى الدرجات حتى الآن.
تحسينات ملحوظة في أداء Opus 5.5
أعربت Anthropic عن أن أداء Opus 5.5 يمثل تقدمًا ملحوظًا، حيث تم تحسينه بشكل كبير مقارنةً بـ Opus 5. هذا هو نموذج رائد جديد، وقد شهد الم testers الأوائل قفزة كبيرة في الأداء في أكثر المهام تعقيدًا. أكمل أحد الم testers في أقل من يوم مهمة ترحيل كود مكون من 680,000 سطر، بينما عادة ما تتطلب هذه المهمة فريق هندسي لأسابيع. وقد أظهر أداءً ممتازًا في البحث عن الكفاءات وإصلاحها في البرمجيات: عندما طلبنا منه تقليل وقت تحميل كل صفحة من تطبيق ويب، نجح Opus 5.5 في 40 من أصل 39 مرة، بينما كانت تحسينات Opus 5 أقل، وتغير سلوك التطبيق.
علاوة على ذلك، جعل أحد الم testers نماذج Claude المختلفة تبني لعبة من تلميح واحد؛ حيث سجل Opus 5.5 درجات أعلى من جميع النماذج الأخرى من حيث الرسوميات والمظهر.
فيما يتعلق بالبرمجة، ذكرت Anthropic أن Opus 5.5 يتفوق بشكل خاص في المهام الطويلة والمعقدة، مثل ترحيل وتدقيق مكتبات الكود بالكامل. استخدم أحد الم testers الأوائل النموذج لمراجعة وإصلاح مكتبة كود مكونة من 200,000 سطر في أقل من ثلاث ساعات، بينما استغرق Opus 5 أكثر من 20 ساعة واستخدم 2.5 مرة من العلامات. في اختبار داخلي، طلبنا من Opus 5.5 و Fable 5.1 ترجمة برنامج HAProxy الشائع الاستخدام من لغة C إلى Rust.
تمت إعادة كتابة كلا النموذجين تقريبًا بنجاح في اختبارات HAProxy الخاصة به، لكن Opus 5.5 استغرق 9.5 ساعة، بينما استغرق Fable 5.1 12 ساعة، مما أدى إلى تقليل التكلفة بنسبة 51%. يقدم Opus 5.5 نتائج رائدة بتكاليف أقل عند القيام بالبرمجة الذاتية.
Opus 5.5 يقدم قيمة أفضل من الإصدارات السابقة
في مستوى الجهد الافتراضي، تبلغ تكلفة Opus 5.5 لكل مهمة حوالي 20% من تكلفة GPT-6 Astra. في اختبار Terminal Bench 4.0، كانت أداؤه مشابهًا لـ Astra، لكن التكلفة كانت حوالي 40%، بينما في اختبار CursorBench، تفوق على GPT-5.6 Sol بفارق 11 نقطة، وكانت التكلفة حوالي ثلث التكلفة. بالإضافة إلى ذلك، فإن تسعير Opus 5.5 أكثر تنافسية مقارنةً بـ Opus 5 بعد التعديل: تتطلب Opus 5.5 موارد حسابية أقل من Opus 5، ويعكس التسعير ذلك.
تظهر اختباراتنا أنه في الإعدادات الافتراضية، تكلفة Opus 5.5 على أحمال العمل النموذجية أقل بنسبة 40% من تكلفة Opus 5. تكلفة علامات الإدخال والإخراج هي $4 و $20 لكل مليون على التوالي، وهو أقل بنسبة 20% من Opus 5. تكلفة قراءة الذاكرة (التي تمثل الجزء الأكبر من تكاليف العمل المستقل والترميز) هي $0.20 لكل مليون، وهو أقل بنسبة 60% من Opus 5. كما أن سرعة توليد الإخراج في Opus 5.5 أسرع بأكثر من 30% مقارنةً بـ Opus 5.
بالإضافة إلى انخفاض الأسعار، سنقوم بزيادة حد الاستخدام لخمس ساعات في خطط Pro و Max و Team. كما نقدم لمستخدمي الاشتراك إعادة تعيين حدود السرعة، والتي يمكن حفظها واستخدامها في أي وقت. تم إطلاق نموذج Claude Opus 5.5 الجديد. وعند النظر إلى المستقبل، صرحت Anthropic أن نماذج Claude Sonnet 5.5 و Claude Haiku 5.5 ستصدر في الأسابيع المقبلة، مع العديد من نفس التحسينات في الأداء والكفاءة والسلامة.
البند المواصفات قدرة نقل الشيفرة 680,000 سطر من الشيفرة في أقل من يوم وقت تدقيق مستودع الشيفرة 200,000 سطر من الشيفرة في أقل من ثلاث ساعات وقت ترجمة HAProxy 9.5 ساعات (أقل من 12 ساعة لـ Fable 5.1)
اقرأ المقال الأصلي على techritual.com (بالصينية التقليدية) →
The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.

