أنثروبيك تطلق Claude Sonnet 5.5 بسرعة أكبر وتكلفة أقل

منذ 49 دقيقة

كشفت شركة أنثروبيك عن أحدث نماذجها للذكاء الاصطناعي Claude Sonnet 5.5، في خطوة تستهدف تحسين سرعة تنفيذ المهام اليومية وخفض التكلفة الفعلية للاستخدام، مع تطوير قدراته في البرمجة وإنشاء المستندات والتعامل مع البيانات والصور.

وتضع الشركة الإصدار الجديد ضمن عائلة Claude 5.5 إلى جانب نموذج Claude Opus 5.5، مع اختلاف واضح في طبيعة الاستخدام؛ إذ يستهدف Sonnet 5.5 المهام اليومية المحددة التي تتطلب سرعة وكفاءة، بينما صُمم Opus 5.5 للتعامل مع المهام الأكثر تعقيدًا والتي تحتاج إلى استدلال وحكم مستمرين.

ما الجديد في Claude Sonnet 5.5؟

يقدم النموذج الجديد مجموعة من التحسينات مقارنة بـClaude Sonnet 5، الذي أطلقته أنثروبيك قبل نحو ثلاثة أشهر.

وتتركز أبرز التطورات في أربعة محاور رئيسية:

- سرعة استجابة أعلى بأكثر من 30%.

- استهلاك أقل للرموز اللازمة لإنجاز المهمة.

- تحسن ملحوظ في البرمجة والعمل المعرفي.

- قدرات أقوى في إنشاء المستندات والعروض التقديمية وجداول البيانات.

وبحسب أنثروبيك، فإن هذه التحسينات تجعل النموذج مناسبًا للمهام التي تتطلب تكرارًا سريعًا للتجربة والتعديل، خصوصًا عندما لا تكون المهمة بحاجة إلى القدرات الاستدلالية الأعلى الموجودة في نموذج Opus.

— Anthropic (@AnthropicAI) This is a Twitter Status

سرعة Claude Sonnet 5.5 تتجاوز 30%

تعد السرعة أبرز ما تراهن عليه أنثروبيك في الإصدار الجديد.

وتقول الشركة إن Claude Sonnet 5.5 يولد النتائج بأكثر من 30% سرعة مقارنة بـSonnet 5، ليصبح أسرع نموذج ضمن سلسلة Sonnet التي تقدمها الشركة.

ولا يعتمد انخفاض تكلفة الاستخدام على تغيير سعر الرموز نفسها، وإنما على قدرة النموذج على إنجاز المهام باستخدام عدد أقل منها.

وتشير اختبارات أنثروبيك إلى أن Sonnet 5.5 قد يكلف نحو 30% أقل لكل مهمة مقارنة بالإصدار السابق، رغم بقاء أسعار الرموز الأساسية دون تغيير.

أسعار Claude Sonnet 5.5

أبقت أنثروبيك على هيكل التسعير نفسه الخاص بـSonnet 5، حيث تبلغ التكلفة:

- 2 دولار لكل مليون رمز إدخال.

- 10 دولارات لكل مليون رمز إخراج.

- 0.20 دولار لكل مليون رمز لقراءة الذاكرة المؤقتة.

وتكمن الفكرة الأساسية في أن المستخدم قد يدفع تكلفة أقل للمهمة الواحدة لأن النموذج يحتاج إلى عدد أقل من الرموز للوصول إلى النتيجة المطلوبة.

تحسن كبير في البرمجة

حصل Claude Sonnet 5.5 على قفزة ملحوظة في اختبارات البرمجة، وهي إحدى المجالات التي تركز عليها أنثروبيك بشكل كبير.

وفي اختبار Terminal-Bench 4.0، المخصص لقياس أداء نماذج الذكاء الاصطناعي في مهام البرمجة القائمة على الوكلاء، سجل Sonnet 5.5 نتيجة بلغت 70.6%، مقارنة بـ10.3% للإصدار Sonnet 5.

كما حقق نتائج قريبة من Opus 5.5 في اختبار CursorBench، الذي يعتمد على مهام مستمدة من جلسات برمجة حقيقية باستخدام منصة Cursor.

وأشارت أنثروبيك إلى أن النموذج أصبح أسرع في استيعاب بنية قواعد البرمجيات، كما أصبح أكثر كفاءة عند استخدام أدوات البرمجة.

ومن بين التحسينات المهمة قدرته على تنفيذ عدة استدعاءات للأدوات بصورة مجمعة، ما يقلل عدد الخطوات اللازمة لإنجاز المهمة ويحد من استهلاك الرموز.

أداء متقدم في مهام العمل والمعرفة

لم تقتصر التطورات على البرمجة، حيث أظهر Sonnet 5.5 تحسنًا في مجموعة من مهام العمل المعرفي التي تحاكي استخدام الذكاء الاصطناعي في الوظائف المختلفة.

وفي اختبار GDPval-AA، الذي يقيس أداء النماذج في مهام عملية مرتبطة بـ44 مهنة وتسع صناعات، أصبح أداء Sonnet 5.5 قريبًا من Opus 5.5، بينما سجل فارقًا كبيرًا مقارنة بـSonnet 5.

كما أظهرت الاختبارات تحسنًا في استخدام الحاسوب، وقراءة الرسوم البيانية، وتنفيذ المهام التي تمتد على فترة زمنية طويلة.

الذكاء الاصطناعي لإنشاء عروض تقديمية أكثر احترافية

تستهدف أنثروبيك أيضًا استخدام Sonnet 5.5 في الأعمال المكتبية، بما يشمل إنشاء العروض التقديمية والمستندات وجداول البيانات.

وتقول الشركة إن المختبرين الأوائل لاحظوا تحسنًا في قدرة النموذج على التواصل والتعاون مع المستخدم، إلى جانب اهتمام أكبر بالتنسيق والتصميم.

كما يستطيع النموذج اتباع قوالب جاهزة للعروض التقديمية وإضافة تحسينات بصرية إلى واجهات المستخدم.

وفي اختبار داخلي، طلبت أنثروبيك من النموذج إعداد عرض مكون من 10 شرائح اعتمادًا على مواد خاصة بأرباح إحدى الشركات المدرجة، ونصوص مكالمات النتائج المالية وقالب عرض محدد.

وبحسب الشركة، اعتبر خبيران أن النسخة الأولى من العرض كانت قابلة للإرسال دون تعديلات إضافية.

قدرات أفضل في فهم الصور

شهد Sonnet 5.5 أيضًا تحسينات في فهم المحتوى المرئي، بما يسمح له بالتعامل مع المعلومات الموجودة داخل الصور ولقطات الشاشة بصورة أفضل.

وتقول أنثروبيك إن النموذج أصبح أول إصدار من Sonnet يتفوق على لعبة Pokémon Red عند الاعتماد على لقطات الشاشة فقط، وهو اختبار تستخدمه الشركة لقياس قدرة النموذج على فهم المعلومات المرئية وتنفيذ مهام ممتدة.

كما حقق النموذج أداءً قويًا في التعرف على الرسوم البيانية واستخدام الحاسوب، إلى جانب تحسن في المهام التي تتطلب الاحتفاظ بالسياق لفترات طويلة.

ضوابط أمان إضافية للمهام السيبرانية

مع زيادة قدراته في مجال الأمن السيبراني، قررت أنثروبيك تطبيق ضوابط حماية إضافية على Sonnet 5.5.

وتقول الشركة إن القدرات السيبرانية للنموذج الجديد أصبحت مماثلة من حيث المستوى لقدرات Opus 5، ولذلك فهو أول نموذج من سلسلة Sonnet يتم إطلاقه مع إجراءات حماية وبدائل احترازية مماثلة لتلك المستخدمة في نماذجها الأكثر قدرة.

وتوضح أنثروبيك أن هذه الإجراءات تستهدف مجموعة محددة من الطلبات مرتفعة الخطورة، بينما لا تؤثر على الاستخدامات المعتادة لتطوير البرمجيات ومعظم تطبيقات علوم الحياة.

أما إجراءات السلامة المرتبطة بالمهام البيولوجية، فتظل مماثلة لتلك الموجودة في Sonnet 5.

Claude Haiku 5.5 قادم خلال أسابيع

تستعد أنثروبيك لإضافة نموذج آخر إلى عائلة Claude 5.5، مع إعلانها عن Claude Haiku 5.5 خلال الأسابيع المقبلة.

ويُعد Haiku النموذج الأصغر في منظومة Claude، وتوجهه الشركة نحو التطبيقات التي تحتاج إلى تنفيذ أعداد كبيرة من المهام مع الحفاظ على تكلفة منخفضة.

ولم تكشف أنثروبيك عن موعد محدد لإطلاق Haiku 5.5 حتى الآن.

✎

فريق تحرير اعرف سبورت

فريق التحرير في اعرف سبورت — نتابع الخبر من مصادره ونقدّمه لك محرَّراً ومراجَعاً على مدار الساعة.

أخبار ذات صلة

0 تعليق