Anthropic وOpenAI تطلقان أحدث نماذج الذكاء الاصطناعي وسط جدل إبطاء التطوير

اليوم 7 0 تعليق ارسل طباعة تبليغ حذف

أطلقت شركتا Anthropic وOpenAI أحدث نماذجهما الرئيسية للذكاء الاصطناعي، في وقت يتصاعد فيه النقاش داخل صناعة التكنولوجيا حول سرعة تطوير النماذج المتقدمة والمخاوف المتعلقة بسلامة الذكاء الاصطناعي وتأثيره المحتمل على البشر، وتقدم Anthropic نموذج Claude Opus 5.5، بينما كشفت OpenAI عن GPT-6 Sol إلى جانب نموذج أصغر يحمل اسم GPT-6 Luna، مع تركيز الشركتين على تقديم أداء أعلى بتكلفة تشغيل أقل، خصوصًا في مجالات البرمجة واستخدام الحاسوب وأداء مهام الأعمال.

Claude Opus 5.5.. أداء أعلى وتكلفة أقل
 

وصفت Anthropic نموذج Claude Opus 5.5 بأنه أول إصدار ضمن عائلة Claude 5.5، وأعلنت أنه نموذجها الرئيسي الجديد للبرمجة واستخدام الحاسوب والمهام المعقدة، وتقول الشركة إن النموذج يستطيع تحقيق أداء مماثل لنموذجها الأكبر Claude Fable 5.1 في العديد من مهام العمل، مع تكلفة تشغيل أقل بنحو 40% ، كما خفضت Anthropic أسعار استخدام النموذج إلى 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز إخراج، مقارنة بـ5 دولارات و25 دولارًا على التوالي في النموذج السابق.

وأظهرت الاختبارات التي نشرتها الشركة حصول Opus 5.5 على 66.4% في اختبار البرمجة Terminal-Bench 4.0، مقابل 55.8% لنموذج Claude Fable 5.1، وفي اختبار GDPval-AA v2.1 الخاص بمهام المعرفة والعمل المكتبي، سجل Opus 5.5 نحو 1,846 نقطة، مقابل 1,735 نقطة لنموذج Fable 5.1، وتشير Anthropic كذلك إلى أن النموذج الجديد يحتاج إلى قدرة حوسبية أقل، وينتج الإجابات بسرعة تزيد بأكثر من 30% مقارنة بـOpus 5، مع تركيز إضافي على وضوح الكتابة وتقليل استخدام المصطلحات المعقدة.

opus
opus

 

OpenAI تخفض تكلفة GPT-6 Sol
 

في المقابل، أطلقت OpenAI نموذجي GPT-6 Sol وGPT-6 Luna، لينضما إلى GPT-6 Astra الذي تقدمه الشركة باعتباره نموذجها الأقوى، وتستهدف OpenAI نموذج Sol لتنفيذ المهام الأكثر تعقيدًا، خاصة البرمجة والمهام التي تتطلب استخدام الحاسوب، بينما يركز Luna على المهام ذات الحجم الكبير مثل تلخيص المستندات واستخراج المعلومات، وتبلغ تكلفة GPT-6 Sol نحو 2 دولار لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج، بانخفاض عن 4 دولارات و20 دولارًا على التوالي في GPT-5.6 Sol، وتعزو OpenAI انخفاض الأسعار إلى تحسينات في تقنيات التخزين المؤقت وعمليات الاستدلال، كما تقول إن النماذج الجديدة ترتكب أخطاء أقل في المعلومات والبرمجة.

openai
openai

 

اختبارات للبرمجة واستخدام الحاسوب
 

تقول OpenAI إن GPT-6 Sol حقق 56.4% في اختبار Agents’ Last Exam عند استخدام أعلى مستوى من الجهد، بينما سجل 60.5% في اختبار OSWorld 2.0 Offline عند مستوى xhigh، مقارنة بـ60.3% لنموذج Claude Opus 5 عند مستوى medium، وتشير الشركة إلى أن GPT-6 Sol حقق هذه النتيجة في اختبار OSWorld بتكلفة أقل بنحو 80% لكل مهمة، وفقًا لبياناتها الداخلية، كما قالت OpenAI إن GPT-6 Sol وGPT-6 Luna يمثلان نماذجها الأكثر توافقًا مع متطلبات السلامة حتى الآن.

إطلاق نماذج جديدة رغم دعوات إبطاء تطوير الذكاء الاصطناعي
 

يأتي إطلاق النموذجين في ظل نقاش متزايد داخل قطاع التكنولوجيا بشأن ما إذا كان ينبغي إبطاء تطوير نماذج الذكاء الاصطناعي المتقدمة بسبب مخاوف تتعلق بالسلامة، وكان الرئيس التنفيذي لـAnthropic، داريو أمودي، قد دعا إلى اتباع نهج أكثر حذرًا في تطوير نماذج الذكاء الاصطناعي المتقدمة، بينما تحدث مسؤولون وباحثون في القطاع عن الحاجة إلى وضع ضوابط وتنظيمات أكثر صرامة مع تطور قدرات النماذج.

وفي المقابل، لا يوجد توافق داخل قطاع التكنولوجيا على فكرة إبطاء التطوير، إذ أبدى عدد من قادة شركات التكنولوجيا مواقف معارضة لمثل هذه المقترحات،وتقول Anthropic إن Claude Opus 5.5 خضع لاختبارات خارجية قبل إطلاقه، شملت جهات تقييم مستقلة، كما أعلنت الشركة أنه حقق أفضل أداء لديها حتى الآن في اختبار سلوكي آلي يتعلق بالتوافق مع متطلبات السلامة، ومن المنتظر أن توسع Anthropic عائلة Claude 5.5 خلال الأسابيع المقبلة بإطلاق نماذج Sonnet 5.5 وHaiku 5.5، مع التركيز على خفض التكلفة وتحسين الأداء والكفاءة والسلامة.

أخبار ذات صلة

0 تعليق