أطلقت Anthropic وOpenAI نماذج جديدة تستهدف الاستخدامات المهنية، مع الجمع بين تحسين الأداء وخفض تكلفة تشغيل النماذج. ويأتي ذلك في وقت تزداد فيه أهمية الكفاءة الاقتصادية وقابلية الاعتماد على النماذج في البرمجة والمهام المؤسسية، إلى جانب الجدل المستمر حول سلامة النماذج المتقدمة.
Opus 5.5 يركز على المهام المعقدة
كشفت Anthropic عن نموذج Opus 5.5، الذي تقول إنه يحسن التعامل مع المهام المعقدة، واكتشاف عيوب البرمجيات وإصلاحها، وتحليل البيانات المالية وتنفيذ مهام الأعمال. وتشير اختبارات الشركة إلى تفوق النموذج على GPT-6 Astra في مهام البرمجة الوكيلة ضمن اختباري Terminal-Bench 4.0 وFrontierCode v1.1 (Main).
وتقول Anthropic إن النموذج ينتج نصوصاً أوضح، وأصبح أقل ميلاً إلى محاولة تجاوز الحدود والضوابط بنسبة 85% مقارنةً بالنماذج السابقة. كما خفضت الشركة سعر مليون رمز إدخال إلى 4 دولارات، ومليون رمز إخراج إلى 20 دولاراً، مقابل 5 دولارات و25 دولاراً على التوالي في نموذج Opus 5.
ثلاثة مستويات مختلفة من التكلفة لدى OpenAI
أطلقت OpenAI نموذجَي GPT-6 Sol وGPT-6 Luna، مع تحسينات في العمل الاحترافي والبرمجة واستخدام الحاسوب. وتقول الشركة إن تكلفة النموذجين أقل بنسبة تصل إلى 50% مقارنةً بالأسعار الترويجية لنماذج GPT-5.6.
يبلغ سعر مليون رمز إدخال في GPT-6 Sol دولارين، مقابل 10 دولارات للإخراج. أما GPT-6 Luna فسعر مليون رمز إدخال فيه 10 سنتات، ومليون رمز إخراج 50 سنتاً. ووفق OpenAI، يرتكب GPT-6 Sol نحو نصف عدد الأخطاء التي كان يرتكبها النموذج السابق، كما يحقق في البرمجة مستوى أداء مماثلاً لـ Fable 5.1 بتكلفة أقل.
وتتضمن التحسينات أيضاً وضوحاً أكبر في التواصل ودعم تخزين سياق الأوامر مؤقتاً، ما يتيح إعادة استخدام قدر أكبر من السياق وتسريع الاستجابات.
ما الذي يتغير عملياً؟
تمنح الأسعار الجديدة المطورين والشركات مجالاً أوسع لاستخدام النماذج في مهام متكررة أو كثيفة الاستدعاءات، بينما تستهدف النماذج الأعلى قدرة أعمال البرمجة والتحليل والتنفيذ الوكيل. لكن الأرقام الواردة بشأن التفوق والدقة والسلامة صادرة عن اختبارات الشركات نفسها، ولذلك لا تثبت وحدها تفوقاً عاماً في جميع الاستخدامات أو البيئات.
تحسينات السلامة والتوفر
تقول OpenAI إن نماذج GPT-6 أصبحت أقل ميلاً إلى تقديم معلومات غير صحيحة عن نتائج مهام البرمجة، وأكثر رفضاً لمحاولات تجاوز إجراءات الحماية عند تلقي أوامر غير آمنة. وتعمل الشركتان على اقتراح معايير يمكن لجهات تقييم خارجية استخدامها لقياس تطور النماذج وسلامتها، لكن لم يتضح بعد ما إذا كانت هذه المقترحات ستتحول إلى معيار موحد.
يتوفر Opus 5.5 عبر Claude، إضافة إلى Amazon Web Services وGoogle Cloud وMicrosoft Azure. ويتوفر GPT-6 Sol وGPT-6 Luna عبر ChatGPT Work وCodex لعملاء خطط Plus وPro وBusiness وEnterprise، بينما يحصل مستخدمو الخطة المجانية ومشتركو Go على GPT-6 Luna فقط عبر تطبيق الشركة للحاسوب.
كيف أعددنا هذا الخبر؟
اعتمد الخبر على المصدر الأصلي الموضح أعلاه. قد نستخدم أدوات آلية للمساعدة في الاستخراج والتصنيف والصياغة،
لكن النشر يخضع لقواعد تمنع المحتوى المكرر والقصير أو الروتيني منخفض القيمة.
اقرأ سياستنا التحريرية.