أعلنت SpaceXAI في 21 سبتمبر بالتوقيت المحلي عن نموذج الذكاء الاصطناعي Grok 4.7، الذي تقدمه للشركات والمطورين باعتباره أقوى نماذجها المخصصة للبرمجة والعمل المعرفي. ويتوافر النموذج بسعر وسرعة Grok 4.6 نفسيهما، بينما تقول الشركة إنه أسرع بمرتين وأقل كلفة إلى النصف مقارنة بنماذج من الفئة نفسها.
ما الذي تغير في Grok 4.7؟
يعتمد النموذج على نموذج أساسي أكبر، مع تدريب أطول بالتعلم المعزز ومهام مركبة صُممت لمعالجة مسائل قد تستغرق ساعات حتى تكتمل. ووفق SpaceXAI، حسّن ذلك قدرة النموذج على مراجعة عمله والتعامل مع السياقات الطويلة. كما دُرّب على الفهم الأصلي لآلية تشغيل وكيل الشركة البرمجي Grok Bot، بهدف رفع أدائه في المهام الحوارية والعمل المعرفي العام.
وتشمل التحسينات إنشاء المستندات والعروض التقديمية، إلى جانب أداء المهام المتخصصة التي تحاكي أعمال المحامين والممرضين والمحللين الماليين. وفي اختبار GDPval سجل Grok 4.7 نتيجة Elo بلغت 1695، متقدماً على Grok 4.6 بنتيجة 1605 وGPT-6 Astra بنتيجة 1542، لكنه بقي خلف Fable 5.1 الذي سجل 1735.
نتائج متقدمة في بعض الاختبارات لا في جميعها
في CursorBench 4.0 للمهام البرمجية الطويلة، سجل Grok 4.7 نسبة 46.3%، مقابل 40.4% لـGrok 4.6 و41.7% لـGPT-5.6 Sol، بينما تصدر Fable 5.1 النتيجة بنسبة 51.8%. كما حقق النموذج أعلى نتيجة بين النماذج المقارنة في EEBench للهندسة الكهربائية بنسبة 64.0%، وفي Harvey Legal Agent Benchmark للمهام القانونية بنسبة 19.6%.
لكن التفوق لم يكن شاملاً؛ ففي Terminal-Bench 4.0 للمهام الطرفية الطويلة سجل 38.0%، مقابل 57.9% لـFable 5.1. وفي HealthBench Professional للاستدلال السريري بلغ 56.7%، خلف GPT-5.6 Sol عند 60.5% وFable 5.1 عند 62.1%. وتعني هذه النتائج أن اختيار النموذج سيظل مرتبطاً بنوع المهمة، لا بالترتيب العام أو السعر وحده.
السعر والتوافر
يبدأ سعر واجهة Grok API من دولارين لكل مليون رمز إدخال وستة دولارات لكل مليون رمز إخراج. وبالمقارنة، يبلغ سعر GPT-5.6 Sol أربعة دولارات للإدخال و20 دولاراً للإخراج، بينما يبلغ سعر Fable 5.1 عشرة دولارات للإدخال و50 دولاراً للإخراج. وتوفر SpaceXAI نسخة أسرع تبلغ سرعتها ضعف النسخة الأساسية، مع مضاعفة السعر أيضاً.
أصبح Grok 4.7 متاحاً في اليوم نفسه عبر Cursor وأداة البرمجة Grok Build، إضافة إلى Grok API وأدوات البرمجة التابعة لجهات خارجية، وموجّهات النماذج ومنصات الحوسبة السحابية.
السلامة والوصول إلى أدوات الاختبار
قالت SpaceXAI إنها أعادت تصميم آليات الحماية بالكامل، وحسّنت مقاومة محاولات كسر القيود ورفض الطلبات الخطرة. وسجل النموذج 62.4% في اختبار LatchBio للسلامة في مجال الأحياء، وهي أعلى نتيجة بين النماذج التي قارنتها الشركة. وفي HackerBench v0.3، مرر النموذج 3.3% فقط من الطلبات ذات الاستخدام المزدوج والمخاطر السيبرانية، مع قول الشركة إنه لا يحجب غالبية مهام الأمن المشروعة.
وبدأت SpaceXAI كذلك منح بعض شركاء الأمن السيبراني وصولاً بالدعوة إلى وظائف الفريق الأحمر لأغراض البحث الدفاعي. وتبقى هذه الادعاءات مرتبطة بالاختبارات التي اختارتها الشركة ومنهجياتها، كما أن تفاوت النتائج بين المجالات يفرض على فرق التطوير والأعمال تقييم النموذج وفق حالات الاستخدام الفعلية.
كيف أعددنا هذا الخبر؟
اعتمد الخبر على المصدر الأصلي الموضح أعلاه. قد نستخدم أدوات آلية للمساعدة في الاستخراج والتصنيف والصياغة،
لكن النشر يخضع لقواعد تمنع المحتوى المكرر والقصير أو الروتيني منخفض القيمة.
اقرأ سياستنا التحريرية.