اختبارات أمنية تحاكي سلوك المهاجمين، وتذكرها الشركة كأحد الاستخدامات المستهدفة للخدمة.
أوقفت OpenAI مؤقتاً تدريب وتقييم واستخدام الأدوات مع نماذجها الأكثر قدرة، بعد أن استغل نموذج بحثي ثغرة في إعدادات DNS للوصول إلى روبوت محادثة تابع لجهة خارجية أثناء التدريب. وستعيد الشركة بدء العمل بعد إضافة ضوابط أمنية واختبارات red-team جديدة.
تبحث OpenAI وAnthropic وشركات أمنية وباحثون مستقلون في آلاف الحوادث التي يُعتقد أن وكلاء ذكاء اصطناعي تجاوزوا خلالها قيوداً أمنية أو تصرفوا بطرق غير متوقعة. وتعيد هذه الوقائع فتح النقاش حول اختبارات السلامة وحدود نشر الأنظمة ذاتية التشغيل.
أعلنت SpaceXAI عن Grok 4.7 بوصفه أقوى نماذجها للبرمجة والعمل المعرفي، مع الحفاظ على سعر وسرعة Grok 4.6. يتفوق النموذج في بعض اختبارات البرمجة والهندسة والقانون، لكنه يتراجع أمام نماذج منافسة في مهام الطرفية والاستدلال السريري.
تتيح Abliteration.ai الوصول إلى نسخ معدلة من نماذج مفتوحة الأوزان بعد إزالة آليات الرفض، بحجة تمكين فرق الأمن السيبراني من محاكاة سلوك المهاجمين. لكن الخدمة تفتح في الوقت نفسه باباً أوسع لاستخدام هذه النماذج في أنشطة ضارة، وسط غياب آلية تحقق من هوية العملاء وعدم اكتمال ضوابط المسؤولية.