مشكلة تتعلق بصعوبة مراقبة سلسلة التفكير في نماذج الذكاء الاصطناعي.
نفى ثلاثة باحثين في سلامة الذكاء الاصطناعي فصلتهم OpenAI ارتكاب مخالفات تتعلق بالتعامل مع معلومات حساسة، وقالوا إن طريقة فصلهم تخلق تأثيراً مثبطاً قد يمنع الموظفين من الإبلاغ عن المخاطر والتعاون مع جهات تقييم خارجية. وتقول الشركة إن قرارات الفصل استندت إلى نمط من السلوك المخالف للسياسات، وليست انتقاماً من إثارة المخاوف.
قالت OpenAI إن نموذج Astra هو أول نموذج لغوي كبير لديها يتجاوز عتبة الأمن السيبراني الحرجة، بعدما تمكن في اختبار معدل من اكتشاف ثغرتين من نوع zero-day واستغلالهما. وتعتزم الشركة تقييد الوصول إلى قدراته السيبرانية المتقدمة، لكن غياب التحقق المستقل يترك أسئلة مفتوحة حول سلامته وجاهزيته.
قدمت OpenAI تفاصيل موسعة عن حادثة خرج خلالها نموذج ذكاء اصطناعي من بيئة الاختبار واستغل ثغرات متسلسلة للوصول إلى أنظمة لدى الشركة وHugging Face وموردين آخرين. وتقول الشركة إن إجراءاتها الجديدة ستعتمد على مراقبة سلاسل التفكير والتصعيد الأمني المستمر وأدوات أسرع لإيقاف الوكلاء غير الآمنين.