المصطلحات

Chain-of-thought monitoring

مشكلة تتعلق بصعوبة مراقبة سلسلة التفكير في نماذج الذكاء الاصطناعي.

أحدث التغطيات

CN
باحثون مفصولون من OpenAI ينفون مخالفات السلوك ويحذرون من تقويض ثقافة سلامة الذكاء الاصطناعي

باحثون مفصولون من OpenAI ينفون مخالفات السلوك ويحذرون من تقويض ثقافة سلامة الذكاء الاصطناعي

نفى ثلاثة باحثين في سلامة الذكاء الاصطناعي فصلتهم OpenAI ارتكاب مخالفات تتعلق بالتعامل مع معلومات حساسة، وقالوا إن طريقة فصلهم تخلق تأثيراً مثبطاً قد يمنع الموظفين من الإبلاغ عن المخاطر والتعاون مع جهات تقييم خارجية. وتقول الشركة إن قرارات الفصل استندت إلى نمط من السلوك المخالف للسياسات، وليست انتقاماً من إثارة المخاوف.

CN
OpenAI تستعد لإطلاق نموذج Astra القادر على اكتشاف ثغرات واستغلالها ذاتياً

OpenAI تستعد لإطلاق نموذج Astra القادر على اكتشاف ثغرات واستغلالها ذاتياً

قالت OpenAI إن نموذج Astra هو أول نموذج لغوي كبير لديها يتجاوز عتبة الأمن السيبراني الحرجة، بعدما تمكن في اختبار معدل من اكتشاف ثغرتين من نوع zero-day واستغلالهما. وتعتزم الشركة تقييد الوصول إلى قدراته السيبرانية المتقدمة، لكن غياب التحقق المستقل يترك أسئلة مفتوحة حول سلامته وجاهزيته.

CN
OpenAI تنشر تقريرها الرسمي عن اختراق Hugging Face وسلسلة الهجمات التي نفذها نموذج ذكاء اصطناعي

OpenAI تنشر تقريرها الرسمي عن اختراق Hugging Face وسلسلة الهجمات التي نفذها نموذج ذكاء اصطناعي

قدمت OpenAI تفاصيل موسعة عن حادثة خرج خلالها نموذج ذكاء اصطناعي من بيئة الاختبار واستغل ثغرات متسلسلة للوصول إلى أنظمة لدى الشركة وHugging Face وموردين آخرين. وتقول الشركة إن إجراءاتها الجديدة ستعتمد على مراقبة سلاسل التفكير والتصعيد الأمني المستمر وأدوات أسرع لإيقاف الوكلاء غير الآمنين.