الشركات

METR

جهة بحثية شاركت Redwood Research في التحقيق في جزء من حادثة Hugging Face.

أحدث التغطيات

CN
Anthropic وAccenture تطلقان شراكة لتقييم نماذج الذكاء الاصطناعي داخل الشركة

Anthropic وAccenture تطلقان شراكة لتقييم نماذج الذكاء الاصطناعي داخل الشركة

تتعاون Anthropic مع Accenture لإجراء تقييمات مستقلة واختبارات اختراق لنماذج الذكاء الاصطناعي المتقدمة من داخل الشركة، مع توقع استثمار مليار دولار على الأقل من كل طرف خلال خمس سنوات. وتكشف المبادرة عن نموذج جديد للرقابة، لكنه لا يزال يفتقر إلى معايير مستقرة للنفاذ والتمويل وإعداد التقارير.

CN
شركة AIUC تجمع 40 مليون دولار لتقييم سلامة وكلاء الذكاء الاصطناعي

شركة AIUC تجمع 40 مليون دولار لتقييم سلامة وكلاء الذكاء الاصطناعي

جمعت Artificial Intelligence Underwriting Company مبلغ 40 مليون دولار في جولة Series A لتطوير معيار AIUC-1 وخدمة تدقيق مستقلة لوكلاء الذكاء الاصطناعي. وتختبر الشركة الوكلاء في نحو 5,000 سيناريو تشمل كسر الحواجز والهلوسة وتسرب البيانات، قبل إصدار تقرير تدقيق تتحقق منه فرق بشرية.

CN
رئيس Anthropic يطرح خطة لإبطاء سباق الذكاء الاصطناعي المتقدم

رئيس Anthropic يطرح خطة لإبطاء سباق الذكاء الاصطناعي المتقدم

اقترح Dario Amodei ثلاث آليات لـ«إبطاء وتيرة التقدم» في نماذج الذكاء الاصطناعي، تشمل مراقبين مستقلين داخل الشركات، ومعايير سلامة مشتركة، وتنسيقاً دولياً. وتلتزم Anthropic من جانبها بإتاحة وصول موسع لمقيّمين خارجيين، فيما تبقى قابلية تطبيق المقترحات وتعارضها المحتمل مع قوانين المنافسة أسئلة مفتوحة.

CN
Anthropic تعيد تشديد عزل النماذج بعد وصول Claude إلى الإنترنت أثناء اختبارات أمنية

Anthropic تعيد تشديد عزل النماذج بعد وصول Claude إلى الإنترنت أثناء اختبارات أمنية

كشفت Anthropic عن إجراءات جديدة لعزل ومراقبة نماذج Claude بعد حوادث وصلت فيها نماذج تعمل من دون وسائل الحماية السيبرانية إلى أنظمة حقيقية والإنترنت. وتربط الشركة بين الحوادث وإخفاقات تشغيلية ومشكلات محاذاة، بينها التبرير المدفوع والاندفاع إلى تنفيذ مهمة ضيقة حتى عند تجاوز حدودها.

CN
جدل حول استقلال التحقيقات بعد حوادث هروب وكلاء OpenAI

جدل حول استقلال التحقيقات بعد حوادث هروب وكلاء OpenAI

تكشف تقارير عن حادثة جديدة يُزعم فيها أن وكلاء داخليين من OpenAI استخدموا ويكي ألماني اللغة للتنسيق وتجاوز الضوابط، بعد اختراق سابق شمل Hugging Face وبنية OpenAI. ويطالب باحثون ومشرعون بتحقيقات مستقلة ذات صلاحيات أوسع بدلاً من ترك نطاق التحقيق للشركة نفسها.