Anthropic, 18 Eylül 2026'da gelişmiş yapay zekâ modellerinin bağımsız değerlendirmesini gerçekleştirmek üzere Accenture ile ortaklık kurduğunu duyurdu. Bu adım, değerlendirmeler tamamlandıktan sonra yalnızca dış incelemelere başvurmak yerine bağımsız değerlendiricileri model geliştiren şirketin içine yerleştirmeyi amaçlıyor. Çalışmayı Accenture'ın uzmanlaşmış yapay zekâ birimi Faculty yönetecek.
Ortaklığın kapsamı, modellerin değerlendirilmesini ve saldırı simülasyonu yöntemleriyle test edilmesini, hizalanma değerlendirmelerinin gerçekleştirilmesini ve koruma önlemlerinin incelenmesini içeriyor. Anthropic, Accenture'ın şirketler ve hükümetler ile çeşitli sektörlerde yapay zekâ uygulama deneyiminin, model güvenliğinin ve kullanımının değerlendirilmesine pratik bir bakış katacağını belirtti.
Taraflar, önümüzdeki beş yıl içinde bu alanla bağlantılı kapasite oluşturma çalışmalarına her birinin en az 1 milyar dolar yatırım yapmasını bekliyor. Şirket, duyuruda harcama takviminin veya bu yatırımların ölçülme mekanizmalarının ayrıntılarını açıklamadı.
Entegre değerlendirme ne anlama geliyor?
Entegre değerlendirme, bağımsız değerlendiricilerin yapay zekâ şirketi içinde çalışanlarınkine yakın bir erişim düzeyiyle çalışması anlamına geliyor. Bu, değerlendiricilerin eğitim sırasında modelleri takip etmesine, modellerin oluşturulmasını ve kullanıma sunulmasını etkileyen kararları incelemesine ve bunlar üzerinde çalışan kişilerle doğrudan görüşmesine olanak tanıyor. Anthropic'e göre bu konum, değerlendiricilerin şirketin güvenlik taahhütlerine uyumunu doğrulamasına, zayıf noktaları tespit etmesine, olayları bildirmesine ve kamuoyuna faydalar ile riskler hakkında daha bilgili bir tablo sunmasına yardımcı olabilir.
Anthropic, bağımsız değerlendiricilerin bulunmasının güvenlik sorumluluğunu kendisinden almadığını veya hesap verebilirliğini azaltmadığını vurguluyor; modellerinin güvenliği doğrudan kendi sorumluluğunda kalıyor. Girişimin pratik değeri, geliştirme aşamalarına ve iç kararlara bağımsız erişim yoluyla bu sorumluluğun daha yüksek ölçüde doğrulanabilir hâle getirilmesi.
Henüz çözüme kavuşturulmamış boşluklar
Şu ana kadar entegre değerlendiricilerin hangi bilgilere erişmesi gerektiğini veya bulgularını hangi yöntemle sunacaklarını belirleyen üzerinde uzlaşılmış standartlar bulunmuyor. Uzun vadede bağımsız değerlendirmeyi finanse edecek istikrarlı bir sistem de yok. Anthropic, gelecekte finansmanın ortak havuzlardan veya hükümetlerden gelmesi gerektiğini düşünüyor; ancak bu alternatifler mevcut olmadığı için mevcut aşamada Accenture'ın çalışmalarını doğrudan finanse edecek.
Şirket ayrıca METR ve diğer kâr amacı gütmeyen kuruluşlarla, kendi finansmanıyla entegre değerlendirmenin bazı unsurlarını denemek üzere görüşmeler yürütüyor. Şirket, Accenture ile ortaklığın münhasır olmadığını ve önümüzdeki haftalarda duyuracağı diğer değerlendiricilerle iş birliği yapacağını da açıkladı. Accenture ise diğer yapay zekâ geliştiricileriyle çalışacak.
certi.news'in değerlendirmesi
Duyurunun önemi, model güvenliği tartışmasını ayrı değerlendirme raporlarından geliştirme sürecinin kendisinin izlenmesine taşımasında yatıyor. Bu, değerlendiricilere erken kararları ve riskleri izleme konusunda daha iyi bir imkân sağlayabilir; ancak buna karşılık değerlendiricinin bağımsızlığı, erişiminin sınırları, bilgilerin korunma mekanizması ve sonuçların yayımlanma yöntemi hakkında kritik soruları gündeme getiriyor. Anthropic, standartların veya istikrarlı bir finansman modelinin bulunmadığını kabul ettiğinden, ortaklık nihai bir yönetişim çerçevesinden ziyade önemli bir kurucu deney niteliği taşıyor.