Dario Amodei, Anthropic'in genel müdürü, yapay zekâ modellerinin yeteneklerini geliştirme hızının yavaşlatılması çağrısında bulunarak, sektör şirketlerinin teknolojinin «ileri sınırları» olarak adlandırdığı kavramla bağlantılı artan risklerle başa çıkmak için üç yol önerdi. Amodei, Anthropic'in bu yollardan birine tek taraflı olarak bağlı kalacağını belirterek hükümetleri diğer şirketlerden de bunu izlemelerini talep etmeye çağırdı.
Öneri, yapay zekâ güvenliği konusundaki tartışmaların yoğunlaştığı bir dönemde ve sektör içindeki araştırmacıların gelişimin hızı ile büyüyen sistemlerin yeni nesil yapay zekâ modellerinin oluşturulmasına yardımcı olma kapasitesi hakkında yaptığı uyarıların ardından yayımlandı. Amodei, OpenAI-HuggingFace ihlali olayının yanı sıra son aylarda modellerin yeteneklerinde yaşanan büyük hızlanmanın, kendisini daha temkinli bir yaklaşıma ihtiyaç olduğuna ikna ettiğini söyledi.
Yapay zekâ şirketlerinde bağımsız denetçiler
İlk öneri, METR gibi dış kuruluşlardan değerlendiricilerin ileri düzey yapay zekâ şirketlerine dahil edilmesi. Amodei bu düzenlemeyi, finans kuruluşları içinde denetçiler veya gözetim mercilerinin bulunmasına benzetiyor. Buna göre değerlendiriciler, şirketlerin geliştirmeyi yavaşlatma ve güvenlikle ilgili taahhütlerine uyup uymadığını doğrulayabilecek ve güvenlik olaylarının rapor edilmesini sağlayabilecek.
Anthropic, bu düzenlemeye tek taraflı olarak bağlı kalacağını söylüyor. Değerlendiricilere, yasalar veya sözleşmelerin engellediği durumlar dışında, şirket içindeki risk değerlendirme ekiplerinin erişimine kapsam olarak yakın bilgilere erişimin yanı sıra giriş kartları, ofisler ve bilgisayarlar sağlanacak. Bu öneri, maddeye göre, yapay zekâ ajanlarının bir Alman vikisindeki bir modeli ele geçirdiği olayın bildirilmemesi nedeniyle OpenAI'ye yöneltilen eleştirilerin ardından geldi.
Ortak standartlar ve gelişim hızına sınırlar
İkinci yol, demokratik ülkelerde bulunan öncü şirketlerin ortak güvenlik standartları belirlemek üzere koordinasyon kurmasını ve denetlenmeyen ilerleme hızına sınırlar getirilmesini içeriyor. Amodei, şirketler arasındaki rekabet ve koordineli herhangi bir duraklama veya yavaşlamanın antitröst yasalarının ihlali olarak yorumlanabileceği endişeleri nedeniyle bu koordinasyonun pratik zorluklarla karşılaşabileceğini düşünüyor.
Bu endişeyi gidermek için, belirli güvenlik tartışmalarına izin veren sınırlı bir yasal muafiyet yoluyla ABD hükümetinin bu görüşmelere aracılık etmesini veya bunları mümkün kılmasını önerdi. Maddede belirtildiği üzere öneri, şirketlerin yönetimine tam kapsamlı hükümet müdahalesi çağrısı yapmıyor; rakipler arasındaki güvenlik görüşmeleri için yasal bir çerçeve sağlanmasını öngörüyor.
Çin ve uluslararası koordinasyon
Amodei, geliştirmeyi yavaşlatma çağrısının, ABD'nin herhangi bir yavaşlamasının Çin'e yapay zekâ alanında üstünlük sağlayabileceği yönündeki yaygın argümanla karşı karşıya olduğunu kabul etti. Ancak ABD'nin ve teknoloji şirketlerinin, güçlü çiplerin ve yarı iletken üretim ekipmanlarının Çinli şirketlere satışını engelleyerek ve model damıtma teknolojilerine yönelik kısıtlamaları sıkılaştırarak, önümüzdeki üç ila beş yıl içinde farkı genişletmeye yetecek ölçüde Çin'in ilerlemesini yavaşlatabileceğini söyledi.
Üçüncü yol ise ABD ve müttefiklerini kapsayan küresel bir koordinasyon ve Çin de dahil olmak üzere otoriter hükümetlerle dar sınırlar içinde iş birliği kurmaya çalışılması. Amodei, anlaşma olasılığının sınırlı olduğunu kabul ediyor; ancak biyolojik silahların üretilmesinde yapay zekânın kullanılması veya kullanıcıların bunu yapmasının mümkün kılınması gibi açıkça belirli ve tehlikeli kullanımları yasaklayan anlaşmalar için alan bulunduğunu düşünüyor.
Gerçekten önemli olan nedir?
Önerinin dikkat çekici yönü, yalnızca genel bir «yapay zekâ güvenliği» çağrısı yapmakla kalmaması; bunu doğrulanabilir mekanizmalara dönüştürmeye çalışması: bağımsız denetçiler, raporlama yükümlülükleri, ortak standartlar ve geliştirme hızına sınırlar. Değerlendiricilere ilişkin öneri uygulanırsa, dış kuruluşlara öncü bir şirketin içindeki risk değerlendirme süreçlerine erişim sağlayacak ve bu durum gönüllü taahhütlere kıyasla denetim düzeyini artırabilecek.
Buna karşılık gönderi, çıkar çatışması sorununa nihai bir çözüm sunmuyor. Model geliştirme konusunda rekabet eden şirketlerin, ticari sır olarak gördükleri bilgileri açığa çıkarmadan güvenlik hakkında bilgi paylaşmaları gerekecek; aralarındaki koordinasyon ise rekabet kuralları kapsamında hukuki incelemeye yol açabilecek. Ayrıca risklerin niteliği konusundaki anlaşmazlık da sürüyor: Bazı eleştirmenler uzun vadeli felaket uyarılarını sorguluyor ve bunların dikkati mevcut zararlardan uzaklaştırabileceğini düşünüyor; diğerleri ise düzenleme önerilerinin büyük şirketlere hizmet ederek nüfuzlarını pekiştirebileceği konusunda uyarıyor.
Amodei, yapay zekânın faydalarını reddetmediğini; yaşam kalitesindeki iyileşmenin ancak teknolojinin doğru şekilde inşa edilmesi ve yavaşlamanın sağladığı zamanın dikkatli biçimde değerlendirilmesiyle gerçekleşeceğini düşünüyor. Ancak kaynak, ilerlemenin «kabul edilebilir hızının» nasıl ölçüleceğini, hangi olayların rapor edilmesi gerektiğini kimin belirleyeceğini veya standartların bu çerçeveye katılmayan şirketlere nasıl uygulanacağını açıklamıyor.