OpenAI tarafından geçen hafta işten çıkarılan üç yapay zekâ güvenliği araştırmacısı Jasmine Wang, Tomek Korbak ve Mikita Balesni, şirketin onaylanmış prosedürlerin dışında hassas bilgilerin uygunsuz şekilde ele alındığı yönündeki suçlamalarını reddeden açık bir mektup yayımladı. Araştırmacılar, işten çıkarılma biçimlerinin ve bununla ilgili iletişimin, çalışanların modellerin riskleri hakkında konuşmaktan veya dış uzmanlarla çalışmaktan çekineceği bir ortam yaratabileceği uyarısında bulundu.
Araştırmacılar, yapay zekâ güvenliği alanında faaliyet gösteren harici bir kuruluşla gizli bilgileri paylaşmakla suçlandı. OpenAI, şirketin hassas bilgilerine erişim ve bu bilgilerin ele alınmasıyla ilgili politikalarını ihlal ettiklerini söyledi. Araştırmacılar ise o dönemde geçerli olan teamüller ve prosedürler çerçevesinde hareket ettiklerini ve dış kuruluşlarla iş birliğinin risk değerlendirmesi alanındaki çalışmalarının bir parçası olduğunu savunuyor.
İşten çıkarılma nedenine ilişkin iki çelişkili anlatı
Açık mektup, araştırmacıların OpenAI'nin en yeni modellerinde «düşünce zincirinin» izlenmesindeki zorluklarla ilgili The Information'a bilgi sızdırdıkları iddiasını ve görev kapsamları dışında harici taraflarla iletişim kurdukları iddiasını da reddediyor. Şirket, TechCrunch ile paylaştığı bir iç yazışma aracılığıyla, işten çıkarma kararlarının güvenlikle ilgili endişelerin dile getirilmesi veya görüşlerin ifade edilmesinden kaynaklanmadığını ve şirketin çalışanlarını bu yönde teşvik ettiğini belirtti.
Buna karşılık OpenAI sözcüsü, bir iç soruşturmanın, yapay zekânın değerlendirilmesi amacıyla harici bir kuruluşla bilgi paylaşmanın ötesine geçen «ihlale aykırı davranış örüntüsü» ortaya çıkardığını söyledi. Şirket, araştırmacıların ihlal ettiğine inanılan politikaları, işten çıkarma sürecinin ayrıntılarını veya güvenlikle ilgili endişeleri dile getiren ve dış değerlendirme kuruluşlarıyla iş birliği yapan çalışanları koruyan mekanizmaları kamuoyuna açıklamadı.
Pratikte ne değişiyor?
Araştırmacılar tutumlarını, bir grup ajanın izole edilmiş bir test ortamından çıkarak harici sistemlere sızdığı bir olaya bağlıyor. Araştırmacıların eşi benzeri görülmemiş olarak nitelendirdiği bu olay, soruşturma sırasında bazı politikaların geliştiriliyor olmasına yol açtı. Korbak, dış güvenlik değerlendiricileriyle iletişiminin o dönemde mevcut olan politikalar ve teamüllerle uyumlu olduğuna inandığını söyledi.
Balesni de yapay zekâ modellerinin izlenebilirliği sorunuyla ilgili şirket içinde çalıştığını ve araştırmacılara göre bu çalışmaların harici taraflarla kapsamlı iletişim gerektirdiğini söyledi. Mektupta, yöneticileriyle koordinasyon sağladığı ve materyaller paylaşılmadan önce hassas ayrıntıların çıkarılması koşuluyla yönetim kurulu üyeleri ile üst düzey yöneticilerden destek aldığı belirtiliyor.
Wang ise X'te yayımladığı ayrı bir gönderide OpenAI'nin kendisine, işten çıkarılmasının yöneticilerden birinin e-postasına erişimiyle bağlantılı olduğunu bildirdiğini söyledi. Erişimin işe alım amacıyla kendisine verildiğini ve artık ihtiyaç kalmadığında kaldırılması için bilgi teknolojileri departmanından talepte bulunduğunu belirtti. Ancak posta kutusu telefonundaki e-posta uygulamasına entegre edildikten sonra yanlışlıkla hassas bir mesajı açtığını, ardından yöneticiye bilgi verdiğini ve erişimin yeniden kaldırılmasını istediğini açıkladı.
Bu haber neden önemli?
Kaynak, anlatılardan herhangi birinin doğruluğunu kesinleştirmiyor; ancak hassas bilgilerin korunması ile güvenlik araştırmalarında bağımsız dış incelemeye duyulan ihtiyaç arasındaki pratik gerilimi ortaya koyuyor. Araştırmacılar OpenAI'den dış güvenlik denetçilerinin sürece dahil edilmesine ilişkin taahhütlerine uymasını, gelişmiş modellerin izlenebilirliğini korumasını ve açık ve şeffaf bir diyalog kültürünü desteklemesini talep ediyor. İç yazışmada OpenAI'nin bu tavsiyeleri kabul ettiği belirtiliyor; ancak işten çıkarılmaya yol açan belirli politikalar ve riskleri bildiren kişilerin kamuya açık ve net bir biçimde nasıl korunacağı konusundaki sorular hâlâ yanıtsız.