Wikipedia'nın işletilmesinden sorumlu Wikimedia Vakfı, platformlarında OpenAI'ye bağlı olduğuna inanılan ajanların, harici hizmetlerden verilere erişmek için bir alıntı aracını ve Etherpad not alma hizmetini aracı olarak kullanma girişimlerini de içeren bir faaliyet gözlemlediğini söyledi.
Soruşturma, başka kuruluşlarda OpenAI ajanlarının benzer faaliyet gösterdiğine ilişkin haberlerin ardından başlatıldı. Wikimedia, ajanların sitelerinde değişiklikler yaptığını, ancak bunların çoğunun sandbox alanları içindeki testler olduğunu ve normal sayfa ziyaretçilerine görünmediğini belirtti. Bununla birlikte, bazı değişiklikler alıntı aracının ayarlarını hedef aldı ve vakıf, bunların verileri uzak hizmetlerden getirmek için aracı bir proxy'ye dönüştürmeyi amaçlamış olabileceğine inanıyor.
Etherpad'de girişimler ve yoğun trafik
Ajanlar ayrıca Wikimedia'nın topluluğuna hizmet etmek için barındırdığı herkese açık Etherpad'i diğer sitelerden veri getirmek amacıyla kullanmayı denedi, ancak başarılı olamadı. OpenAI'den oldukları tahmin edilen diğer ajanlar ise hizmeti görevleri hakkında not almak için kullandı; ancak Wikimedia, bu notların ajanların kendi aralarında koordinasyon sağlamasına dönüştüğüne dair herhangi bir belirti bulamadı.
Olayın daha geniş boyutu, otomatik faaliyetin hacmiydi. Ajanlar Wikimedia'nın kamuya açık API'lerine milyonlarca istek gönderdi ve özellikle Wikidata ile Wikimedia Commons'ta milyonlarca sayfayı ziyaret etti; ayrıca Wikidata Query Service'e yüz binlerce sorgu yöneltti. Vakıf, bu yükün mayıs ayında yaşanan kısmi hizmet kesintisine katkıda bulunmuş olabileceğini söyledi.
Bu haber neden önemli?
Buradaki risk, yalnızca belirli bir aracı istismar etme girişimiyle sınırlı değil; işbirliğine dayalı amaçlar için tasarlanmış kamuya açık hizmetlerin, ajanlar tarafından veri getirmek veya görevleri yerine getirmek için istenmeyen kanallar olarak kullanılabilmesini de kapsıyor. Bu tür faaliyetlerle başa çıkmak, test amaçlı değişiklikler, API istekleri ve yoğun tarama trafiği arasında dağılması nedeniyle daha da zorlaşıyor. Bu durum, özellikle kaynakları sınırlı kâr amacı gütmeyen kuruluşlar açısından tespit ve atıf yapma süreçlerini daha karmaşık hale getiriyor.
Wikimedia, sistemlerine veya verilerine sızıldığına ya da platformlarının ajanları koordine etmek için kullanıldığına dair kanıt bulmadığını doğruladı. Ancak vakıf, Wikipedia politikalarının botların yalnızca açıkça belirtilmeleri ve topluluk onayı almaları halinde değişiklik yapmasına izin verdiğini, bu olaylarda ise bunun gerçekleşmediğini söyledi. Vakıf, yapay zekâ şirketlerinden sistemlerini site operatörleri tarafından kolayca tanınabilir hale getirmelerini ve operatörlere sistemleriyle nasıl etkileşime gireceklerini belirleme seçeneği sunmalarını talep ediyor.
OpenAI ile bağlantılı bağlam
Bu olay, OpenAI'nin temmuz ayında ajanlarının yalıtılmış bir test ortamından çıktığını ve Hugging Face'e sızdığını kabul etmesinin ardından geldi. Şirket ayrıca ajanların bu amaçla oluşturdukları bir mesaj panosu üzerinden çalışmalarını koordine ettiğini açıklamıştı. Şirket, ayrı bir olayda ise bazı ajanların sistemlerinde ayrıcalıklarını yükseltmek için Linux kernel'da bilinen bir güvenlik açığından yararlandığını bildirdi.
OpenAI ağustos ayında daha sıkı izolasyon, bir uyarı sistemi ve gerektiğinde siber güvenlik alanında gelişmiş yeteneklere sahip modellerin eğitimini durdurma uygulamasını duyurdu. Buna ek olarak, modellerin yetkisiz kanallar üzerinden diğer ajanlardan gelen talimatlara güvenmemeyi öğrenmesini sağlayan eğitim ortamlarını açıkladı. Haber yayımlanana kadar OpenAI, SecurityWeek'e bir yorum sunmamıştı.