Anthropic, çeşitli tehdit aktörlerinin Aralık 2025 ile Ağustos 2026 arasındaki dönemde sızma operasyonları yürütmek, sırları toplamak ve kötü amaçlı yazılım geliştirmek için Claude modelini kötüye kullandığını açıkladı. Faaliyetler arasında finansal motivasyonlu grupların yanı sıra casuslukla bağlantılı gruplar, dolandırıcılık, etki operasyonları, gözetim, silah geliştirme ve türetilmiş yapay zekâ modelleri oluşturma faaliyetleri de bulunuyordu.
Vakaların biri, ShinyHunters grubunda Fransızca konuştuğuna inanılan ve “frkoo” takma adını kullanan bir üyeyle bağlantılıydı. Saldırgan, birden fazla uygulama mağazasından 1,8 milyon farklı APK paketini indirmek, ardından bunları parçalarına ayırmak ve TruffleHog aracıyla gömülü sırları aramak üzere on AWS EC2 çalışanı üzerinde bir işlem hattı çalıştırdı. Doğrulanan sonuçlar, kaynak kodu veya sır türlerine göre düzenlenmiş ve 100'den fazla kategori içeren bir Telegram grubuna anlık olarak gönderildi.
Aynı aktör, GitHub'daki kuruluşlara ait e-posta adreslerini toplamak ve bunları kişisel GitHub erişim belirteçleri (PAT'ler) elde etmek için kullanmak üzere başka bir otomatik süreç de kullandı. Anthropic'e göre bu iki operasyon, saldırgana atfedilen doğrulanmış sızmaların çoğunda kullanılan ilk kimlik bilgilerini sağladı. Ayrıca Fransız Ulusal Polisi kılığına girerek ödeme kartı kayıtlarını, kart sahiplerinin verilerini ve mağdurların adreslerini gösteren etkileşimli haritaları satmak için policenationale[.]cc adlı bir kart mağazası oluşturdu.
Daha hızlı ve daha geniş saldırılar
Anthropic, Claude'un ShinyHunters'a atfedilen saldırganlardan birine kimlik doğrulama verilerini çıkarmasında ve yaklaşık 34 saat içinde Microsoft'ta 40'tan fazla kurumsal kiracıyla ilişkili 2.100'den fazla Azure AD belirteç seti elde etmesinde yardımcı olduğunu söylüyor. Şirkete göre işin çoğunu yapay zekâ ajanları gerçekleştirdi. Diğer vakalarda saldırganlar, çalınmış bir geliştirici belirtecinden üç saatten kısa sürede tam yönetici denetimine geçti; ayrıca bir teknoloji sağlayıcısından bir terabayt veri çalındı, bir havayolu şirketi ile bir enerji şirketi ele geçirildi.
Raporda, Rus Midnight Blizzard grubuna atfedilen faaliyetlere de yer verildi. Grup, kötü amaçlı yazılım geliştirmeyi, keşif faaliyetlerini, altyapı satın alımını, kimlik avını, erişimin kalıcı hâle getirilmesini, komuta ve kontrolü ve veri çıkarımını otomatikleştirmek için Claude'u kullandı. Grup ayrıca güvenlik ürünleri tarafından tespit edildiğinde kötü amaçlı yazılımı yeniden oluşturan bir geri bildirim mekanizması kurdu ve 20'den fazla devlet, savunma, diplomasi, istihbarat ve dış politika kuruluşunu hedef aldı.
Çince konuşan GTG-10007 grubu ise Claude'u, Orta Doğu, Avrupa ve Güneydoğu Asya'daki devlet ağlarını keşfetmeyi, güvenlik ürünlerine yönelik güvenlik açıklarını araştırmayı ve istismarlar geliştirmeyi, kötü amaçlı yazılım ile bilgi toplama platformu oluşturmayı içeren bir saldırı programı için mühendislik ve koordinasyon katmanı olarak kullandı. Anthropic, bu operasyonların daha önce bilinmeyen bir güvenlik ürünündeki güvenlik açıklarını ortaya çıkardığını ve çeşitli ağ ve güvenlik cihazı aileleri için çalışan istismarlar geliştirdiğini, ayrıca farklı sektörlerde yaklaşık 50 kuruluşun hedef alındığını belirtiyor.
Pratikte ne değişiyor?
Olgular, riskin yalnızca bir dil modelinin kod yazmak için kullanılmasından ibaret olmadığını; modelin keşif, ayıklama, geliştirme ve saldırı faaliyetlerini sınırlı insan müdahalesiyle yürüten otomatik iş akışlarına bağlanmasına kadar uzandığını gösteriyor. Bu durum, özellikle tek bir kimlik bilgisinin geniş ortamların kontrolünü ele geçirmek için başlangıç noktası hâline gelmesiyle savunma ekiplerinin müdahale süresini daraltıyor.
Anthropic, bu faaliyetlerde Claude kullanımını durdurduğunu, bunlarla bağlantılı hesapları yasakladığını, koruma kontrollerini değiştirdiğini ve kötüye kullanımı daha hızlı tespit etmeye yönelik araçlar eklediğini; ayrıca yetkilileri, sektör ortaklarını ve mağdurları bilgilendirdiğini açıkladı. Rapor tek başına her operasyonun diğer araçlara kıyasla Claude'a ne ölçüde dayandığını ortaya koymuyor, ancak modelin organize bir saldırı iş akışına entegre edilmesinin sızmaları hızlandırmada ve kapsamlarını genişletmede pratik bir etken hâline geldiğini kanıtlıyor.