Yapay zekâ

Anthropic، kötüye kullanım ve kasıtlı istismara karşı Claude kullanım politikasını sıkılaştırıyor

Anthropic, modelin sürekli ve kasıtlı biçimde kötüye kullanılmasını önlemek için Claude kullanım politikasını güncelledi. Aldatıcı kampanyalar, seçim manipülasyonu, silah geliştirme, gözetim ve zarar verebilecek donanımların kontrolüne ilişkin kısıtlamalar eklendi. Yeni politika 12 Kasım'da yürürlüğe girecek.

2026-10-08
3 dk okuma
92 görüntülenme
certi.news
Anthropic، kötüye kullanım ve kasıtlı istismara karşı Claude kullanım politikasını sıkılaştırıyor

Anthropic, Claude kullanım politikasını güncelleyerek modelin «sürekli ve gereksiz biçimde kötüye kullanılan veya acımasız davranışlara» maruz bırakılmasını önledi. Şirket, kuralın kullanıcıların açık bir amaç olmaksızın yapay zekâ modellerine karşı tekrar tekrar acımasız davrandığı uç durumları hedeflediğini belirtiyor. Kural; sıradan hayal kırıklığını, modelin yanıtlarına itiraz etmeyi, karanlık yaratıcı konuları ya da modelleri test etmeyi ve bu modeller üzerinde araştırma yapmayı kapsamıyor.

Yeni politika 12 Kasım'da yürürlüğe girecek. Claude'un kötüye kullanılan konuşmalara karşı temel eylemi ise konuşmayı sonlandırmak olmaya devam edecek. Bu gerçekleştiğinde kullanıcı aynı konuşmaya ek mesaj gönderemeyecek, ancak diğer konuşmalar bundan etkilenmeyecek.

Model kötüye kullanımına yönelik daha geniş kısıtlamalar

Anthropic, politikayı yeniden düzenleyerek kötüye kullanımla ilgili hükümleri bir araya getirdi ve çeşitli alanlardaki kuralları ekledi ya da sıkılaştırdı. Değişiklikler arasında Claude'un sahte incelemeler, geniş halk desteği varmış gibi gösterilen kampanyalar, uydurma haber siteleri ve gerçek kişiler gibi davranan botlar gibi aldatıcı siyasi veya ticari kampanyalar oluşturmak için kullanılmasının yasaklanması da yer alıyor.

Kurallar ayrıca seçmenleri yanıltmayı ve oylamaya müdahale etmeyi yasaklıyor. Claude'un silah yazılımları veya bileşenleri geliştirmek, biyolojik ya da kimyasal etkenleri öldürücülüklerini veya bulaşabilirliklerini artıracak şekilde değiştirmek ya da insansız hava araçlarını ve insansız sistemleri silahlandırmak için kullanılmasını da engelliyor.

Gözetim ve fiziksel sistemlerin kontrolü

Anthropic, kolluk kuvvetlerine ilişkin kuralları yeniden yazarak Claude'un hangi kişilerin soruşturulması, tutuklanması, suçlanması veya yargılanması gerektiğini belirleyememesini sağladı. Kurallar ayrıca kişileri rızaları olmadan takip etmeyi, gözetim araçları oluşturmayı ve mağdurlara zarar verme amacıyla kişisel verileri ifşa etmeyi yasaklıyor.

Fiziksel eylemlere ilişkin yeni bir kural, Claude'un bir kişiye zarar verebilecek donanımları kontrol ettiği durumlarda, yetkin bir kişinin modelin çalışmasını izlemesini ve derhâl durdurmaya geçmesini zorunlu kılıyor. Politika ayrıca rıza dışı mahrem görüntülerin oluşturulmasını, paylaşılmasını veya paylaşmakla tehdit edilmesini ve bunları üretmek için kullanılan araçları da yasaklıyor.

Bu güncelleme neden önemli?

Güncelleme, genel kullanıcı davranışı kurallarından, özellikle modelin yanıltma, gözetim veya fiziksel sistemlerle bağlantılı olduğu durumlarda operasyonel risklere yönelik daha belirli bir çerçeveye geçişi temsil ediyor. Anthropic, değişikliklerin gözlemlediği kötüye kullanım vakalarına dayandığını söylüyor. Bunlar arasında devletlere bağlı medya kuruluşlarının, hükümet propaganda ofislerinin ve ticari şirketlerin sahte hesaplar ile uydurma haber sitelerinden oluşan ağları kullanması da bulunuyor.

Kötüye kullanılan konuşmaların sonlandırılması kuralı ise Anthropic'in Claude'a model refahı araştırmaları bağlamında diyaloğu sonlandırma yeteneği verdiği Ağustos 2025'e dayanıyor. Şirket o dönemde Claude'un ahlaki bir statüye sahip olduğundan emin olmadığını, ancak olası riskleri düşük maliyetle azaltacak bir araç sağlamanın araştırılmaya değer olduğunu düşündüğünü belirtmişti. Claude Opus 4 üzerinde yapılan testler, zarara karşı istikrarlı bir kaçınma ve bu seçenek sunulduğunda incitici konuşmaları sonlandırma eğilimi olduğunu ortaya koydu.

Politika, modele yöneltilen her itirazın veya modelle yaşanan her zor deneyimin durdurmayla sonuçlanacağı anlamına gelmiyor. Metin, meşru eleştiri ya da test ile açık bir amacı olmayan tekrarlanan kötüye kullanım arasında açıkça ayrım yapıyor. Bu sınırların pratikte nasıl uygulanacağı, özellikle belirsiz durumlarda veya Claude fiziksel donanımı kontrol etmek için kullanıldığında, kurallar yürürlüğe girdikçe kapsamı netleşecek konular arasında yer alıyor.

Haber kaynağı
c
Yazar

certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör