Anthropic, gelecekteki Claude modellerine, uygun anahtara sahip kişilerin Claude’un metnin oluşturulmasına katkıda bulunmuş olma olasılığını tahmin etmesini sağlayacak bir metin filigranı mekanizması eklemeyi planlıyor. Şirket, 14 Ağustos 2026 tarihli bir gönderide filigranın okuyucular tarafından görünür olmayacağını, gizli karakterler veya tanımlayıcı veriler eklemeyeceğini ve ek belirteçler gerektirmeyeceği ya da modelin çalıştırma maliyetini artırmayacağını açıkladı.
Bu adım, Anthropic’in Avrupa Birliği Yapay Zekâ Yasası’na uyum çalışmaları kapsamında atılıyor. Şirket, diğer büyük model sağlayıcıları ve toplamda yaklaşık 190 imzacı kuruluşla birlikte Temmuz 2026’da yapay zekâ tarafından oluşturulan içeriklerde şeffaflığa ilişkin Avrupa uygulama kurallarını imzalamıştı. Anthropic’in belirttiğine göre Avrupa Birliği, 2 Ağustos’tan bu yana kendi pazarına hizmet veren yapay zekâ sağlayıcılarının makine tarafından oluşturulan içerikleri etiketlemesini zorunlu kılıyor.
Filigran nasıl çalışıyor?
Dil modelleri metni kelime kelime oluşturur ve her adımda birkaç olası kelime arasından seçim yapar. Birden fazla seçeneğin anlam ve kalite bakımından birbirine yakın olduğu durumlarda filigran, seçimi belirleyen rastgelelik kaynağını saptamak için bir anahtar ve önceki kelimeler grubunu kullanır. Böylece seçim pratikte rastgele kalır, ancak kelimelerin sıralanışı daha sonra anahtar kullanılarak tespit edilebilecek bir örüntü bırakır.
Anthropic, bu mekanizmanın Claude’u normalde kullanmayacağı kelimeleri seçmeye itmediğini ve onu sürekli olarak belirli bir kelimeye yönlendirmediğini söylüyor. Şirket, durumu zar atmak yerine pi sayısındaki rakam dizisini kullanmaya benzetiyor: Sonuç rastgele görünür, ancak sonuçlar dizisinin incelenmesi rastgelelik kaynağını ortaya çıkarabilir.
Metin kalitesi üzerinde pratikte etkisi yok
Dâhili testlere göre Anthropic, Claude metinlerinin içeriğinde, yaratıcılığında veya okunabilirliğinde bir etki tespit etmedi. Şirket ayrıca, teknolojiyi Gemini trafiğinin bir bölümü üzerinde test eden SynthID-Text çalışmasına işaret ediyor; çalışmada filigranlı ve filigransız metin değerlendirmeleri arasında istatistiksel açıdan anlamlı bir fark bulunmadı. Kontrollü bir çalışmada insan değerlendiriciler, yan yana karşılaştırıldığında yanıtların kalitesindeki farkı fark edemedi.
Şirket, filigranın modelleri yalnızca çok küçük ölçüde yavaşlattığını ve ek belirteçler üretmediği için hizmeti daha maliyetli hâle getirmediğini vurguluyor. Ayrıca filigran, kullanıcının veya kurumunun kimliğini ya da sohbetlerini açığa çıkarabilecek bilgiler içermiyor.
Tespit sınırları, düzenleme ve programlama durumları
Tespitin etkinliği, metnin uzunluğuna ve modelin birden fazla uygun seçeneğe sahip olduğu kararların sayısına bağlıdır. Bu nedenle kısa örneklerde ve yalnızca tek bir doğru cevaba izin veren gerçeklere dayalı bölümlerde (örneğin Isaac Newton’un bir eserinin doğru adını belirtme) tespit daha zayıftır. Hafif dil düzeltmeleri için de aynı durum geçerlidir; kelimelerin çoğu kullanıcının yazdığı biçimde kalır ve filigranın dayanabileceği yeterli malzeme bulunmaz.
Programlamada, kesin çıktının gerekli olduğu durumlarda filigran genellikle uygulanmaz; çünkü bir kelimenin veya sembolün değiştirilmesi kodu bozabilir. Ancak yorumlar gibi rastgele seçeneklerin bulunduğu yerlerde, kodun kendisi üzerinde çok az etkiyle ortaya çıkabilir. Claude’un oluşturduğu çeviriler ise model tüm kelimeleri seçtiği için filigran taşır.
Kullanılabilirlik ve filigranın kanıtladığı şey
Anthropic, filigranı tespit etmek için bir API sunmaya çalışıyor, ancak uygulama ayrıntılarını henüz belirlemedi. Filigran kullanıma sunulduğunda dünya genelinde uygulanacak; çünkü şirketin şu anda bunu bölgeye göre sınırlamak için sürdürülebilir bir yöntemi bulunmuyor. Şirket ayrıca 2 Ağustos 2026’dan önce yayımlanan Claude modellerine de filigranı eklemek için çalışıyor; Avrupa yasasında öngörülen geçiş döneminden yararlanarak bu işlemin önümüzdeki aylarda yapılması planlanıyor.
Filigran, metni tamamen Claude’un yazdığını kanıtlamaz; yalnızca onun metnin üretimine veya işlenmesine katkıda bulunmuş olma olasılığını belirler ve özgün yazım ile kapsamlı düzenleme arasında ayrım yapmaz. Metnin tamamen yeniden yazılması filigranı kaldırabilirken hafif düzenleme kaldırmayabilir. Filigran, kullanıcının haklarını, içeriğin mülkiyetini veya içerikle ilgili yasal sorumluluğu değiştirmez.
PNG, JPG ve SVG gibi desteklenen dosyalar için Claude, açık C2PA standardına uygun olarak dosyanın meta verilerine kriptografik olarak imzalanmış bir not biçiminde içerik kimlik bilgileri ekleyecek. Anthropic, bu verilerin dosyayı değiştirmediğini veya tanımlayıcı bilgiler içermediğini ve C2PA ile uyumlu araçlar tarafından okunabileceğini söylüyor.