Siber güvenlik

Yapay Zekâ Metinlerindeki Filigranları Kaldırma Araçları, Etkililiğine Dair Kanıt Olmadan Yayılıyor

Anthropic’in Claude tarafından üretilen metinlerde görünmez filigranları etkinleştirdiğini açıklamasından birkaç gün sonra, bu filigranları aşabildiğini iddia eden bir dizi açık kaynak proje ve ticari hizmet ortaya çıktı. Ancak Anthropic filigran mekanizmasını veya bunu tespit edecek bir araç yayımlamadığı için bu iddiaları doğrulamak şu anda mümkün değil.

2026-08-13
4 dk okuma
8 görüntülenme
فريق تحرير certi.news
Yapay Zekâ Metinlerindeki Filigranları Kaldırma Araçları, Etkililiğine Dair Kanıt Olmadan Yayılıyor

İnternette, yapay zekâ tarafından üretilen metinlerdeki filigranları kaldırdığını iddia eden araçlar için hızla büyüyen bir pazar ortaya çıktı. Bu gelişme, Anthropic’in Claude’un yazdığı her şeye görünmez filigranlar eklemeyi etkinleştirdiğini açıklamasından birkaç gün sonra yaşandı. Bu pazar, GitHub’da yıldız sayısı 4500’ü aşan açık kaynaklı bir projeyi, yakın zamanda kaydedilmiş bir dizi web sitesini ve yapay zekâ tarafından oluşturulan içerik tespit araçlarını aşmaya odaklanan ticari hizmetleri kapsıyor.

Ancak Anthropic çalışma mekanizmasının ayrıntılarını henüz yayımlamadığı ve temizlenmiş metnin hâlâ filigran taşıyıp taşımadığını anlamak için kullanılabilecek herkese açık bir tespit aracı sunmadığı için bu araçların metinsel filigranı kaldırdığı yönündeki iddiaları şu anda doğrulamak mümkün değil.

Çeşitli proje ve hizmetler

Öne çıkan projeler arasında, Memo’nun kurucusu Guillaume Meyer tarafından geliştirilen ve MIT lisansıyla sunulan watermarks-remover aracı bulunuyor. Araç başlangıçta Claude ajanına özel bir beceri olarak geliştirildi, ardından Claude, Gemini ve SynthID-Text desteğinin yanı sıra OpenAI’nin kaynak kanıtı yüzeyleri ile Kirchenbauer tarzı filigranlar kullanan açık ağırlıklı modelleri desteklediğini duyurdu.

Bunun yanı sıra claude-watermark-cleaner, remove-ai-watermarks ve noai-watermark gibi başka depolar da bulunuyor. Ayrıca aralarında claudewatermark.com, claudewatermark.rip, gptcleanup.com ve claudewatermarkremover.app’in de bulunduğu yakın zamanda açılmış web siteleri ortaya çıktı. Yapay zekâ tarafından oluşturulan içeriklerin tespitini aşmaya yönelik araçlar satan StealthGPT de hizmet sayfalarına Claude filigranını kaldırmaya yönelik bir araç ekledi. Human Writes ise, akademik dürüstlük politikalarına uygun kullanım çağrısı yapan bir uyarı içermesine rağmen makalelerde ve ödevlerde Turnitin ile GPTZero’yu aşmayı ve Claude filigranını kaldırmayı vaat ediyor.

Bu araçlar gerçekte neyi kaldırıyor?

Araçlar üç farklı veri türüyle ilgileniyor. Sıfır genişlikli karakterler, çift yönlü kontrol öğeleri, özel Unicode karakterleri ve normal boşluklara benzeyen boşluklar gibi görünmez karakterlerin kaldırılması doğrulanabilir ve ölçülebilir bir işlem. PNG, JPEG, SVG, PDF, DOCX, ODT, HTML ve Markdown dosyalarındaki C2PA, EXIF ve XMP meta verilerinin kaldırılması için de aynı durum geçerli. Ancak bu veriler, dosya yeniden kaydedildiğinde veya biçimi dönüştürüldüğünde ya da ekran görüntüsü alındığında genellikle korunmuyor.

Metinsel filigranın kendisi ise görünmez karakterlerde bulunmuyor; modelin seçtiği kelimelerle bağlantılı. Bu nedenle filigranla başa çıkmanın bilinen yolu, metni başka bir model kullanarak büyük ölçüde yeniden yazmaktan geçiyor. Meyer, aracının şu anda yalnızca meta verileri kaldırdığını ve gerçek filigranların kaldırılmasının daha sonra gelebileceğini, ancak bunun şu anda kullanılamadığını belirtiyor.

Bazı ticari web siteleri temiz ve tespit edilemez metin üretme vaadinde bulunurken, bazı sonuçlar Anthropic’in filigranına karşı değil, filigranı tespit etmeye yönelik herkese açık araçlara karşı ölçülüyor; Anthropic’in filigranı içinse herkese açık bir tespit aracı bulunmuyor. Pasquale Pillitteri, projeleri klonlayıp kodu inceledikten sonra, yaygın metin temizleme araçlarından birinin gizli veri taşımaya yönelik yaygın bir tekniği değiştirmeden bıraktığını gördü. Böylece aracın metni temizlediğini iddia etmesinin ardından yük çıkarılıp geri getirilebildi.

Filigranların amacı ve tedarik zinciri riskleri

Anthropic, 2 Ağustos 2026’da veya sonrasında yayımlanan modellerden çıkan metinlerin biçimlendirmeye gömülü, algılanamayan bir filigran taşıdığını; desteklenen dosya türlerinin ise imzalı C2PA verileri aldığını söyledi. Etiketleme, API, claude.ai, Claude Code, Claude Cowork ve Claude Tag üzerinden model düzeyinde uygulanıyor; ayrıca AWS, Google Cloud ve Microsoft Foundry aracılığıyla da geçerli.

Bu uygulama, 2 Ağustos’ta yürürlüğe giren Avrupa Yapay Zekâ Yasası’nın 50. maddesiyle bağlantılı. İhlaller için cezalar 15 milyon avroya veya küresel gelirin %3’üne kadar çıkabiliyor. Anthropic, filigranın tespit edilmesinin içeriğin Claude tarafından işlendiği anlamına geldiğini, ancak mutlaka tamamen Claude tarafından yazıldığı anlamına gelmediğini açıklıyor; model dil bilgisi denetimi, çeviri veya özetleme için kullanıldığında da filigran görünebilir. Şirket ayrıca kapsamlı düzenleme, yeniden yazma ve çevirinin filigranı kaldırabileceğini belirtti ve ileride üçüncü taraf tespitini destekleyeceğini ve teknik belgeler yayımlayacağını söyledi.

Bu gelişmeler tedarik zinciri risklerine de dikkat çekiyor. watermarks-remover aracı bir yazılım ajanına beceri olarak yükleniyor ve üçüncü bir tarafa ait araştırma deposunu klonlayıp yaklaşık 220 megabayt boyutunda bir dosya indirmek üzere yapılandırılabiliyor. BleepingComputer söz konusu araçları test etmedi veya denetlemedi. Bu nedenle, özellikle vaatlerini bağımsız olarak doğrulamanın bir yolu bulunmadığından, bunlara internetten edinilen güvenilmeyen kodlar olarak yaklaşılmalı.

Haber kaynağı
BleepingComputer
Özgün kaynağı aç ↗
ف
Yazar

فريق تحرير certi.news

Aynı kategoride

Bunlar da ilginizi çekebilir

Tüm haberleri gör