2 Ağustos 2026 tarihinde Anthropic, Claude'un yeni sürümlerine görünmez filigranlar, yani metnin istatistiksel dağılımında kalan ve kopyalama veya kısmi düzenleme sırasında korunan makine tarafından okunabilir etiketler yerleştirmeye başladı. Bu sadece teknik bir güncelleme değil, yapay zeka içeriğini sonradan tespit etme çabalarından, üretim aşamasında köken kanıtlarını proaktif bir şekilde yerleştirmeye yönelik stratejik bir geçiştir.
Mekanizma, belirteç (token) düzeyinde çalışır: Model, kelime seçim olasılıklarını, dizide anlamı, kaliteyi ve okunabilirliği etkilemeyen istatistiksel olarak tespit edilebilir bir desen görünecek şekilde değiştirir. Şirket doğrulama araçları vaat ediyor, ancak algoritmanın detayları ve saldırılara (çeviri, başka sözcüklerle ifade etme, insan metniyle karıştırma) karşı dayanıklılığı henüz tam olarak açıklanmadı. Stil ve sıklık analizine dayanan önceki yaklaşımların aksine, Anthropic'in filigranı üretici tarafından yerleştirilmiş aktif bir sinyaldir.
Anthropic'in metodolojisi, tam olarak 2 Ağustos'ta yürürlüğe giren EU AI Act'in 50 maddesindeki gerekliliklere dayanmaktadır. Düzenleyici kurum, üretken yapay zeka sistemlerinin yapay zeka içeriğini tanımlamak için makine tarafından okunabilir etiketler eklemesini şart koşuyor. Bu durum, diğer oyuncularla olan eşzamanlılığı açıklıyor: Google, SynthID'yi metne genişletiyor, OpenAI C2PA ve dijital filigranları teşvik ediyor, Meta ise benzer çözümleri test ediyor. Ancak Anthropic, filigranı yalnızca dahili güvenlik girişimleriyle değil, doğrudan uyumlulukla (compliance) ilişkilendirmesiyle öne çıkıyor.
Geleneksel yapay zeka dedektörleriyle (şaşkınlık ve patlama analizi yapanlar) karşılaştırıldığında, filigran belirli bir model hakkında daha güvenilir bir sinyal verir ancak karma yazarlık sorununu çözmez. 8 Ağustos'ta arXiv'de yayınlanan bir araştırma şunu vurguluyor: insan-yapay zeka iş birliği çağında, "insan mı yoksa yapay zeka mı" şeklindeki ikili ayrım eskimiştir. Filigran, Claude kullanımının bir gerçeğini kaydeder ancak metnin ne kadarının insana ait olduğunu, hangi düzenlemelerin yapıldığını ve nihai sorumluluğun kime ait olduğunu göstermez.
Sınırlamalar açıktır. Kapsamlı düzenleme, çeviri veya başka içeriklerle karıştırma sinyali yok edebilir. Filigranın olmaması insan yazarlığını kanıtlamaz; sadece etiketin ya yerleştirilmediği ya da kaldırıldığı anlamına gelir. Dolayısıyla araç, platformlar ve yayıncılar için ek bir sinyal olarak yararlıdır, ancak "tartışılmaz bir kanıt" değildir.
Sektör için bu, bir köken (provenance) ekosistemine geçiş anlamına geliyor: gelecekte modeller sadece metin üretmekle kalmayacak, aynı zamanda kriptografik olarak doğrulanabilir izler de bırakacak. Bu durum moderasyonu kolaylaştıracak ancak yazarlık, alıntı yapma ve yasal sorumluluk konularını karmaşıklaştıracaktır. Araştırmacıların, farklı sağlayıcıların filigranlarının nasıl etkileşime gireceği ve evrensel bir tespit standardı oluşturulup oluşturulamayacağı sorularına yanıt vermeleri gerekecek.
Nihayetinde Anthropic'in filigranları, düzenlemelerin teknik gündemi halihazırda belirlediğini gösteriyor: içerik izlenebilirliği, isteğe bağlı bir özellik değil, modellerin zorunlu bir niteliği haline geliyor.

