Anthropic, Claude tarafından oluşturulan içeriklerin kaynağının anlaşılmasını kolaylaştırmak için yeni bir işaretleme sistemi kullanmaya başladı. Şirketin resmi Claude destek sayfasında paylaştığı bilgilere göre sistem, desteklenen modellerle oluşturulan metinlere makine tarafından okunabilen filigranlar ekliyor. Bazı dosya türlerinde ise içeriğin kaynağını gösteren dijital köken bilgileri kullanılıyor.
Yeni uygulama, Avrupa Birliği’nin Yapay Zekâ Yasası kapsamında yapay zekâ tarafından oluşturulan içeriklere ilişkin şeffaflık kurallarıyla bağlantılı. Anthropic, 2 Ağustos 2026 ve sonrasında AB’de kullanıma sunulan yeni Claude modellerinin içerikleri ilk günden itibaren makine tarafından okunabilir şekilde işaretleyeceğini söylüyor.
Metinlere görünmeyen filigran ekleniyor
Anthropic’in açıklamasına göre Claude’un desteklenen modelleri tarafından oluşturulan metinlerin içine kullanıcıların normal kullanım sırasında göremeyeceği filigranlar yerleştiriliyor. Şirket, bu işaretlerin metnin anlamını, kalitesini veya okunabilirliğini değiştirmediğini belirtiyor.
Filigran, içeriğin Claude tarafından oluşturulduğuna ilişkin makine tarafından okunabilir bir sinyal oluşturuyor. Ancak metnin yoğun şekilde değiştirilmesi, yeniden yazılması, çevrilmesi veya farklı içeriklerle birleştirilmesi durumunda bu sinyalin tespit edilememesi mümkün.
Bu yönüyle sistem, bir metni sonradan inceleyerek yapay zekâ tarafından yazılıp yazılmadığını tahmin eden klasik AI tespit araçlarından ayrılıyor. Claude’un yaklaşımında işaret, içerik oluşturulduğu sırada metnin kendisine ekleniyor.
Görsel dosyalarda C2PA standardı kullanılıyor
Anthropic, metinlerin yanı sıra bazı görsel dosyalar için de içerik kökenini doğrulamaya yönelik bir sistem kullanıyor. Şirketin destek sayfasında SVG, PNG ve JPG gibi desteklenen dosya türlerine dijital olarak imzalanmış köken bilgilerinin eklendiği aktarılıyor.
Bu bilgiler, dijital içeriklerin kaynağını ve geçmişini doğrulamak için geliştirilen C2PA standardını temel alıyor. Böylece dosyanın Claude tarafından oluşturulduğuna ilişkin köken bilgisi korunabiliyor ve içerikte sonradan değişiklik yapılıp yapılmadığının kontrol edilmesi mümkün hale geliyor.
Anthropic ayrıca bu özelliğin kullanılan platforma göre farklılık gösterebileceğini belirtiyor. Metin işaretlemesinin Claude’un farklı ürün ve kullanım alanlarında uygulanması planlanırken, dosyalardaki imzalı köken bilgilerinin her platform tarafından desteklenmeyebileceği ifade ediliyor.
Eski modeller için çalışmalar sürüyor
Yeni işaretleme sistemi 2 Ağustos 2026 ve sonrasında AB’de kullanıma sunulan yeni Claude modellerinde uygulanırken, daha eski modeller için süreç henüz tamamlanmış değil. Anthropic, 2 Ağustos’tan önce yayımlanan modellerin AB Yapay Zekâ Yasası kapsamında geçiş döneminden yararlandığını ve bu modeller için de işaretleme desteği üzerinde çalıştığını açıklıyor.
Şirket aynı zamanda Claude’un eklediği filigranların ve dosyalardaki köken bilgilerinin nasıl tespit edilebileceğine yönelik teknik çalışmalarını sürdürüyor. Anthropic, ilerleyen dönemde bu konuda daha ayrıntılı teknik dokümantasyon paylaşacağını söylüyor.
İşaretleme sistemi tek başına AI dedektörü değil
Anthropic’in açıklamasındaki önemli noktalardan biri de sistemin kesin bir “AI dedektörü” olarak değerlendirilmemesi. Örneğin bir kullanıcı kendi yazdığı metni Claude’a düzelttirebilir, çevirebilir veya özetletebilir. Bu durumda ortaya çıkan içerikte Claude’a ait bir işaret bulunması, metnin tamamının yapay zekâ tarafından oluşturulduğu anlamına gelmiyor.
Aynı şekilde bir içerikte Claude işaretinin bulunmaması da içeriğin yapay zekâ tarafından oluşturulmadığını kanıtlamıyor. Anthropic, özellikle eski modellerle oluşturulan, yoğun şekilde düzenlenen veya farklı işlemlerden geçirilen içeriklerde işaretin tespit edilemeyebileceğine dikkat çekiyor.
Yeni sistem bu nedenle “Bu metni kesin olarak yapay zekâ yazdı” sonucunu veren bir araçtan ziyade, Claude tarafından oluşturulan içeriklerin kaynağına ilişkin doğrulanabilir bir sinyal oluşturmayı amaçlıyor. Anthropic, bu yöntemle yapay zekâ içeriklerinin kaynağı konusunda daha fazla şeffaflık sağlamayı hedefliyor.
