Ne oldu?
Anthropic, Claude modellerinin ürettiği metinlere gömülü bir filigran uygulamaya başladığını duyurdu ve bu filigranın nasıl çalıştığına dair teknik ayrıntıları paylaştı. Şirkete göre filigran, kelime seçimi sırasında sık kullanılan yüksek olasılıklı belirteçler (token) arasından belirli bir örüntüye göre seçim yapılmasıyla oluşturuluyor. Anthropic, bu yöntemin metnin görünümünü veya kalitesini pratikte etkilemediğini savunuyor.
Şirketin açıklamasına göre filigran, bir metnin Claude tarafından üretilmiş olma ihtimalini göstermek üzere tasarlandı; kesin bir kanıt sunmuyor. Kod ve olgusal metinlerde kelime seçimi kısıtlı olduğundan filigran izleri daha seyrek bulunuyor. Metin tamamen yeniden yazıldığında ise filigran kayboluyor.
Neden önemli?
Anthropic ayrıca üçüncü tarafların Claude tarafından üretilmiş metinleri tespit edebilmesi için bir filigran tespit API'si duyurdu. Bu adım, yapay zeka üretimi metinlerin akademik ve profesyonel ortamlarda tespitine yönelik artan talebe bir yanıt olarak görülüyor.
Duyuru, kullanıcılar ve geliştiriciler arasında karışık tepkilere yol açtı. Bazı kullanıcılar, filigranın çeviri gibi işlemlere de uygulanacağını ve bunun üniversite öğrencileri gibi kullanıcılar için sorun yaratabileceğini savundu. Bazı teknoloji yazarları ise filigranın kaldırılamadığına ve Aralık ayından itibaren mevcut modellere de uygulanacağına dikkat çekti. Bu tartışmaların kaynağı, filigranın metnin sahipliğini mi yoksa yalnızca olası kaynağını mı gösterdiğine dair belirsizlik.
Bilinenler
- Filigran belirteç seçimi sürecine gömülü çalışıyor ve seyrek de olsa görünmez biçimde iz bırakıyor.
- Kod ve olgusal metinlerde filigran izleri daha seyrek bulunuyor.
- Metin tamamen yeniden yazıldığında filigran kayboluyor.
- Anthropic, üçüncü taraflar için bir tespit API'si duyurdu.
- Filigranın gelecekteki bütün Claude modellerine, mevcut modellere ise Aralık 2026'dan itibaren uygulanması planlanıyor.
Sırada ne var?
Anthropic, filigran tespit API'sini üçüncü tarafların kullanımına açmayı planlıyor ancak kesin bir tarih paylaşmadı. Duyuru, şirketin halka arza hazırlandığı ve yatırımcıların gelir projeksiyonlarını değerlendirdiği bir döneme denk geliyor. Filigran teknolojisinin yapay zeka içeriği tespiti tartışmalarını nasıl etkileyeceği önümüzdeki dönemde daha net görülecek.
Yöntem: olasılık değil, rastgeleliğin kaynağı
Filigranın nasıl kurulduğu, haberin ilk hâlinde anlatıldığından biraz farklı. Anthropic'in yaklaşımı Google DeepMind'ın SynthID-Text yöntemine dayanıyor ve belirteçlerin olasılıklarını değiştirmiyor; değiştirdiği şey, seçim yapılırken kullanılan rastgelelik kaynağı. Model bir kelimeyi seçerken aralarında anlam farkı olmayan birden çok makul seçenekle karşılaşıyor. Bu düşük bahisli seçimler bir metin boyunca defalarca tekrarlandığı için, hepsi aynı gizli anahtardan türetilen bir kalıba göre yapıldığında ortaya istatistiksel bir imza çıkıyor.
Sonuç okuyucu için görünmez, anahtarı elinde tutan için ölçülebilir. Anthropic imzanın metnin anlamını, kalitesini ya da okunabilirliğini değiştirmediğini söylüyor. İşaret metnin kendisinin içinde durduğu için kopyala-yapıştır ile taşınıyor ve bazı düzenlemelerden sağ çıkabiliyor.
Dosyalarda farklı bir yöntem
Üretilen PNG, JPG ve SVG dosyalarında gömülü filigran kullanılmıyor. Onlara bunun yerine, dosyanın Claude ile üretildiğini ya da işlendiğini bildiren kriptografik olarak imzalanmış C2PA künyesi ekleniyor. Aradaki fark önemli: künye dosyanın içeriğinde değil üstverisinde duruyor, dolayısıyla ekran görüntüsü almak ya da başka bir araçtan geçirmek onu silebiliyor. Metindeki filigran içeriğin kendisine gömülü olduğu için daha dayanıklı.
Neden şimdi
Adımın arkasında AB Yapay Zeka Yasası'nın şeffaflık yükümlülüğü var: 2 Ağustos'tan itibaren Avrupa'da sunulan yeni modeller için geçerli. Anthropic ise sistemi yalnızca Avrupa'da değil, Claude'un kullanılabildiği her yerde açtı. Yani düzenlemenin coğrafi kapsamı dar, uygulaması küresel oldu — bir yargı bölgesindeki kuralın ürünün tamamını şekillendirmesine örnek.