Anthropic, yeni çıkaracağı Claude modellerinin ürettiği metinlere istatistiksel filigran uygulayacak. 2 Ağustos 2026'dan önce piyasaya sürülen mevcut modellere ise filigranın önümüzdeki aylarda kademeli olarak eklenmesi planlanıyor.
Anthropic, 14 Ağustos'ta resmi açıklamasında bundan sonra piyasaya sürülecek Claude modellerine dünya genelinde filigran uygulanacağını duyurdu. Şirket, bölgesel uygulama sistemlerini birbirinden istikrarlı biçimde ayırmanın zor olduğunu belirtti.
Filigran, metne insanların okuyabileceği işaretler veya gizli karakterler eklenmesiyle oluşturulmuyor. Claude, bir sonraki kelimeyi seçerken anlam farkı büyük olmayan adaylar arasındaki seçim yöntemini ayarlayarak istatistiksel bir örüntü bırakıyor.
Sistem, okuyucunun gördüğü cümlelerin kalitesinde ve okunabilirliğinde kayda değer bir değişiklik yaratmayacak şekilde tasarlandı. Filigran, kullanıcıyı, kuruluşu veya konuşma içeriğini tanımlayabilecek bilgiler içermiyor.
Filigran tespit edilse bile bu yalnızca Claude'un içeriğin yazımına veya işlenmesine dahil olmuş olabileceğini gösteriyor. Metnin insan tarafından mı yazıldığını veya başka bir yapay zeka tarafından mı üretildiğini belirleyemiyor.
Teknolojinin teknik temeli, Google DeepMind'ın 2024'te Nature'da yayımladığı SynthID-Text yöntemi. Birden fazla aday kelimenin anlamı büyük ölçüde aynı olduğunda token seçim yöntemini ayarlayarak istatistiksel bir imza bırakan bu sistem, Google'ın çalışmasında ele alındı.
Nature makalesi, yaklaşık 20 milyon Gemini yanıtı kullanılan deneyde filigran uygulanıp uygulanmamasının kullanıcı değerlendirmelerinde istatistiksel olarak anlamlı bir fark yaratmadığını bildirdi. Ancak bu sonuç, Google modelleri ve Google'ın deney ortamına ilişkin bir doğrulama niteliğinde. Aynı sonucun Claude'un tüm modelleri, dilleri ve kullanım alanları için geçerli olduğunu söylemek mümkün değil.
Kısa cümlelerde veya kesin yanıt gerektiren olgusal ifadeler ile kodlarda aday seçeneklerin sınırlı olması, filigran tespitinin güvenilirliğini düşürebilir. Metnin bir bölümü düzenlendiğinde izler kalabilirken, cümlenin tamamının yeniden yazılması filigranı zayıflatabilir.
Çeviri gibi Claude'un cümlenin tamamını yeniden ürettiği işlemlerde filigran uygulanıyor. Buna karşılık, tam yeniden yazım veya çeviri sonrasında tespit gücünün korunup korunmayacağı gerçek kullanım ortamlarında doğrulanması gereken bir unsur olarak öne çıkıyor.
Uygulamanın kurumsal arka planında Avrupa Birliği'nin (AB) AI Act düzenlemesi bulunuyor. Avrupa Komisyonu, AI Act şeffaflık kurallarına ilişkin açıklamasında, yapay zeka tarafından üretilen veya değiştirilen içeriklere makine tarafından okunabilir işaretler eklenmesini öngören şeffaflık yükümlülüğünün 2 Ağustos'ta uygulanmaya başlayacağını belirtti.
İlgili uygulama kuralları gönüllü nitelik taşısa da yapay zeka tarafından üretilen içeriklerin işaretlenmesine ilişkin yükümlülük yasal zorunluluk olarak uygulanıyor. 2 Ağustos'tan önce piyasaya sürülen Claude modelleri için geçiş süresi tanınırken Anthropic, bu modellere de filigran eklemeyi planladığını açıkladı.
Anthropic, 1 Eylül'deki güncellemesinde tespit API'sını özel ön izleme olarak sunacağını duyurdu. İlk hedef gruplar arasında düzenleyici kurumlar, kolluk birimleri, medya kuruluşları, doğrulama platformları, bağımsız araştırma kurumları ve eğitim kurumları yer alıyor. API'nin genel kullanıma açılacağı tarih ise açıklanmadı.
Tespit API'sı, filigranın var olma ihtimalini kontrol etmeye yarayan yardımcı bir araç. Anthropic, filigranın telif hakkı, mülkiyet veya hukuki sorumluluk konusunda karar vermek için kullanılamayacağını belirtti.
Anthropic daha önce Claude tarafından üretilen metinlere filigran uygulama yöntemini açıklamıştı. Ancak o dönemde tüm ürün grubuna uygulandığına ilişkin resmi bir açıklama yapılmamıştı. Son açıklama, yeni modellere uygulanacak sistemi ve mevcut modellere yönelik kademeli uygulama planını netleştirdi.
Bu adım, kripto para piyasası için doğrudan bir fiyat değişkeninden çok, üretken yapay zeka içeriklerinin kaynağını doğrulama yöntemleri ve endüstri standartları üzerindeki rekabetle ilgili. Bundan sonraki süreçte filigranın tespit doğruluğu, yeniden yazım ve çeviri sonrasındaki dayanıklılığı, tespit API'sına erişim yetkileri ve yapay zeka şirketleri arasındaki işaretlerin birlikte çalışabilirliği izlenecek.
Yorum 0