Claude ürettiği metne filigran koyuyor: yöntem ve sınırları
Filigran, metnin anlamını değiştirmeyen kelime tercihlerinin nasıl yapıldığını değiştiriyor; kısa metinlerde ve kodda güvenilirliği düşüyor.
Bir metnin yapay zekâ tarafından üretilip üretilmediğini anlamak, üretmekten çok daha zor bir problem. Anthropic, Claude'un çıktısına yerleştireceği filigranın nasıl çalıştığını ve nerede işe yaramadığını ayrıntılandıran bir açıklama yayımladı. Şirket bu değişikliği, diğer büyük sağlayıcılarla birlikte AB Yapay Zekâ Yasası'na uyum için yaptığını belirtiyor; 2 Ağustos'tan itibaren AB pazarına hizmet veren sağlayıcılar üretilen içeriği işaretlemek zorunda.
Yöntem metne görünmez karakter ya da fazladan jeton eklemiyor. Model bir metni kelime kelime üretirken her adımda olası adaylar arasından seçim yapıyor. "Bugün hava soğuk ve..." cümlesinde sıradaki kelimenin "şekerli" olma ihtimali yok denecek kadar düşük, ancak "kapalı" ya da "gri" olması oldukça olası. Okur açısından hangisinin seçildiği çoğu zaman fark etmiyor — cümlenin anlamı değişmiyor. Normalde bu seçim rastgele bir sayıyla belirleniyor.
Filigran, bu düşük önemli seçimlerin nasıl yapıldığını değiştiriyor. Rastgele sayı üreteci yerine bir anahtar ve metindeki önceki birkaç kelime kullanılıyor. Seçimler yine rastgele görünüyor, ancak anahtara sahip olan taraf kelime dizisinin bu anahtarla uyumlu olup olmadığını sınayabiliyor ve metnin Claude tarafından üretilmiş olma olasılığını hesaplayabiliyor.
Şirketin altını çizdiği bir nokta var: yöntem modeli kalıcı olarak belirli kelimelere yönlendirmiyor. Bir cümlede "kapalı", sonrakinde "gri" seçilebiliyor. Filigran ayrıca modeli normalde hiç kullanmayacağı tuhaf bir kelimeye itmiyor.
Anthropic'in belirttiğine göre yöntem metin kalitesini etkilemiyor, üretim hızını yavaşlatmıyor ve maliyeti artırmıyor. Filigran kimlik bilgisi taşımıyor; belirli bir kişiye, kuruma ya da sohbete geri izlenemiyor. Teknik temel olarak Google DeepMind'ın 2024'te Nature'da yayımlanan SynthID-Text çalışmasının bir sürümü kullanılıyor; fikrin kökeni Scott Aaronson'ın 2022'deki önerisine dayanıyor.
Açıklamanın en dikkat çekici bölümü sınırlamalar. Tek doğru cevabı olan ifadeler filigran taşımıyor, çünkü modelin seçim yapabileceği alan kalmıyor. Kesin çıktı gerektiren kod parçalarında da aynı sorun geçerli. Kısa metinlerde tespit güvenilir değil; metin uzadıkça güven artıyor. Metin baştan yeniden yazılacak ölçüde düzenlendiğinde filigran tamamen kayboluyor.
Doğrulama için bir API özel inceleme aşamasında bulunuyor ve düzenleyiciler, medya kuruluşları, doğrulama kuruluşları, araştırmacılar ile uyum yükümlülüğü olan şirketlere açılıyor. Görsel dosyalarda ise C2PA standardında içerik kimlik bilgisi kullanılıyor: dosyanın kendisi değişmiyor, üst veriye imzalı bir not yazılıyor. Şirket filigranın mülkiyeti ya da telif hakkını değiştirmediğini, yalnızca Claude'un katkısını tespit etmeye yaradığını belirtiyor.
İlgili rehber
Adım adım rehber
Türkçe Claude Skill Paketi: Claude'a Türkçe İş Yaptıran 10 Hazır Beceri (Ücretsiz)
TDK imla denetiminden dilekçe yazmaya, KVKK kontrolünden Excel rapor özetine: Claude'a Türkçe işleri doğru yaptıran 10 h... Rehberi oku →
Adım adım rehber
Claude Code Nasıl Kurulur ve Kullanılır? Windows, Mac ve Linux İçin Adım Adım
Claude Code'u Windows, macOS ve Linux'a kurmak, hesabınızı bağlamak ve ilk projenizde kullanmak için adım adım Türkçe re... Rehberi oku →
Yorumlar (0)
Bu içeriğe henüz yorum yapılmamış.
Yorumlar yayınlanmadan önce moderasyondan geçer.