Anthropic, Avrupa Birliği’nin yapay zekâ alanındaki yeni şeffaflık kurallarına uyum sağlamak amacıyla Claude tarafından oluşturulan metinlere filigran eklemeye başladığını açıklamıştı. Şirketin tercih ettiği yöntem, metnin üzerinde görülebilen bir işaret veya insanların okurken fark edebileceği özel bir biçimlendirme kullanmıyor. Bunun yanında metne sonradan tespit edilebilecek görünmez karakterler de yerleştirilmiyor. Bunun yerine Claude, metni oluştururken yaptığı sözcük seçimlerinin içine yalnızca uygun anahtara sahip sistemlerin çözebileceği istatistiksel bir desen yerleştiriyor. Böylelikle ortaya çıkan metnin normal biçimde okunması korunurken Claude’un üretim sürecine dahil olup olmadığı daha sonra teknik olarak incelenebiliyor.
Büyük dil modelleri metin üretirken sıradaki sözcük veya daha doğru ifadeyle token için bağlama uygun çok sayıda olasılığı değerlendiriyor. Normal koşullarda model, olasılık dağılımı içindeki uygun seçeneklerden birini örnekleme yöntemiyle belirliyor ve metni bu işlem tekrarlanarak oluşturuyor. Anthropic’in filigran sistemi etkin olduğunda ise Claude’un seçenekler arasındaki tercihini belirlemek için rastgeleliğin yerine gizli bir anahtar devreye giriyor. Şirket, yöntemi anlatırken pi sayısının basamaklarının anahtar olarak kullanıldığı basitleştirilmiş bir örnek veriyor. Buna göre, anahtardaki rakamlar modelin olası sözcükler arasından hangi seçeneğe yönelmesi gerektiğini belirleyerek metin boyunca daha sonra çözülebilecek bir desen meydana getiriyor.
Claude metinlerindeki filigran nasıl tespit edilecek?
Anthropic’in kullandığı teknik, Google DeepMind tarafından geliştirilen ve ayrıntıları Nature dergisinde yayımlanan bir araştırmada açıklanan SynthID-Text yaklaşamasının uyarlanmış bir biçimine dayanıyor. SynthID-Text de üretken yapay zekânın sözcük seçimlerini kontrollü biçimde yönlendirerek insan gözüyle fark edilmesi güç bir istatistiksel imza oluşturuyor. Anthropic’e göre bu işlem Claude’un yanıt kalitesinde bir düşüşe yol açmıyor ve metin oluşturma süresini uzatmıyor. Sistem fazladan token kullanılmasını gerektirmediği için kullanıcı açısından üretim maliyetinin yükselmesi de beklenmiyor. Böylece filigranın modelin olağan çalışma biçimine mümkün olduğunca az müdahaleyle uygulanması hedefleniyor.
Yapay zekâ tarafından yazılan metinleri yalnızca kullanılan dil kalıplarına bakarak tahmin etmek zaten mümkün olabiliyor. Büyük dil modellerinin belirli cümle yapılarını, geçiş ifadelerini veya karşılaştırma biçimlerini sık kullanması metnin yapay zekâ desteğiyle hazırlanmış olabileceği yönünde ipucu verebiliyor. Ne var ki bu tür dil özellikleri hangi modelin kullanıldığını güvenilir biçimde ortaya koymuyor ve tek başına kesin kanıt niteliği taşımıyor. Anthropic bu nedenle filigranı kontrol edebilecek anahtarları içeren bir API de sunmayı planlıyor. Söz konusu sistem, incelenen yeterince uzun bir metin parçasında Claude’a ait filigran desenini arayarak modelin metnin hazırlanmasına dahil olma ihtimalini belirleyebilecek.
İLGİNİZİ ÇEKEBİLİR

Claude’un yeni filigran sistemi kullanıcılar arasında tartışma yarattı

Anthropic CEO’su yapay zekaya tepkinin asıl nedenini açıkladı

Claude’un yazdığı metinler artık gizli bir işaret taşıyor

Çin, F-22 ve F-35’leri ısı izinden yapay zekayla arıyor

Yapay zeka işleri hızlandırdı ama mesai 90 saate kadar çıktı
Sistemin sınırları da bulunuyor. Anthropic, filigranın Claude’un bir metni baştan sona yazdığını kanıtlamadığını özellikle belirtiyor. Kullanıcının kendi hazırladığı bir metni Claude’a düzenletmesi durumunda ortaya çıkan içerik de filigran taşıyabiliyor. Aynı durum Claude kullanılarak yapılan çeviriler için de geçerli olacak. Dolayısıyla tespit sistemi esas olarak Claude’un söz konusu içerikle üretim veya düzenleme aşamalarından birinde muhtemelen etkileşime girdiğini gösterebiliyor; metnin yazarlığını kesin biçimde belirleyen bir mekanizma olarak çalışmıyor.
Günün Öne Çıkan Fırsatları

REKLAM — Bu içerikte satış ortaklığı bağlantıları bulunmaktadır. Bu bağlantılar üzerinden yapılan alışverişlerden Teknoblog komisyon kazanabilir.
Bununla birlikte filigranın her durumda tespit edilebilmesi de mümkün değil. Claude yalnızca yazım hatalarını düzeltmiş veya metin üzerinde çok küçük değişiklikler yapmışsa yeterli istatistiksel desen oluşmayabiliyor. Çok kısa metinlerde de benzer bir sorun ortaya çıkıyor; çünkü güvenilir bir değerlendirme için yeterli sayıda sözcük seçiminin bulunması gerekiyor. Öte yandan Claude tarafından oluşturulmuş bir metinde daha sonra birkaç küçük değişiklik yapılması filigranı ortadan kaldırmaya yetmeyebilir. Filigranın tamamen kaybolması için metnin kapsamlı biçimde yeniden yazılması gerekebiliyor.
Kod tarafında ise yöntemin uygulanması daha sınırlı olacak. Bunun nedenlerinden biri, programlama sırasında modelin her zaman birbiriyle eşdeğer çok sayıda çıktı seçeneğine sahip olmaması. Belirli bir sözdiziminin veya tam olarak belirlenmiş bir çıktının gerekli olduğu durumlarda Claude’un alternatifler arasından seçim yapması mümkün olmadığından filigran deseni de üretilemiyor. Anthropic bu nedenle kodlarda diğer bazı metin türlerine kıyasla genel olarak daha az filigran bulunacağını söylüyor. Yapay zekâ tarafından üretilen kodların telif hakkı ve sahiplik tartışmalarına konu olması düşünüldüğünde, bu teknik sınırlama filigranın tek başına bir kod tabanının kaynağını kesin biçimde belirleyemeyeceğini de gösteriyor.
Anthropic yalnızca metinlerle yetinmeyerek Claude’un oluşturduğu görseller için de farklı bir işaretleme yöntemi kullanacak. Görsellerin meta verilerine, içeriğin Claude tarafından üretildiğini belirten kriptografik olarak imzalanmış bir kayıt eklenecek. Şirket, filigran uygulamasını başlangıç aşamasında belirli bölgelerle sınırlamak yerine Claude’un tüm çıktılarında etkinleştireceğini belirtiyor. Bunun gerekçesi, değişiklikleri bölgesel olarak güvenilir biçimde uygulayabilecek bir mekanizmanın henüz bulunmaması. Düzenleme, 2 Ağustos’tan sonra yayımlanan modelleri kullanan tüm Claude ürünlerinin çıktılarını kapsarken eski Claude modellerine de önümüzdeki aylarda filigran desteği getirilecek.






