Anthropic, Avrupa Birliği’nin yeni yapay zeka şeffaflık kurallarına uymak için Claude AI tarafından üretilen metinlere nasıl filigran eklediğini açıkladı. Şirket, metin filigranının kolayca görülebilen görseller içermeyeceğini, okuyan kişiler tarafından ayırt edilemeyeceğini ve metne gizli karakterler eklemeyeceğini söyledi. Bunun yerine, Anthropic’in yöntemi, yalnızca anahtarı olan biri tarafından çözülebilen bir deseni metne bırakmayı içeriyor.
Anthropic AB yasaları uyumu için yeni eklemeler yapıyor
Şirket, büyük dil modellerinin metin oluştururken, kullanılabilecek potansiyel uygun kelimeler listesinden seçim yaparak her seferinde bir kelime seçtiğini açıkladı. Rastgele kelimeler seçiyorlar, yeter ki ürettikleri bağlam için anlamlı olsunlar. Filigran açıkken, Claude bir sonraki kelimeyi seçmek için rastgele bir sayı üreteci kullanmak yerine, hangi kelimeyi seçeceğine karar vermek için bir anahtar kullanacak. Örneğin, Anthropic pi sayısının rakamlarını anahtar olarak kullandı. Diyelim ki, anahtar pi dizisi 3.1415926535’ten 2 rakamıyla başlıyor. Oluşturulan bir sonraki kelime, seçenekler listesindeki altıncı kelime, ardından beşinci, üçüncü ve sonra tekrar beşinci kelimedir. Bu yöntem, ekibin Nature’da yayınlanan bir makalede açıkladığı Google DeepMind’ın SynthID-Text yaklaşımının bir uyarlamasıdır. Şirket, filigranlamanın Claude’un çıktısının kalitesini etkilemediğini veya yavaşlatmadığını ve ek belirteçler gerektirmeyeceğini veya üretimleri daha pahalı hale getirmeyeceğini söyledi.
Elbette, yapay zeka tarafından oluşturulan metinlerde genellikle ipuçları bulunur. Modeller, örneğin “bu [X] değil, [Y]” gibi belirli cümle yapılarını kullanmayı severler. Ancak bu ipuçları, yalnızca o metni yazmada bir yapay zekanın yer aldığını anlamanıza yeterlidir, kullanılan modeli değil. Anthropic, Claude’un filigranını çözmek için “anahtarlar” içeren bir API yayınlayacak ve kontrol edilen metin bloğunun yapay zeka tarafından oluşturulup oluşturulmadığını söyleyebilecektir.
Anthropic, metin filigranlama yönteminin sınırlamaları olduğunu kabul ediyor. Yapay zekâ, Claude’un metni gerçekten kendisinin mi yazdığını yoksa sadece düzenlediğini mi ayırt edemez; bu da yapay zekâdan bir şeyi düzenlemesini isterseniz, metnin de filigranlı olacağı anlamına gelir. Şirketin açıkladığı gibi, yapay zekâ yalnızca Claude’un bir noktada metinle muhtemelen ilgilendiğini anlayabilir. Çeviriler bile filigranlı olacaktır. Claude metni yalnızca gözden geçirip hafifçe düzenlediyse veya metin çok kısaysa, filigran tespit edilemeyecek kadar küçük olabilir. Claude tarafından oluşturulan metni hafifçe düzenlemenin filigranı kaldırmayacağını unutmayın. Emin olmak istiyorsanız, metni tamamen yeniden yazmanız gerekecektir.

