Yapay Zekada Gizli Filigran Açıklandı: Claude’un Şeffaflık Taşıyıcı Sistemi
Anthropic, Claude adlı yapay zeka modelinin metinlerine eklenecek gizli filigran sistemiyle ilgili yeni bir blog yazısı yayımladı. Şirket, filigranın nasıl çalışacağı ve metin üzerindeki düzenlemelerin etkisini detaylıca anlattı. Kullanıcılar, Avrupa Birliği Yapay Zeka Yasası’nın Şeffaflık Kodu’na uyum sağlamak amacıyla filigran kullanılacağını duyunca derin tartışmalara girdi. Sokağa çıktıda, kullanıcılar tam anlamıyla şaşırdı.
Filigran, Claude’un metin oluştururken kullandığı ‘düşük riskliovercast’ ile ‘greyişaretlerinibu X değil, Y’ şeklinde cümle yapısı üzerinden tespit ediliyor. Anthropic, bu örüntüleri yakalama yönteminin metinde doğrudan filigran varlığını kontrol ettiğini belirtti. Metnin yeniden yazılması durumunda filigranın ortadan kaldırılıp kaldırılamayacağına dair açıklamalarda, hafif düzenlemelerle filigranın tamamen ortadan kalkmayacağını vurguladı.
Claude kullanıcıları, filigran sisteminin uygulanmasının yarattığı belirsizliklere tepki gösterdi. Küçük düzenlemelerle metindeki kelimelerin neredeyse tamamı insan yazımı olarak kalacak, bu yüzden filigranın yerleşebileceği çok az içerik kalacağını düşündüler. Gelimiyi mi? Birçok kullanıcı, tam bir yeniden yazımın filigranı kaldıracağını ancak metnin yapay zeka tarafından oluşturulmuş olarak tanımlanıp tanımlanamayacağını sorguluyor.
Kod çıktılarında filigranlamanın diğer metin türlerine kıyasla daha sınırlı olması bekleniyor. Bunun nedeni, Claude’un kod üretirken eşit derecede geçerli seçenekler arasında serbestçe tercih yapma imkanının doğal dildeki kadar geniş olmamasıdır. Kod çıktılarında, sistemin filigran tespiti için özel algoritmalar kullandığı bildirildi.
Claude’un yalnızca düzelttiği veya editörlük yaptığı insan yazılmış metinlerde filigranın tespit edilip edilemeyeceği, metnin uzunluğuna ve yapılan değişikliklerin kapsamına bağlıdır. Kısıtlı düzenlemelerle filigran çok az kalır, ama kapsamlı bir yeniden yazım filigranı ortadan kaldırabilir. Bakalım bu filigran sistemi, gelecekteki AI içeriklerin şeffaflığını nasıl etkiler?
Kaynak: Orijinal Haber

