Claude’un metinlerine gizli filigran geliyor: Yapay zeka içerikleri böyle tespit edilecek
Anthropic, Claude’un ürettiği metinlerde yapay zeka tarafından oluşturulduğunu ortaya koyabilecek gizli bir filigran sistemi üzerinde çalışıyor.
Yapay zeka sohbet robotlarının ürettiği metinlerin insan eliyle yazılan içeriklerden ayırt edilmesine yönelik çalışmalar hız kazanırken, Anthropic’ten dikkat çeken bir adım geldi. Şirket, Claude modelinin metin oluşturma sisteminde değişikliğe giderek çıktılara dışarıdan bakıldığında fark edilmesi zor bir filigran yerleştirmeyi planladığını açıkladı. Yeni sistem, metin içerisindeki kelime seçimlerinde yapılan küçük ve rastgele değişikliklerden yararlanarak yapay zeka tarafından oluşturulan içeriklerin özel sistemlerle tespit edilmesini sağlayacak.
KELİME SEÇİMLERİNDEKİ RASTGELELİK KULLANILACAK
Yapay zeka modelleri metin üretirken bir sonraki kelimeyi seçmek için farklı olasılıkları değerlendiriyor. Aynı cümle farklı zamanlarda oluşturulduğunda modelin benzer anlam taşıyan farklı kelimeleri tercih edebilmesinin temelinde de bu istatistiksel yapı bulunuyor.
Anthropic’in planladığı filigran sistemi ise modelin bu doğal rastgeleliğinden yararlanacak. Sistem, kelimelerin seçilme olasılıklarını belirli ölçüde değiştirerek metnin tamamında insanlar tarafından fark edilmesi güç, ancak özel tespit araçlarının belirleyebileceği istatistiksel bir iz oluşturacak.
Örneğin modelin aynı anlamı taşıyan iki kelime arasında seçim yaptığı bir noktada, filigran mekanizması belirli tercihlere ağırlık verecek. Bu tercihler metnin genelinde bir araya geldiğinde, yapay zeka üretimini ortaya koyabilecek bir kalıp meydana gelecek.
“ORTALAMA OKUYUCU FARK EDEMEYECEK”
Anthropic, oluşturulacak filigranın sıradan bir okuyucu tarafından fark edilemeyecek şekilde tasarlanacağını ve rastgele bir yapıya sahip olacağını belirtti.
Bu yöntem sayesinde metnin görünümünde belirgin bir değişiklik meydana gelmemesi, ancak teknik analiz yapılması halinde içeriğin yapay zeka tarafından üretilip üretilmediğine ilişkin işaretlerin ortaya çıkarılması hedefleniyor.
TEKNOLOJİ YAZARINDAN ELEŞTİRİ
Filigran uygulaması teknoloji çevrelerinde ise tartışmayı beraberinde getirdi. Teknoloji yazarı John Gruber, sistemin Claude’un metin üretme kabiliyetini olumsuz etkileyebileceğini savundu.
Gruber’a göre modelin kelime tercihlerini belirli bir filigran düzenine göre değiştirmesi, bazı durumlarda en doğru veya en uygun kelimenin seçilmesinin önüne geçebilir. Bu durumun da metin kalitesini sınırlayabileceği öne sürüldü.
Ancak University College London bilgisayar bilimleri profesörü Steven Murdoch, söz konusu değişikliğin kullanıcı tarafından fark edilebilecek ölçüde bir etki oluşturmasının beklenmediğini ifade etti.
“RASTGELELİK MODELLERİN TEMELİNDE VAR”
Uzmanlara göre yapay zeka modellerinin metin üretiminde kullandığı rastgelelik, sistemlerin çalışma mekanizmasının önemli bir parçasını oluşturuyor.
Murdoch, modellerin olasılıklara dayalı seçimler yapmasının doğal olduğunu belirterek, bu mekanizmanın ortadan kaldırılması durumunda sistemlerin belirli ifadeleri veya kalıpları sürekli tekrarlayabileceğine dikkat çekti.
Bu nedenle Anthropic’in filigran amacıyla kelime seçimlerinde yapacağı sınırlı değişikliklerin modelin genel performansını ciddi biçimde etkilemeyebileceği değerlendiriliyor.
YAPAY ZEKA METİNLERİNİN KAYNAĞI DAHA KOLAY BELİRLENECEK
Planlanan sistemin en önemli kullanım alanlarından birinin eğitim dünyası olması bekleniyor. Yapay zeka tarafından hazırlanan metinlerin öğrenciler veya akademisyenler tarafından herhangi bir değişiklik yapılmadan kendi çalışmalarıymış gibi sunulmasının önüne geçilmesi, filigran teknolojisinin hedefleri arasında gösteriliyor.
Özellikle yapay zeka kullanımının hızla yaygınlaşmasıyla birlikte, bir metnin insan tarafından mı yoksa bir sohbet robotu tarafından mı oluşturulduğunun belirlenmesi eğitim kurumları açısından giderek daha önemli hale geliyor.
AMAÇ SADECE İÇERİK TESPİTİ DEĞİL
Filigran uygulamasının yalnızca akademik sahtekarlık veya yanlış bilgiyle mücadele amacı taşımadığına da dikkat çekiliyor.
İnternette yapay zeka tarafından üretilen içeriklerin hızla çoğalması, gelecekte yapay zeka modellerinin eğitiminde kullanılan verilerin niteliği açısından yeni bir sorun oluşturabilir. Modellerin internet üzerindeki kendi ürettikleri içeriklerle yeniden eğitilmesi, zaman içerisinde veri kalitesinin düşmesine ve sistemlerin performans kaybı yaşamasına yol açabilecek bir risk olarak değerlendiriliyor.
Bu nedenle yapay zeka üretimi içeriklerin tespit edilebilmesini sağlayacak filigranların, gelecekte eğitim verilerinin kaynağının belirlenmesi ve insan üretimi içerikle yapay zeka üretimi içeriğin birbirinden ayrılması açısından da önem kazanabileceği belirtiliyor.