Yapay zeka geliştiricisi OpenAI, Avrupa Birliği'nin Yapay Zeka Yasası kapsamındaki şeffaflık standartlarına uyum sağlamak amacıyla ürettiği metinlere görünmez işaretler ekleyeceğini duyurdu. Önümüzdeki haftalardan itibaren ChatGPT ve Codex platformlarında devreye girecek olan "textGrain" teknolojisi, metin çıktılarına insan gözüyle fark edilemeyen istatistiksel sinyaller entegre edecek.

Özelliğin Erişimi ve Uygulama Alanları
OpenAI tarafından yapılan bilgilendirmeye göre söz konusu görünmez işaretleme sistemi, Avrupa Birliği sınırları içerisindeki ChatGPT ve Codex kullanıcılarının metin çıktılarına kademeli olarak tanımlanacak. Dünya genelindeki API kullanıcıları ise seçili modeller için bu özelliği bugünden itibaren tercihlerine bağlı olarak aktif hale getirebilecek; ancak sistem API tarafında varsayılan olarak kapalı tutulacak. Şirket aynı zamanda bulut platformu ortaklıkları üzerinden sunulan model çıktılarına da bu teknolojiyi dahil etmek için çalışmalarını sürdürüyor.
textGrain Teknolojisi ve Müdahaleler Karşısındaki Sınırları
Açıklanan teknik verilere göre textGrain sistemi, yapay zekanın kelime seçim sürecine özel istatistiksel izler yerleştirerek çalışıyor. Ancak yapılan testler, metin üzerinde değişiklik yapıldığında filigranın tespit edilebilirliğinin azaldığını ortaya koyuyor. Yüzde 1 yanlış pozitiflik payıyla yapılan denemelerde, psikoloji gibi esnek kelime kullanımına uygun 400 tokenlik metinlerde yüzde 95 olan tespit oranı, 200 tokenlik metinlerde yüzde 80'e düşüyor. Matematik gibi kelime varyasyonlarının kısıtlı olduğu alanlarda ise tespit imkanı belirgin şekilde azalıyor.

Düzenlemelerin Tespit Gücüne Etkisi
Metin içeriğinde yapılan kelime değişiklikleri sinyal gücünü doğrudan etkiliyor. 400 tokenlik bir içeriğin kelimelerinin yüzde 10'u eşanlamlılarıyla değiştirildiğinde doğrulama oranı yüzde 92'den yüzde 66'ya gerilerken, bu değişim oranı yüzde 25'e çıktığında tespit oranı yüzde 17 seviyesine kadar iniyor. Bu teknik sınırlamalar, hatalı pozitif ve hatalı negatif sonuç alma riskleri nedeniyle tespit aracı doğrudan genel kullanıma açılmayacak. Doğrulama yazılımına erişim, sistemi test etmeleri ve geliştirmeleri amacıyla yalnızca onaylanan araştırmacı ve uzman kuruluşlara başvuru ile sağlanacak.
Çıktı Kalitesi ve Doğrulama Araçlarının Kapsamı
Şirket, gelişmiş modeli Astra üzerinde gerçekleştirdiği performans testlerinde filigran uygulamasının metin kalitesinde kayda değer bir düşüşe yol açmadığını ifade etti. Kıyaslama verilerinde yapay zeka analiz endeks puanı filigransız metinde 49,57 iken filigranlı metinde 49,76 olarak ölçüldü; GPQA Diamond testinde ise filigransız yüzde 94,44 olan başarı oranı filigranlı sürümde yüzde 93,94 oldu. OpenAI, görünmez işaretlerin metindeki insan katkısını ölçmediğini, telif ya da sorumluluk belirlemediğini, kullanıcı veya girdi verilerini açığa çıkarmadığını bildirdi. Görsel ve ses içeriklerinde kullanılan SynthID ve C2PA tabanlı doğrulama araçları ise kamuya açık kalmaya devam edecek.



