“Sansürsüz yapay zekâ” ifadesi bazı kullanıcılar için özgürlük vaadi taşıyor. Bulutta çalışan büyük modeller, şirketlerin güvenlik politikaları nedeniyle silah, suç, kendine zarar verme, zararlı yazılım veya başka riskli konularda ayrıntılı yardım vermeyi reddedebiliyor. Yerel olarak bilgisayarda çalıştırılan açık modellerde ise kullanıcı bu güvenlik katmanlarını değiştirebiliyor veya tamamen kaldırabiliyor. Clubic’in 3 Ekim’de yayımladığı deney bu farkı sınamak için yapıldı.
Gazeteci Colin Golberg, güvenlik filtreleri azaltılmış bir yerel modeli bilgisayarına kurup günlük işinde normalde sormayacağı, ana akım sohbet botlarının önemli bölümünün reddedeceği talepler yöneltti. Aynı soruları karşılaştırma amacıyla ChatGPT’ye de verdi. Yazının amacı yasa dışı talimatları yayımlamak değil, iki sistemin sınır çizme davranışını karşılaştırmaktı.
Deneyde yerel model bazı riskli taleplerde ilk cümlede etik veya yasal uyarı üretti fakat ardından ayrıntılı cevap vermeye devam etti. Yani güvenlik davranışı gerçek bir engelden çok dilsel bir “itiraz” düzeyinde kaldı. Bu, modelin temel eğitiminde güvenli yanıt örnekleri bulunduğu halde sonradan uygulanan koruma katmanlarının zayıflatılmasının ne kadar büyük fark yaratabileceğini gösteriyor.
Burada “sansür” ve “güvenlik” kavramlarını ayırmak gerekiyor. Bir modelin siyasi görüş veya tartışmalı sanat konusu hakkında gereksiz yere konuşmaması kullanıcı özgürlüğü sorunu olabilir. Aynı modelin patlayıcı, kötü amaçlı yazılım veya şiddet için yüksek uygulanabilirlikte talimat vermesi ise fiziksel ve dijital güvenlik meselesi. Tek bir filtre seviyesi bu iki alanı kusursuz ayıramıyor.
Açık model savunucuları merkezi şirketin hangi soruya cevap verileceğini belirlememesi gerektiğini, araştırmacı ve geliştiricilerin modeli kendi donanımlarında denetleyebilmesinin önemli olduğunu savunuyor. Ayrıca kapalı sistemlerin kuralları da hatalı, kültürel olarak önyargılı veya aşırı kısıtlayıcı olabilir. Karşı görüş ise en güçlü sistemlerin güvenlik önlemleri tamamen kaldırılabilir biçimde dağıtılmasının kötüye kullanım maliyetini ciddi biçimde düşürdüğünü söylüyor.
Clubic deneyi bilimsel benchmark değil; tek gazetecinin belirli bir model ve istem setiyle yaptığı saha testi. Sonucu bütün açık modeller için genellemek doğru olmaz. Fakat deney, yakın geleceğin en zor teknoloji politikası sorularından birini görünür kılıyor: Kullanıcının tamamen kontrol ettiği bir yapay zekâ ne kadar güçlü olmalı?
Yazının sonunda rahatsız olanın model değil gazeteci olması da anlatının en çarpıcı tarafı. Teknik olarak makine yalnız olasılıksal metin üretiyor; etik sınırı koymak hâlâ onu geliştiren, dağıtan ve kullanan insanların işi.
Kaynak bağlantısı: https://www.clubic.com/dossier-632209-j-ai-pousse-une-ia-non-censuree-dans-ses-retranchements-c-est-moi-qui-ai-fini-mal-a-l-aise.html