Çin merkezli Alibaba’nın geliştirdiği Qwen, dünyanın en yaygın açık ağırlıklı yapay zekâ model ailelerinden biri. Modeller ücretsiz indirilebiliyor, şirketlerin kendi sunucularında çalıştırılabiliyor ve daha pahalı kapalı sistemlere alternatif olarak giderek daha fazla ürüne entegre ediliyor. CBS News’in aktardığı yeni araştırma ise bu teknik avantajın yanında daha az görünür bir özelliğe dikkat çekiyor: Modelin bazı siyasi konularda sistematik biçimde Çin devletinin sınırlarına yaklaşması.

İsrail merkezli siber güvenlik şirketi Hirundo’nun testlerinde Qwen’e Tiananmen Meydanı’ndaki 1989 olayları, 2019 Hong Kong protestoları, Uygurlar, Falun Gong ve Çin Devlet Başkanı Şi Cinping’le ilişkilendirilen Winnie the Pooh göndermeleri gibi başlıklar soruldu. Araştırmacılar, modelin bazı soruları reddettiğini, bazılarında Çin yönetiminin resmî söylemine yakın ifadeler kullandığını ve kimi zaman kullanıcıyı “ilgili yasa ve düzenlemelere” uymaya çağırdığını bildirdi. CBS de bazı örnekleri kendi testlerinde yeniden gözledi. Alibaba, kanalın yorum talebine yanıt vermedi.

Araştırmanın önemi Qwen’in yalnız Çin’de kullanılmaması. Açık ağırlıklı modeller indirildikten sonra dünyanın herhangi bir yerindeki geliştirici tarafından yeni bir ürünün içine yerleştirilebiliyor. CBS’in haberinde Qwen’in milyarlarca kez indirildiği ve ABD’deki bazı büyük şirketlerin de Çin yapımı açık modelleri değerlendirdiği vurgulanıyor. Maliyet avantajı önemli: geliştirici modeli kendi altyapısında çalıştırabildiği için her sorguda büyük bir Amerikan YZ şirketine ödeme yapmak zorunda kalmayabiliyor.

Ancak burada yeni bir tedarik zinciri sorunu ortaya çıkıyor. Bir şirket yabancı ülkede geliştirilmiş modeli yalnızca “yazılım bileşeni” olarak gördüğünde, modelin eğitim verisi ve güvenlik ayarlarıyla birlikte siyasi varsayımlarını da ithal edebilir. Üstelik bu önyargılar klasik bir sansür listesi gibi görünmeyebilir; cevapların tonu, hangi olayların nasıl adlandırıldığı, hangi soruların reddedildiği gibi daha ince biçimlerde ortaya çıkabilir.

Bu sorun yalnız Çin modellerine özgü değil. Her büyük dil modeli geliştiricisinin içerik politikaları, güvenlik kuralları ve toplumsal değer tercihleri var. Amerikan ya da Avrupalı modeller de tarafsız bir boşlukta doğmuyor. Qwen tartışmasını önemli kılan, açık modellerin küresel yayılımı sayesinde bu tercihlerin sınır ötesi yazılım altyapısına dönüşebilmesi.

Dolayısıyla soru artık yalnız “hangi model daha ucuz ya da daha güçlü?” değil. Şirketler ve devletler için yeni soru şu: Kullandıkları model hangi konularda konuşmuyor, hangi bakış açısını varsayılan kabul ediyor ve bunu kim belirliyor?

Araştırmanın yönteminin de sınırları var. Bir modelin belli istemlerde kaçınması, eğitim verisinden mi, sonradan eklenmiş güvenlik talimatından mı yoksa uygulamayı işleten sunucu katmanından mı kaynaklanıyor, her zaman kolayca ayrıştırılamıyor. Açık ağırlıklı bir model indirildiğinde bu davranışların bir bölümü ince ayarla değiştirilebilir. Dolayısıyla sonuç “Qwen değişmez biçimde sansürlüdür” değil; varsayılan sistemin belirli siyasi konularda sistematik davranış gösterdiği yönünde. Asıl politika sorunu da burada: kritik alanlarda model kullanan kurumlar yalnız performans testini değil, değer ve sansür testini de tedarik sürecinin parçası yapmak zorunda kalabilir.

Kaynak bağlantısı: https://www.cbsnews.com/news/china-ai-qwen-artificial-intelligence-bias-analysis/