Hirundo melaporkan Qwen menghasilkan jawaban yang menyensor, memakai pembingkaian selaras propaganda, atau menunjukkan bias politik dalam 89,8% uji topik sensitifnya.[11] Pengujian Hirundo mencakup 500 prompt dalam 15 topik, termasuk pertanyaan tentang Tiananmen dan Hong Kong; angka tersebut bukan hasil yang telah d...
Diterbitkan olehDiedit dengan GPT-6 LunaGambar dibuat dengan GPT Image 2
Jawaban penelitian

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Qwen, model AI dari Alibaba, merupakan model dengan bobot terbuka yang dapat digunakan dalam berbagai produk dan layanan. CBS News melaporkan bahwa model ini telah diunduh lebih dari 3 miliar kali dan digunakan oleh perusahaan seperti Airbnb dan Uber.10 Karena itu, pertanyaan tentang cara Qwen menjawab bukan sekadar soal akurasi chatbot: jawaban yang menghilangkan fakta atau membingkai isu secara tertentu bisa ikut muncul dalam produk yang memakai model tersebut.
Namun, temuan yang dilaporkan Hirundo dan pemeriksaan CBS perlu dibaca sesuai cakupannya. Keduanya mengangkat kemungkinan bias politik dan penyensoran, tetapi tidak membuktikan semua versi Qwen akan berperilaku sama. Temuan itu juga tidak membuktikan bahwa penggunaan Qwen otomatis memberikan akses atas data perusahaan kepada Alibaba atau pemerintah Tiongkok.10
Hirundo, perusahaan rintisan keamanan siber, mengatakan telah menguji Qwen dengan 500 prompt yang mencakup 15 topik. Menurut CEO Hirundo yang dikutip Newsmax, pada pertanyaan sensitif secara politik Qwen menghasilkan penyensoran, pembingkaian yang selaras dengan propaganda, atau bias politik sebanyak 89,8% dari waktu pengujian.11
Angka 89,8% itu adalah hasil yang dilaporkan Hirundo, bukan tingkat yang telah direplikasi secara independen untuk semua versi Qwen, susunan prompt, maupun cara penerapannya. Angka tersebut juga menggabungkan beberapa jenis respons—menghindari jawaban, memakai pembingkaian tertentu, dan menunjukkan bias—bukan hanya mengukur seberapa sering model menolak menjawab.11
Contoh yang dilaporkan mencakup pertanyaan tentang pembantaian di Lapangan Tiananmen pada 1989 dan demonstrasi Hong Kong pada 2019. Menurut laporan mengenai pengujian itu, Qwen memberikan jawaban yang tidak mengonfirmasi atau mengakui peristiwa tersebut. Liputan CBS juga menyoroti respons Qwen tentang Hong Kong dan topik kontroversial lainnya.11
15
CBS News mengajukan pertanyaan sendiri kepada Qwen dan melaporkan jawaban yang dinilai mengkhawatirkan pada isu sensitif. Pemeriksaan ini memberi contoh tambahan yang sejalan dengan kekhawatiran Hirundo, tetapi cakupannya tetap berupa pemeriksaan terbatas—bukan bukti bahwa setiap versi Qwen atau setiap penerapannya akan menjawab dengan cara yang sama.10
15
Pembedaan ini penting. Model bisa menghindari suatu topik, mengulang pembingkaian yang berpihak, atau memberikan jawaban tidak akurat tanpa secara eksplisit mengatakan, “Saya tidak bisa menjawab.” Jadi, hanya menghitung penolakan langsung bisa melewatkan bentuk penghilangan informasi atau bias lainnya.11
Jika perusahaan memakai model AI untuk fitur yang berhadapan dengan pelanggan atau untuk perangkat internal, respons model dapat memengaruhi informasi yang diterima pengguna. Itu menjadi alasan untuk menguji versi model dan penerapan yang benar-benar akan digunakan—bukan bukti bahwa setiap produk yang memakai Qwen terdampak oleh temuan bias yang dilaporkan.
Model berbobot terbuka dapat dijalankan di infrastruktur milik perusahaan. Pilihan ini bisa memberi organisasi kendali lebih besar atas data sensitif dibandingkan mengirimkannya ke penyedia eksternal, tetapi tidak otomatis menghapus bias yang tertanam dalam respons model. Detail penerapan tetap menentukan.
Risiko keamanan juga perlu dibedakan dari pertanyaan soal bias. Sejumlah komite di Dewan Perwakilan Rakyat AS dilaporkan membuka penyelidikan atas risiko keamanan nasional dan keamanan siber terkait model AI buatan Tiongkok, termasuk penggunaan Qwen yang dilaporkan di Airbnb. Adanya penyelidikan dan kekhawatiran yang menyertainya bukan bukti bahwa Qwen telah menyebabkan kebocoran data.
Hirundo mengatakan telah menemukan cara untuk menghapus bias Qwen dengan mengedit bobot internal model. CBS melaporkan rencana perusahaan itu untuk merilis versi yang mereka sebut “Westernized”.10 Ini merupakan klaim mengenai solusi teknis yang diusulkan, bukan bukti independen bahwa perubahan tersebut bekerja secara konsisten di berbagai topik, versi model, bahasa, dan tugas bisnis.
Bagi organisasi yang mempertimbangkan Qwen, langkah praktisnya adalah menguji versi dan konfigurasi yang spesifik. Coba prompt rutin maupun sensitif, periksa apakah jawaban menghilangkan atau mengubah fakta penting, lalu tinjau aliran data dan kontrol keamanan secara terpisah. Temuan yang dilaporkan layak dicermati, tetapi belum menjawab kedua persoalan itu untuk setiap penggunaan Qwen.
Studio Global AI
Halaman ini berisi jawaban yang didukung sumber yang dapat Anda lanjutkan di dalam Studio Global.
Hirundo melaporkan Qwen menghasilkan jawaban yang menyensor, memakai pembingkaian selaras propaganda, atau menunjukkan bias politik dalam 89,8% uji topik sensitifnya.[11]
Hirundo melaporkan Qwen menghasilkan jawaban yang menyensor, memakai pembingkaian selaras propaganda, atau menunjukkan bias politik dalam 89,8% uji topik sensitifnya.[11] Pengujian Hirundo mencakup 500 prompt dalam 15 topik, termasuk pertanyaan tentang Tiananmen dan Hong Kong; angka tersebut bukan hasil yang telah direplikasi untuk semua versi atau penggunaan Qwen.[11]
Pemeriksaan CBS menambah contoh, tetapi klaim bias dan kekhawatiran keamanan data adalah dua hal berbeda.