Hirundo รายงานว่า Qwen ให้คำตอบที่มีลักษณะเซ็นเซอร์ กรอบความคิดสอดคล้องกับโฆษณาชวนเชื่อ หรือมีอคติทางการเมือง ใน 89.8% ของการทดสอบคำถามอ่อนไหว การทดสอบของ Hirundo ใช้พรอมป์ต์ 500 ข้อ ครอบคลุม 15 หัวข้อ รวมคำถามเกี่ยวกับเทียนอันเหมินและฮ่องกง ผลที่รายงานควรนำไปตรวจสอบต่อ แต่ไม่ได้พิสูจน์ว่า Qwen ทุกเวอร์ชันมีพฤติกรรม...
เผยแพร่โดยแก้ไขด้วย GPT-6 Lunaรูปภาพสร้างด้วย GPT Image 2
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Qwen ของ Alibaba เป็นโมเดล AI แบบเปิดน้ำหนัก (open-weight) ที่ถูกนำไปใช้ในผลิตภัณฑ์และบริการต่าง ๆ รวมถึงบริษัทตะวันตกอย่าง Airbnb และ Uber ตามรายงานของ CBS News10 เมื่อโมเดลถูกนำไปประกอบเป็นเครื่องมือที่ผู้ใช้หรือพนักงานต้องพึ่งพา วิธีที่มันเลือกตอบ—หรือเลือกไม่กล่าวถึงบางเรื่อง—จึงอาจส่งผลต่อข้อมูลที่คนได้รับ
ผลทดสอบของ Hirundo และการทดลองถามคำถามของ CBS ชี้ถึงความเป็นไปได้ที่ Qwen จะมีอคติทางการเมืองหรือหลีกเลี่ยงบางประเด็น แต่ยังไม่ได้พิสูจน์ว่า Qwen ทุกเวอร์ชันตอบแบบเดียวกัน หรือการนำโมเดลไปใช้ทำให้ข้อมูลของบริษัทถูกส่งไปยัง Alibaba หรือรัฐบาลจีน10
Hirundo สตาร์ตอัปด้านความมั่นคงไซเบอร์จากอิสราเอล ระบุว่าได้ทดสอบ Qwen ด้วยพรอมป์ต์ 500 ข้อ ครอบคลุม 15 หัวข้อ บริษัทรายงานว่า เมื่อถามเรื่องการเมืองที่อ่อนไหว โมเดลแสดงการเซ็นเซอร์ ใช้กรอบคำตอบที่สอดคล้องกับโฆษณาชวนเชื่อ หรือมีอคติทางการเมือง คิดเป็น 89.8% ของการทดสอบ ตามคำกล่าวของผู้บริหาร Hirundo ที่ Newsmax อ้างถึง11
ตัวเลขนี้เป็นผลที่ Hirundo รายงาน ไม่ใช่อัตราที่มีการทำซ้ำอย่างเป็นอิสระกับ Qwen ทุกเวอร์ชัน พรอมป์ต์ทุกแบบ หรือทุกระบบที่นำโมเดลไปใช้งาน อีกทั้งตัวเลขยังรวมพฤติกรรมหลายประเภท ทั้งการเลี่ยงตอบ การวางกรอบคำตอบไปในทิศทางหนึ่ง และอคติ ไม่ได้วัดเฉพาะการปฏิเสธตอบเท่านั้น11
ตัวอย่างที่มีการรายงานรวมถึงคำถามเกี่ยวกับเหตุการณ์ที่จัตุรัสเทียนอันเหมินในปี 1989 และการประท้วงในฮ่องกงปี 2019 ผลของ Hirundo ตามที่สื่อรายงานระบุว่ามีคำตอบที่ไม่ยืนยันหรือไม่กล่าวถึงเหตุการณ์เหล่านั้น ส่วน CBS ก็ยกคำตอบของ Qwen เกี่ยวกับฮ่องกงและหัวข้อถกเถียงอื่น ๆ มานำเสนอ11
15
CBS News ทดลองถาม Qwen ด้วยตนเองและรายงานว่าได้คำตอบที่น่ากังวลในประเด็นอ่อนไหว การตรวจสอบนี้เป็นอีกตัวอย่างหนึ่งที่สอดคล้องกับข้อกังวลของ Hirundo แต่เป็นเพียงการทดลองกับคำถามบางส่วน ไม่ใช่หลักฐานว่า Qwen ทุกโมเดลหรือทุกการใช้งานในธุรกิจจะตอบเหมือนกัน10
15
การแยกประเภทคำตอบให้ชัดมีความสำคัญ โมเดลอาจหลีกเลี่ยงประเด็น เลือกใช้กรอบความคิดทางการเมืองบางแบบ หรือให้ข้อมูลคลาดเคลื่อน โดยไม่พูดตรง ๆ ว่า “ฉันตอบไม่ได้” หากประเมินเพียงว่ามีการปฏิเสธอย่างชัดแจ้งหรือไม่ ก็อาจมองไม่เห็นการละเว้นหรืออคติรูปแบบอื่น11
CBS รายงานว่า Qwen มียอดดาวน์โหลดมากกว่า 3 พันล้านครั้ง และมีบริษัทอย่าง Airbnb กับ Uber นำไปใช้10 หากธุรกิจเชื่อมโมเดลเข้ากับบริการลูกค้าหรือเครื่องมือภายใน คำตอบของโมเดลก็อาจส่งผลต่อสิ่งที่ผู้ใช้เห็น นี่เป็นเหตุผลให้ทดสอบโมเดลเวอร์ชันและรูปแบบการติดตั้งที่จะใช้งานจริง ไม่ใช่หลักฐานว่าข้อกล่าวหาเรื่องอคติทางการเมืองส่งผลต่อทุกผลิตภัณฑ์ที่ใช้ Qwen
ข้อกังวลเรื่องอคติทางการเมืองควรแยกจากข้อกังวลด้านความปลอดภัยของข้อมูล คณะกรรมาธิการสองชุดของสภาผู้แทนราษฎรสหรัฐฯ เปิดการสอบสวนความเสี่ยงด้านความมั่นคงแห่งชาติและความมั่นคงไซเบอร์ที่เกี่ยวข้องกับโมเดล AI ที่พัฒนาในจีน รวมถึงกรณีที่มีรายงานว่า Airbnb ใช้ Qwen การเปิดสอบสวนและข้อกังวลที่ตามมาไม่ได้แปลว่ามีหลักฐานว่า Qwen ทำให้ข้อมูลรั่วไหลแล้ว
โมเดลแบบเปิดน้ำหนักสามารถติดตั้งและใช้งานบนโครงสร้างพื้นฐานของบริษัทเองได้ ซึ่งอาจช่วยให้บริษัทควบคุมข้อมูลอ่อนไหวได้มากกว่าการส่งข้อมูลไปยังผู้ให้บริการภายนอก แต่การติดตั้งในลักษณะนี้ไม่ได้ลบอคติที่อาจฝังอยู่ในคำตอบของโมเดลโดยอัตโนมัติ และรายละเอียดการติดตั้งของแต่ละบริษัทก็มีความสำคัญ
Hirundo ระบุว่าพบวิธีแก้อคติของ Qwen ด้วยการปรับน้ำหนักภายในโมเดล และ CBS รายงานแผนของบริษัทที่จะเผยแพร่ Qwen เวอร์ชันที่เรียกว่า “Westernized”10 ขณะนี้ข้อเสนอนี้ยังเป็นคำกล่าวอ้างเกี่ยวกับแนวทางแก้ทางเทคนิค ไม่ใช่หลักฐานอิสระว่าการปรับดังกล่าวได้ผลสม่ำเสมอในทุกหัวข้อ ทุกเวอร์ชัน ทุกภาษา หรือทุกงานทางธุรกิจ
สำหรับองค์กรที่กำลังพิจารณาใช้ Qwen ประเด็นสำคัญคือควรประเมินโมเดลและรูปแบบการติดตั้งที่จะใช้จริง ทดสอบทั้งคำถามอ่อนไหวและคำถามทั่วไป ตรวจว่าคำตอบละเว้นหรือบิดเบือนข้อเท็จจริงสำคัญหรือไม่ และประเมินเส้นทางการไหลของข้อมูลกับมาตรการรักษาความปลอดภัยแยกต่างหาก ผลที่มีการรายงานควรได้รับการตรวจสอบอย่างจริงจัง แต่ยังไม่ใช่คำตอบเด็ดขาดสำหรับการใช้งาน Qwen ทุกกรณี
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
Hirundo รายงานว่า Qwen ให้คำตอบที่มีลักษณะเซ็นเซอร์ กรอบความคิดสอดคล้องกับโฆษณาชวนเชื่อ หรือมีอคติทางการเมือง ใน 89.8% ของการทดสอบคำถามอ่อนไหว
Hirundo รายงานว่า Qwen ให้คำตอบที่มีลักษณะเซ็นเซอร์ กรอบความคิดสอดคล้องกับโฆษณาชวนเชื่อ หรือมีอคติทางการเมือง ใน 89.8% ของการทดสอบคำถามอ่อนไหว การทดสอบของ Hirundo ใช้พรอมป์ต์ 500 ข้อ ครอบคลุม 15 หัวข้อ รวมคำถามเกี่ยวกับเทียนอันเหมินและฮ่องกง
ผลที่รายงานควรนำไปตรวจสอบต่อ แต่ไม่ได้พิสูจน์ว่า Qwen ทุกเวอร์ชันมีพฤติกรรมแบบเดียวกัน หรือมีข้อมูลรั่วไหลไปยัง Alibaba หรือรัฐบาลจีน