Hirundo 表示,測試 Qwen 的 500 個提示中,涉及 15 個主題;政治敏感題目的回答有 89.8% 出現審查、偏向特定立場的敘述或政治偏見。[11] 報導列出的例子包括 1989 年天安門事件與 2019 年香港抗爭;CBS News 也自行查問 Qwen,並報導其對香港及其他爭議議題的回答令人憂慮。[11][15] 這些結果值得企業檢視實際使用的模型版本與部署方式,但不能據此推論所有 Qwen 都有相同表現,或認定使用 Qwen 就會把企業資料交給阿里巴巴或中國政府。[10][17][18]
發布者使用 GPT-6 Luna 編輯圖片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
阿里巴巴的 Qwen 是一款開放權重 AI 模型,CBS News 報導指出,Airbnb、Uber 等企業也有使用。當模型被整合進產品或服務,它如何回答、迴避或描述某些議題,就不只是聊天機器人的準確度問題;這些表達方式也可能出現在企業提供給使用者的服務中。10
Hirundo 的測試與 CBS News 的查核都指向 Qwen 在政治敏感議題上的可能偏向,但目前報導並未證明所有 Qwen 版本、提示方式或企業部署都會有相同反應;也不能單憑這些結果推論使用 Qwen 就會讓阿里巴巴或中國政府取得企業資料。10
以色列網路安全新創 Hirundo 表示,研究人員以 500 個提示測試 Qwen,涵蓋 15 個主題。Hirundo 執行長告訴 Newsmax,在政治敏感問題上,Qwen 有 89.8% 的回答出現審查、與特定政治立場一致的敘述,或政治偏見。11
這個數字是 Hirundo 報告的測試結果,不是已由獨立研究重現、適用於所有 Qwen 版本、提示或部署情境的通用比例。而且它將幾種不同的回答表現合併計算:不只包括拒答,也包括迴避問題或以偏向性方式陳述。11
報導提及的例子包括 1989 年天安門事件與 2019 年香港抗爭。Hirundo 的測試結果被描述為,Qwen 對相關事件未能確認或承認其發生;CBS News 的報導也展示了 Qwen 對香港及其他爭議議題的回答。11
15
CBS News 另行向 Qwen 提問,並報導了該模型在敏感議題上的令人憂慮回答。這提供了與 Hirundo 所述現象相符的另一個例子,但仍屬於個別查問,不能證明每個 Qwen 版本或企業部署都會以相同方式回答。10
15
評估時也不能只看模型有沒有明確說「我無法回答」。它可能避開問題、採用偏向某種政治立場的說法,或給出不準確答案;只統計明確拒答,可能會漏掉其他形式的省略或偏差。11
CBS News 報導,Qwen 的下載量已超過 30 億次,使用者包括 Airbnb 與 Uber 等企業。10 若企業把模型整合到面向客戶的功能或內部工具,模型的回答就可能影響使用者看到的內容。因此,企業應測試自己實際採用的模型版本與部署方式,而不是直接把一項測試結果套用到所有使用 Qwen 的產品上。
政治偏向與資料安全是兩個需要分開檢視的問題。美國眾議院相關委員會已就中國開發 AI 模型涉及的國家安全與網路安全風險展開調查,範圍包括報導所指 Airbnb 使用 Qwen 一事。調查及其提出的疑慮,並不等於已有證據證明 Qwen 導致資料外洩。
開放權重模型可以在企業自己的基礎設施上執行;相較於把資料送往外部服務商,這種做法可能讓企業更能掌握敏感資料。不過,本地部署本身不會消除模型回答中可能存在的偏向,實際資料流向也取決於各企業的部署細節。
Hirundo 表示,已找到透過修改 Qwen 內部權重來移除偏見的方法;CBS News 報導,該公司計畫推出所謂的「西方化」版本。10 目前這是該公司對技術方案的說法,並非獨立證據,無法據此確認修改能否在不同主題、模型版本、語言及企業任務中穩定奏效。
對考慮採用 Qwen 的企業來說,較務實的做法是檢驗實際要使用的模型與部署環境:測試敏感與一般問題,確認回答是否遺漏或扭曲重要事實,並另外盤點資料流向及安全控制。現有報導提供了值得重視的警訊,但尚不足以替每一種使用情境下的偏向或安全問題下定論。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Hirundo 表示,測試 Qwen 的 500 個提示中,涉及 15 個主題;政治敏感題目的回答有 89.8% 出現審查、偏向特定立場的敘述或政治偏見。[11]
Hirundo 表示,測試 Qwen 的 500 個提示中,涉及 15 個主題;政治敏感題目的回答有 89.8% 出現審查、偏向特定立場的敘述或政治偏見。[11] 報導列出的例子包括 1989 年天安門事件與 2019 年香港抗爭;CBS News 也自行查問 Qwen,並報導其對香港及其他爭議議題的回答令人憂慮。[11][15]
這些結果值得企業檢視實際使用的模型版本與部署方式,但不能據此推論所有 Qwen 都有相同表現,或認定使用 Qwen 就會把企業資料交給阿里巴巴或中國政府。[10][17][18]