Hirundo称,在其政治敏感问题测试中,Qwen有89.8%的回答出现审查、与宣传口径一致的表述或政治偏见;这是该公司的测试结果,并非适用于所有版本和场景的独立复现结论。[11] Hirundo测试了500条提示词、涵盖15个主题,其中包括有关1989年天安门事件和2019年香港抗议活动的问题。[11] CBS的抽查提供了补充例证,但相关偏见发现与数据安全风险是不同问题;美国众议院委员会展开调查,也不等于已证实发生数据泄露。[10][15][17]
发布者使用 GPT-6 Luna 编辑图片由 GPT Image 2 生成
研究答案

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
阿里巴巴的Qwen是一款开放权重模型,CBS News称它已被用于包括Airbnb和Uber在内的西方企业产品与服务。10 因此,关注它的回答方式,不只是讨论聊天机器人的准确性:模型中的遗漏或叙事倾向,也可能影响基于它开发的功能。不过,Hirundo的测试和CBS的核查提示了潜在的政治偏见,并不能证明所有Qwen版本表现一致,也不能据此认定使用Qwen会让阿里巴巴或中国政府获取企业数据。
10
网络安全初创公司Hirundo称,他们用500条提示词测试Qwen,涉及15个主题。Hirundo首席执行官Ben Luria告诉Newsmax,在政治敏感问题上,Qwen有89.8%的回答出现审查、与宣传口径一致的表述或政治偏见。11
这个比例是Hirundo报告的测试结果,并非对所有Qwen版本、提示词或部署方式都成立的、经独立复现的比率。它还把几种不同表现合并统计——回避回答、采用特定立场的叙事,以及政治偏见——因此不能简单理解为模型有89.8%的概率直接拒绝回答。11
报道提到的测试问题包括1989年天安门事件和2019年香港抗议活动。根据相关报道,Hirundo记录到的回答有时不会确认或承认事件;CBS的报道也重点呈现了Qwen对香港及其他争议议题的回答。11
15
CBS News另行向Qwen提问,并报道了模型在敏感议题上的令人担忧的回答。这些抽查为Hirundo所描述的现象提供了补充例证,但仍只是有限核查,不能证明每个Qwen模型或企业部署都会作出相同回答。10
15
这里有个重要区别:模型可能回避话题、复述倾向性叙事,或给出不准确答案,却没有明确说“我无法回答”。如果只统计模型是否拒答,就可能漏掉其他形式的信息遗漏或偏见。11
CBS报道称,Qwen的下载量已超过30亿次,并被包括Airbnb和Uber在内的企业使用。10 企业若把模型接入面向客户的功能或内部工具,模型的回答就可能影响用户看到的信息。因此,企业应针对自己打算使用的具体版本和部署方式进行测试;但一项政治偏见测试结果,并不能证明所有采用Qwen的产品都会受到同样影响。
政治偏见与数据安全也应分开看。美国众议院委员会已就中国开发的AI模型可能带来的国家安全和网络安全风险展开调查,其中包括Airbnb据报使用Qwen一事。调查及其提出的担忧,不等于已有证据证明Qwen导致了数据泄露。
开放权重模型可以部署在企业自己的基础设施上。与把数据发送给外部服务商相比,这种方式可能让企业对敏感数据拥有更多控制权;但仅仅在本地运行,并不会自动消除模型回答中已有的偏见,具体情况也取决于企业的部署方式。
Hirundo称,他们找到了通过编辑模型内部权重来移除Qwen偏见的方法;CBS报道,该公司计划发布一个名为“西方化”的版本。10 这仍是对技术方案的主张,并非独立证据,不能据此确认修改能否在不同议题、模型版本、语言和企业任务中稳定奏效。
对考虑使用Qwen的企业来说,实际做法是评估准备采用的确切模型和部署方式:既测试敏感议题,也测试日常任务;检查回答是否遗漏或歪曲关键信息,并另行审查数据流向和安全控制。现有报道所述结果值得认真对待,但不足以替所有使用场景作出结论。
Studio Global AI
此页面包含一个有来源支持的答案,您可以在 Studio Global 内继续。
Hirundo称,在其政治敏感问题测试中,Qwen有89.8%的回答出现审查、与宣传口径一致的表述或政治偏见;这是该公司的测试结果,并非适用于所有版本和场景的独立复现结论。[11]
Hirundo称,在其政治敏感问题测试中,Qwen有89.8%的回答出现审查、与宣传口径一致的表述或政治偏见;这是该公司的测试结果,并非适用于所有版本和场景的独立复现结论。[11] Hirundo测试了500条提示词、涵盖15个主题,其中包括有关1989年天安门事件和2019年香港抗议活动的问题。[11]
CBS的抽查提供了补充例证,但相关偏见发现与数据安全风险是不同问题;美国众议院委员会展开调查,也不等于已证实发生数据泄露。[10][15][17]