Hirundo сообщила, что Qwen выдавал цензурированные, ориентированные на позицию Пекина или политически предвзятые ответы в 89,8% тестов на чувствительные темы. Стартап проверил 500 запросов по 15 темам, в том числе о событиях на площади Тяньаньмэнь в 1989 году и протестах в Гонконге в 2019 м.
ОпубликовалОтредактировано с помощью GPT-6 LunaИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Alibaba Qwen — модель с открытыми весами, которую можно использовать в собственных продуктах и сервисах. По данным CBS News, среди компаний, применяющих Qwen, есть Airbnb и Uber. Поэтому важен не только вопрос точности ответов: уклончивые формулировки и одностороннее изложение могут попасть и в сервисы, построенные на основе модели. Результаты Hirundo и проверки CBS указывают на возможную политическую предвзятость, но не доказывают, что все версии Qwen отвечают одинаково или что использование модели открывает Alibaba либо властям Китая доступ к данным компании.10
Кибербезопасностный стартап Hirundo утверждает, что проверил Qwen с помощью 500 запросов по 15 темам. По словам главы компании, в ответах на политически чувствительные вопросы цензура, близкое к пропаганде изложение или политическая предвзятость встречались в 89,8% случаев.11
Эту цифру следует понимать именно как результат, заявленный Hirundo, а не как независимо воспроизведённый показатель для всех версий Qwen, запросов и вариантов использования. Кроме того, в одну категорию здесь сведены разные типы ответов — уклонение от темы, подача в определённом политическом ключе и предвзятость; это не просто подсчёт прямых отказов.11
Среди упомянутых тем — события на площади Тяньаньмэнь в 1989 году и протесты в Гонконге в 2019-м. В описании тестов Hirundo приводятся ответы, в которых модель не подтверждала или не признавала произошедшее. CBS также обращала внимание на ответы Qwen о Гонконге и других спорных темах.11
15
CBS News отдельно задавала Qwen вопросы на чувствительные темы и сообщила о тревожных ответах. Это ещё один пример поведения, о котором говорила Hirundo, но выборочная проверка не показывает, что любая версия модели или её внедрение в бизнес-сервисе будет отвечать так же.10
15
Важно различать явный отказ и другие формы уклонения. Модель может обойти вопрос, воспроизвести политически заданную трактовку или дать неточный ответ, не произнося «я не могу ответить». Поэтому проверка только на прямые отказы может не выявить умолчания и предвзятость.11
По данным CBS, Qwen скачивали более 3 миллиардов раз; среди компаний, использующих модель, названы Airbnb и Uber.10 Если организация встраивает её в функции для клиентов или внутренние инструменты, ответы модели могут влиять на то, какую информацию получают пользователи. Это веская причина проверять именно ту версию и конфигурацию, которую компания собирается использовать, но не доказательство, что выводы о политической предвзятости относятся ко всем продуктам на базе Qwen.
Вопросы политического уклона и кибербезопасности — разные вопросы. Комитеты Палаты представителей США начали расследование рисков национальной безопасности и кибербезопасности, связанных с моделями ИИ китайской разработки, в том числе с сообщениями об использовании Qwen в Airbnb. Само расследование и высказанные опасения не доказывают, что Qwen привела к утечке данных.
Модели с открытыми весами можно запускать на собственной инфраструктуре компании. Это может дать ей больше контроля над чувствительными данными, чем передача запросов внешнему поставщику. Но такой способ развёртывания сам по себе не устраняет возможную предвзятость ответов; многое зависит от конкретной конфигурации.
Hirundo утверждает, что нашла способ убрать предвзятость Qwen, изменяя внутренние веса модели. CBS сообщила о планах компании выпустить версию, которую там называют «вестернизированной».10 Пока это заявление о предполагаемом техническом решении, а не независимое подтверждение того, что оно надёжно работает на разных темах, версиях модели, языках и рабочих задачах.
Компаниям, рассматривающим Qwen, стоит проверять именно ту модель и конфигурацию, которую они собираются внедрить: тестировать как обычные, так и чувствительные запросы, отмечать пропуски и искажения фактов, а отдельно — анализировать потоки данных и меры защиты. Опубликованные результаты заслуживают внимания, но сами по себе не дают окончательного ответа ни о поведении модели во всех сценариях, ни о безопасности каждого её применения.
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
Hirundo сообщила, что Qwen выдавал цензурированные, ориентированные на позицию Пекина или политически предвзятые ответы в 89,8% тестов на чувствительные темы.
Hirundo сообщила, что Qwen выдавал цензурированные, ориентированные на позицию Пекина или политически предвзятые ответы в 89,8% тестов на чувствительные темы. Стартап проверил 500 запросов по 15 темам, в том числе о событиях на площади Тяньаньмэнь в 1989 году и протестах в Гонконге в 2019 м.
Результаты указывают на повод проверять конкретную версию модели, но не доказывают, что все развёртывания Qwen ведут себя одинаково или передают данные Alibaba.