Hirundo riferisce che, nei suoi test su domande politicamente sensibili, Qwen ha prodotto risposte censurate, orientate o politicamente distorte nell’89,8% dei casi. La startup ha testato 500 prompt su 15 temi, comprese domande su Piazza Tienanmen e sulle proteste di Hong Kong.
Pubblicato daModificato con GPT-6 LunaImmagini generate con GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Hirundo’s testing and CBS News’ independent checks find about political bias and censorship in Alibaba’s Qwen model—including their. Article summary: Hirundo’s tests and CBS News’ independent checks found that Alibaba’s Qwen could give China-favorable answers or avoid politically sensitive facts, rather than simply refusing every question. The concern is that these te. Topic tags: general, academic, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, wate
Qwen, il modello di intelligenza artificiale di Alibaba, è un modello open-weight: i suoi pesi possono essere scaricati e utilizzati per sviluppare prodotti e servizi. Secondo CBS News, il modello è stato usato anche da aziende occidentali come Airbnb e Uber. Per questo, le domande sulle sue risposte non riguardano soltanto l’accuratezza di un chatbot: omissioni e modalità di presentare i fatti possono riflettersi nei prodotti costruiti attorno al modello. I test di Hirundo e le verifiche di CBS segnalano possibili bias politici, ma non dimostrano che tutte le versioni di Qwen si comportino allo stesso modo o che il suo utilizzo esponga i dati aziendali ad Alibaba o al governo cinese.10
Hirundo, una startup che si occupa di cybersicurezza, afferma di aver sottoposto Qwen a 500 prompt su 15 temi. Secondo il CEO dell’azienda, citato da Newsmax, nelle risposte a domande politicamente sensibili il modello ha mostrato censura, una narrazione allineata alla propaganda o bias politico nell’89,8% dei casi.11
È una percentuale riferita da Hirundo, non un risultato riprodotto in modo indipendente su tutte le versioni di Qwen, su ogni tipo di prompt o in ogni ambiente di utilizzo. Inoltre, la cifra raggruppa comportamenti diversi — tra cui evitare una risposta, presentare una narrazione orientata e mostrare un bias — e non misura soltanto i rifiuti espliciti.11
Tra gli esempi citati figurano domande sulla repressione di Piazza Tienanmen del 1989 e sulle proteste di Hong Kong del 2019. Secondo quanto riportato, nei test di Hirundo Qwen ha dato risposte che non confermavano o non riconoscevano gli eventi; anche il servizio di CBS ha messo in evidenza le risposte del modello su Hong Kong e altri temi controversi.11
15
CBS News ha interrogato Qwen separatamente e ha riferito di aver ottenuto risposte preoccupanti su argomenti sensibili. Queste verifiche offrono ulteriori esempi dei comportamenti descritti da Hirundo, ma restano controlli circoscritti: non dimostrano che ogni versione del modello o ogni sua implementazione risponda nello stesso modo.10
15
La distinzione è importante. Un modello può eludere una domanda, riproporre una narrazione orientata o fornire informazioni imprecise senza dire esplicitamente «non posso rispondere». Valutare soltanto i rifiuti dichiarati rischia quindi di non rilevare altre forme di omissione o bias.11
CBS ha riferito che Qwen era stato scaricato oltre 3 miliardi di volte e veniva usato da aziende come Airbnb e Uber.10 Quando un’impresa integra un modello in strumenti interni o funzioni rivolte ai clienti, le sue risposte possono influenzare ciò che gli utenti vedono. È un motivo per testare la versione specifica e l’ambiente di utilizzo previsti, non la prova che i risultati sui bias politici riguardino ogni prodotto che impiega Qwen.
Le questioni relative ai bias politici vanno inoltre tenute distinte da quelle sulla sicurezza. Due commissioni della Camera dei rappresentanti degli Stati Uniti hanno avviato un’indagine sui rischi per la sicurezza nazionale e informatica legati ai modelli di IA sviluppati in Cina, compreso il presunto utilizzo di Qwen da parte di Airbnb. L’esistenza di un’indagine e delle preoccupazioni sollevate non dimostra che Qwen abbia causato una violazione dei dati.
I modelli open-weight possono essere eseguiti sull’infrastruttura informatica dell’azienda, offrendo potenzialmente più controllo sui dati sensibili rispetto all’invio di informazioni a un fornitore esterno. Questa scelta, da sola, non elimina eventuali bias nelle risposte del modello; contano anche i dettagli della configurazione adottata.
Hirundo sostiene di aver trovato un modo per rimuovere i bias di Qwen intervenendo sui pesi interni del modello. CBS ha riferito che la startup intende pubblicare una versione definita «occidentalizzata».10 Si tratta di una soluzione tecnica annunciata dall’azienda: le informazioni disponibili non bastano a dimostrare in modo indipendente che funzioni con affidabilità su temi, versioni del modello, lingue e attività aziendali differenti.
Per le organizzazioni interessate a Qwen, il passo pratico è valutare il modello e la configurazione che intendono usare. Conviene testare prompt sia sensibili sia ordinari, verificare se le risposte omettono o distorcono fatti rilevanti e, separatamente, controllare i flussi dei dati e le misure di sicurezza. I risultati riportati meritano attenzione, ma non risolvono nessuna delle due questioni per ogni possibile utilizzo del modello.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Hirundo riferisce che, nei suoi test su domande politicamente sensibili, Qwen ha prodotto risposte censurate, orientate o politicamente distorte nell’89,8% dei casi.
Hirundo riferisce che, nei suoi test su domande politicamente sensibili, Qwen ha prodotto risposte censurate, orientate o politicamente distorte nell’89,8% dei casi. La startup ha testato 500 prompt su 15 temi, comprese domande su Piazza Tienanmen e sulle proteste di Hong Kong.
Le verifiche di CBS aggiungono esempi, ma non provano che tutte le versioni o gli impieghi di Qwen diano le stesse risposte, né che il modello trasferisca dati alle autorità cinesi.