Il risultato più interessante è stato quello di un sistema ibrido: Kimi K2.6 per l’analisi preliminare e Claude Fable 5 di Anthropic per l’esame più complesso. La combinazione ha rilevato il 65,2% dei bug reali, con un costo di 3,81 dollari per revisione. Una configurazione basata soltanto su modelli americani, Anthropic Sonnet 4.6 + Opus 4.8, si è fermata al 53,6%, costando 3,91 dollari per revisione.
In altre parole, nel test di DoorDash la soluzione vincente non era quella interamente “premium”: il modello cinese risultava utile per i compiti più ordinari e contribuiva a ridurre il costo complessivo.
Il 31 luglio 2026 John Moolenaar, presidente della House Select Committee on China, e Andrew Garbarino, presidente della House Homeland Security Committee, hanno inviato una lettera a Tony Xu, cofondatore e amministratore delegato di DoorDash.
I legislatori hanno chiesto:
La richiesta punta quindi a ricostruire non solo l’uso di Kimi K2.6, ma l’intero processo decisionale di DoorDash: quali modelli cinesi sono stati presi in considerazione, dove sono stati impiegati, quali dati potevano raggiungere e quali controlli sono stati effettuati.
Nella lettera e nei comunicati ufficiali, le commissioni hanno sostenuto che i modelli open-weight cinesi potrebbero contenere vulnerabilità nascoste. In particolare, hanno evocato la possibilità che vi siano backdoor o altre funzionalità malevole — talvolta definite “sleeper agent”, cioè agenti dormienti — inserite senza che gli utenti ne siano consapevoli.
Garbarino ha dichiarato alla CNBC: “Il Partito comunista cinese non si limita più a tallonarci nel campo dell’intelligenza artificiale; sta correndo per colmare il divario in alcune delle capacità che definiranno il futuro della cybersicurezza”.
È però importante distinguere tra rischio ipotizzato e compromissione accertata. I legislatori hanno riconosciuto che non esistono prove pubbliche diffuse della scoperta di backdoor o sleeper agent nei modelli cinesi impiegati in produzione dalle aziende statunitensi. La preoccupazione è quindi preventiva: l’indagine vuole capire se i controlli siano sufficienti, non dimostrare che DoorDash abbia subito un attacco o abbia utilizzato un modello compromesso.
La stessa lettera ammette che le aziende americane possono valutare modelli sviluppati nella Repubblica Popolare Cinese per “legittime ragioni tecniche”, ma sostiene che il vantaggio economico non possa sostituire le misure di sicurezza nelle applicazioni sensibili.
Il caso non è isolato. Nell’aprile 2026 le stesse due commissioni avevano avviato un’indagine congiunta su Airbnb e Anysphere, la società che sviluppa la piattaforma di programmazione Cursor, per il loro ricorso a modelli di IA sviluppati in Cina.
Secondo i legislatori, aziende americane grandi e piccole possono essere incentivate a valutare modelli cinesi open-weight perché offrono costi inferiori, prestazioni competitive, maggiore flessibilità e la possibilità di ridurre la dipendenza da un numero limitato di fornitori proprietari.
Gli open-weight model sono modelli i cui pesi possono essere messi a disposizione per essere scaricati, modificati e ridistribuiti. Questa caratteristica può diminuire i costi e facilitare la personalizzazione, ma rende anche più complesso per un’azienda controllare l’intera catena tecnologica e valutare eventuali rischi introdotti durante l’uso o la modifica del modello.
La vicenda DoorDash è particolarmente significativa perché l’incentivo non è rimasto teorico: il benchmark dell’azienda ha indicato che Kimi K2.6, usato per una parte del flusso di revisione, offriva sia un costo più basso sia una percentuale maggiore di bug rilevati rispetto alla configurazione americana testata.
All’inizio di agosto 2026 DoorDash non aveva ancora diffuso una risposta pubblica dettagliata alla lettera delle commissioni. Un portavoce ha però dichiarato alla CNBC: “DoorDash sostiene con orgoglio la leadership americana nell’IA e lavora per fare in modo che l’IA porti benefici alla Main Street, non soltanto alle aziende più grandi. Non vediamo l’ora di confrontarci con le commissioni su come utilizziamo l’IA in modo sicuro e responsabile, compresi i modelli frontier sviluppati negli Stati Uniti e i modelli open-weight”.
Dai materiali di ricerca pubblicati e dal post di Fang emerge un approccio pragmatico: Kimi K2.6 sarebbe stato destinato alle attività interne di revisione del codice di livello inferiore, mentre il modello frontier di Anthropic sarebbe stato riservato ai compiti più complessi.
DoorDash sostiene inoltre che DashBench le consenta di confrontare rapidamente combinazioni diverse e di individuare quelle con il miglior rapporto tra risultati e costo. L’azienda non è accusata di aver violato una legge: al momento, le società statunitensi possono utilizzare modelli open-weight cinesi.
Le commissioni dicono di voler costruire una base fattuale per eventuali future politiche federali sull’uso dei modelli di IA cinesi da parte delle aziende americane. La loro lettera riconosce che questi sistemi possono offrire prestazioni competitive a costi inferiori, ma propone di rafforzare la disponibilità, la sicurezza e la competitività delle alternative open-weight americane, introducendo garanzie mirate per gli impieghi più sensibili.
Per DoorDash, tutto è partito da un tweet tecnico su come risparmiare e migliorare la revisione del codice. Per Washington, quel tweet è diventato un esempio concreto del dilemma che si trova davanti l’industria americana: scegliere il modello più efficace e conveniente oppure considerare anche il Paese in cui quel modello è stato sviluppato, soprattutto quando entra in contatto con software, dati aziendali o sistemi potenzialmente sensibili.