Tulokset olivat huomionarvoiset: Kimi K2.6:n ja Anthropic Fable 5:n yhdistelmä löysi 65,2 prosenttia todellisista virheistä ja maksoi 3,81 dollaria tarkistusta kohden. Kaikissa vaiheissa yhdysvaltalaisia malleja käyttävä Sonnet 4.6:n ja Opus 4.8:n yhdistelmä löysi 53,6 prosenttia virheistä ja maksoi 3,91 dollaria tarkistusta kohden .
Toisin sanoen kiinalainen malli ei ollut DoorDashin testissä ainoastaan halvempi, vaan juuri koodintarkistuksen tehtävässä myös tehokkaampi.
Edustajainhuoneen Kiina-asioiden erityiskomitean puheenjohtaja John Moolenaar, republikaani Michiganista, ja edustajainhuoneen sisäisen turvallisuuden komitean puheenjohtaja Andrew Garbarino, republikaani New Yorkista, lähettivät 31. heinäkuuta virallisen kirjeen DoorDashin perustajalle ja toimitusjohtajalle Tony Xulle .
Lainsäätäjät vaativat seuraavaa:
Valiokunnat haluavat siis DoorDashilta kattavan luettelon kaikista sen käyttämistä kiinalaisista tekoälymalleista sekä kuvauksen siitä, miten malleja testataan ja niiden riskejä hallitaan .
Avoimien painojen malli tarkoittaa käytännössä sitä, että mallin keskeiset parametrit voidaan ladata, mukauttaa ja ottaa uudelleen käyttöön. Tämä voi alentaa kustannuksia ja antaa yrityksille enemmän joustavuutta, mutta samalla mallin alkuperään ja turvallisuuteen liittyvät kysymykset korostuvat.
Moolenaar ja Garbarino varoittivat, että malleihin voisi käyttäjien tietämättä sisältyä haavoittuvuuksia, takaovia tai muuta haitallista toimintaa. He käyttivät myös ilmaisua ”nukkuvat agentit” eli haitalliset toiminnot, jotka pysyvät piilossa ja aktivoituvat vasta tietyissä tilanteissa .
Garbarino sanoi CNBC:lle, ettei Kiinan kommunistinen puolue enää vain kuro Yhdysvaltojen etumatkaa kiinni tekoälyssä, vaan pyrkii saavuttamaan Yhdysvallat juuri niissä kyvykkyyksissä, jotka muokkaavat kyberturvallisuuden tulevaisuutta .
Tärkeä rajaus on kuitenkin tämä: lainsäätäjät eivät ole esittäneet laajaa julkista näyttöä siitä, että yhdysvaltalaisten yritysten tuotantokäytössä olevista kiinalaisista tekoälymalleista olisi löydetty tällaisia takaovia tai nukkuvia agentteja. Kyse on ennakoivasta riskinarviosta, ei vahvistetusta tietomurrosta tai DoorDashia koskevasta rikosepäilystä. Valiokuntien kirjeessä myös tunnustetaan, että yrityksillä voi olla ”legitiimejä teknisiä syitä” arvioida kiinalaisia malleja, mutta niiden halutaan osoittavan, että suojatoimet ovat riittävät .
DoorDash ei ole ensimmäinen yhdysvaltalainen yhtiö, joka joutuu tämän keskustelun keskiöön. Huhtikuussa 2026 samat kaksi valiokuntaa käynnistivät yhteisen tutkinnan Airbnb:n ja Cursor-koodausalustan valmistajan Anyspheren tekoälymallien käytöstä .
Valiokuntien mukaan suuret teknologiayhtiöt ja startup-yritykset voivat päätyä arvioimaan tai ottamaan käyttöön Kiinassa kehitettyjä avoimien painojen malleja, koska ne ovat edullisia ja suorituskyvyltään kilpailukykyisiä .
DoorDashin tapaus on erityisen kiinnostava, koska yhtiön oma vertailutesti teki taloudellisen kannustimen näkyväksi. Kimi K2.6:n käyttäminen rutiininomaisemmassa työssä ja yhdysvaltalaisen huippumallin varaaminen vaikeimpiin tehtäviin tuotti paremman tuloksen pienemmällä hinnalla kuin pelkästään yhdysvaltalaisiin malleihin perustunut ratkaisu .
Tutkinnan tarkoituksena on valiokuntien mukaan rakentaa ”tosiasiapohja” mahdolliselle liittovaltion politiikalle, joka koskisi kiinalaisten tekoälymallien käyttöä yhdysvaltalaisissa yrityksissä . Valiokuntien kirjeessä myönnetään, että kiinalaiset avoimien painojen mallit voivat tarjota kilpailukykyistä suorituskykyä edullisemmin. Ratkaisuksi ehdotetaan yhdysvaltalaisten vaihtoehtojen saatavuuden, turvallisuuden ja kilpailukyvyn parantamista sekä kohdennettuja suojatoimia arkaluonteisiin käyttötarkoituksiin .
DoorDash ei ollut elokuun 2026 alussa julkaissut yksityiskohtaista vastausta tutkintakirjeeseen. Yhtiön edustaja sanoi kuitenkin CNBC:lle, että DoorDash tukee vahvasti Yhdysvaltain tekoälyjohtajuutta ja pyrkii varmistamaan, että tekoäly hyödyttää myös tavallista yritystoimintaa eikä vain suurimpia teknologiayhtiöitä. Yhtiö kertoi olevansa valmis keskustelemaan valiokuntien kanssa siitä, miten se käyttää tekoälyä turvallisesti ja vastuullisesti, mukaan lukien yhdysvaltalaiset huippumallit ja avoimien painojen mallit .
DoorDashin julkaistun tutkimuksen ja Fangin kommenttien perusteella yhtiön lähestymistapa on ollut käytännöllinen: Kimi K2.6:ta on käytetty alemman tason sisäisessä koodintarkistuksessa, kun taas Anthropic Fable on varattu vaativimpaan työhön . DashBenchin tarkoitus on selvittää nopeasti, mitkä malliyhdistelmät tarjoavat parhaan tuloksen ja kustannustehokkuuden .
DoorDashia ei syytetä lain rikkomisesta. Yhdysvaltalaiset yritykset voivat tällä hetkellä käyttää kiinalaisia avoimien painojen malleja vapaasti . Silti elokuun 14. ja 21. päivän määräajat nostavat yhtiön keskelle kiistaa, joka voi vaikuttaa siihen, miten yhdysvaltalaiset yritykset arvioivat tekoälymallin alkuperää, turvallisuutta ja hintaa.