De opvallendste uitkomst was een combinatie van Kimi K2.6 en Anthropic’s Claude Fable 5. Die vond 65,2 procent van de echte fouten tegen 3,81 dollar per controle. Een combinatie met uitsluitend Anthropic-modellen — Sonnet 4.6 en Opus 4.8 — kwam uit op 53,6 procent tegen 3,91 dollar per controle .
Het Chinese model was in deze specifieke test dus niet simpelweg de goedkopere optie. De hybride aanpak presteerde volgens DoorDash ook beter.
Op 31 juli 2026 stuurden John Moolenaar, voorzitter van de House Select Committee on China, en Andrew Garbarino, voorzitter van de House Committee on Homeland Security, een brief aan DoorDash-topman Tony Xu . Beide Republikeinse congresleden onderzoeken al langer het gebruik van Chinese AI door Amerikaanse bedrijven.
De brief vraagt DoorDash onder meer om:
De congresleden willen specifiek weten welke Chinese modellen DoorDash ooit heeft gebruikt en hoe het bedrijf de risico’s van die systemen beoordeelt .
Moolenaar en Garbarino waarschuwen dat open-weightmodellen mogelijk verborgen kwetsbaarheden bevatten. In hun brief en persbericht noemen de commissies expliciet ‘back doors’ — achterdeurtjes — en andere kwaadaardige functies die zonder medeweten van gebruikers in een model zouden kunnen worden verwerkt. Soms worden zulke verborgen functies aangeduid als ‘sleeper agents’, oftewel slapende agenten .
Garbarino zei tegen CNBC dat de Chinese Communistische Partij volgens hem niet langer alleen probeert de Verenigde Staten op het gebied van AI bij te benen, maar de achterstand inhaalt bij mogelijkheden die bepalend kunnen worden voor de toekomst van cybersecurity .
Belangrijk is wel het onderscheid tussen een risico en een vastgesteld incident. Er is geen breed openbaar bewijs dat dergelijke achterdeurtjes of slapende agenten daadwerkelijk zijn aangetroffen in Chinese productiemodellen die Amerikaanse bedrijven gebruiken. De zorgen van de congresleden zijn vooral preventief: zij willen weten welke controles bedrijven uitvoeren voordat zij deze modellen in hun systemen opnemen.
De brief erkent bovendien dat Amerikaanse bedrijven Chinese modellen om legitieme technische redenen kunnen evalueren, bijvoorbeeld vanwege hun prijs en prestaties. De vraag is volgens de commissies of daar voldoende beveiligingsmaatregelen tegenover staan .
De zaak rond DoorDash staat niet op zichzelf. In april 2026 begonnen dezelfde twee commissies een onderzoek naar Airbnb en Anysphere, het bedrijf achter de programmeerassistent Cursor, vanwege hun gebruik van Chinese AI-modellen .
Volgens de commissies kunnen zowel grote technologiebedrijven als start-ups Chinese open-weightmodellen overwegen omdat die goedkoper zijn, concurrerende prestaties leveren en bedrijven minder afhankelijk maken van een klein aantal aanbieders van propriëtaire modellen .
Daarmee raakt de kwestie aan een bredere economische realiteit. Amerikaanse bedrijven willen de beste AI voor een zo laag mogelijke prijs. De resultaten van DoorDash’ eigen DashBench-test maakten die prikkel extra duidelijk: de combinatie met Kimi K2.6 vond meer fouten en kostte per controle iets minder dan de configuratie met alleen Anthropic-modellen .
Tegelijkertijd vrezen Amerikaanse beleidsmakers dat kostenbesparingen en technische prestaties te weinig rekening houden met de herkomst van een model, de manier waarop het is ontwikkeld en de mogelijke gevolgen voor gevoelige systemen.
DoorDash heeft begin augustus 2026 geen uitgebreide openbare reactie op de onderzoeksbrief gepubliceerd. Wel zei een woordvoerder tegen CNBC:
“DoorDash proudly supports American AI leadership and is working to ensure AI benefits Main Street, not just the biggest companies. We look forward to engaging with the Committees on how we safely and responsibly use AI, including American-developed frontier models and open-weight models.”
Het bedrijf zegt daarmee de Amerikaanse AI-leiderschapspositie te steunen en AI verantwoord te willen inzetten — zowel Amerikaanse geavanceerde modellen als open-weightmodellen.
Uit Fangs berichten en het gepubliceerde onderzoek komt een pragmatische aanpak naar voren: laat een goedkoper model de routinematige eerste beoordeling uitvoeren en zet een krachtiger model in voor de moeilijkste analyses. DashBench moet DoorDash helpen om op basis van meetbare resultaten te bepalen welke modelcombinatie de beste kwaliteit tegen de laagste kosten levert .
DoorDash wordt niet beschuldigd van het overtreden van een wet. Amerikaanse bedrijven mogen Chinese open-weightmodellen momenteel gewoon gebruiken .
De congrescommissies zeggen dat hun onderzoek een feitelijke basis moet opleveren voor mogelijk toekomstig federaal beleid. In hun brief erkennen zij dat Chinese modellen concurrerende prestaties tegen lagere kosten kunnen bieden. Hun voorgestelde richting is daarom niet alleen strengere waarborgen voor gevoelige toepassingen, maar ook het versterken van Amerikaanse open-weightalternatieven op het gebied van beschikbaarheid, veiligheid en concurrentiekracht .
De twee deadlines maken DoorDash voorlopig tot het meest zichtbare voorbeeld van een groeiende spanning: bedrijven kiezen AI op basis van prijs en prestaties, terwijl Washington steeds nadrukkelijker vraagt waar die modellen vandaan komen en welke risico’s eraan verbonden zijn.