A publicação veio depois de a equipe de pesquisa em IA da DoorDash apresentar o DashBench, um benchmark interno que reproduz 105 alterações reais feitas anteriormente no código da empresa. O objetivo é medir quantos problemas de fato cada configuração de IA consegue detectar .
O resultado que mais chamou atenção foi a combinação do Kimi K2.6 com o Claude Fable 5. Ela identificou 65,2% dos bugs reais, a um custo de US$ 3,81 por revisão. Já a combinação exclusivamente baseada em modelos da Anthropic — Sonnet 4.6 e Opus 4.8 — detectou 53,6%, ao custo de US$ 3,91 por revisão .
Em outras palavras, no teste da DoorDash, a opção mais eficiente não foi a configuração formada apenas pelos modelos considerados premium. O modelo chinês assumiu a triagem inicial, enquanto o modelo americano ficou concentrado na análise mais complexa.
Em 31 de julho de 2026, John Moolenaar, republicano de Michigan e presidente do Comitê Seleto da Câmara sobre a China, e Andrew Garbarino, republicano de Nova York e presidente do Comitê de Segurança Interna, enviaram uma carta ao cofundador e CEO da DoorDash, Tony Xu .
Os parlamentares deram dois prazos principais à empresa:
A carta solicita que a DoorDash identifique cada modelo chinês utilizado e explique como toma decisões sobre testes, implantação e mitigação de riscos .
Os dois comitês afirmam que modelos de pesos abertos podem oferecer vantagens de custo e flexibilidade, mas também levantam preocupações relacionadas à segurança nacional, à cibersegurança e à segurança econômica dos Estados Unidos.
Entre os riscos citados está a possibilidade de que vulnerabilidades ocultas ou funções maliciosas — descritas pelos parlamentares como “backdoors” ou “agentes adormecidos” — sejam inseridas nos modelos sem o conhecimento dos usuários .
Garbarino disse à CNBC que o Partido Comunista Chinês não estaria mais apenas tentando alcançar os Estados Unidos em inteligência artificial, mas avançando em capacidades que podem moldar o futuro da cibersegurança .
Há, porém, uma distinção importante: os parlamentares não apresentaram a investigação como prova de que a DoorDash foi comprometida, nem afirmaram que esses mecanismos foram encontrados de forma disseminada em modelos chineses usados por empresas americanas. A preocupação é preventiva e se concentra no risco potencial. A própria carta reconhece que empresas dos EUA podem avaliar modelos chineses por razões técnicas legítimas, mas questiona se os controles de segurança são suficientes .
A DoorDash é o exemplo mais recente — e talvez o mais próximo do consumidor comum — de uma tendência que já vinha sendo acompanhada pelo Congresso americano.
Em abril de 2026, os mesmos dois comitês abriram uma investigação conjunta sobre a Airbnb e a Anysphere, empresa responsável pela plataforma de programação Cursor, por causa da adoção de modelos desenvolvidos na China .
Segundo os parlamentares, empresas americanas, de grandes companhias de tecnologia a startups, podem estar avaliando ou implantando modelos chineses de pesos abertos porque eles oferecem custos menores e desempenho competitivo . Esses modelos também podem ser baixados, modificados e executados novamente, o que dá às empresas mais flexibilidade e reduz a dependência de um grupo limitado de fornecedores proprietários.
O caso da DoorDash evidencia com clareza o incentivo econômico. No benchmark da própria empresa, a combinação com o Kimi K2.6 não apenas custou menos: ela detectou uma parcela maior dos bugs reais do que a configuração formada exclusivamente por modelos da Anthropic .
Até o início de agosto de 2026, a DoorDash não havia divulgado uma resposta pública detalhada à carta dos comitês. Um porta-voz, no entanto, disse à CNBC que a empresa apoia a liderança americana em IA e trabalha para que a tecnologia beneficie a economia real, e não apenas as maiores companhias .
A empresa também afirmou que pretende conversar com os comitês sobre o uso seguro e responsável de IA, incluindo modelos de fronteira e modelos de pesos abertos desenvolvidos nos Estados Unidos .
As publicações de Fang e o material de pesquisa da DoorDash indicam uma abordagem pragmática: usar o Kimi K2.6 para tarefas internas de revisão de código de menor complexidade e manter o Fable para os trabalhos mais difíceis . A empresa afirma que o DashBench permite comparar rapidamente quais combinações oferecem os melhores resultados pelo menor custo .
A investigação pretende criar uma base factual para possíveis políticas federais sobre o uso de modelos chineses por empresas americanas . A carta dos parlamentares reconhece que esses sistemas oferecem capacidade competitiva a um custo menor, mas defende que os Estados Unidos ampliem a disponibilidade, a segurança e a competitividade de alternativas americanas de pesos abertos, além de aplicar salvaguardas específicas em usos sensíveis .
A DoorDash não é acusada de violar nenhuma lei. Empresas americanas podem operar modelos chineses de pesos abertos, e o uso do Kimi K2.6 em revisões internas de código não constitui, por si só, uma infração .
Mas a empresa agora terá de explicar, dentro dos prazos de 14 e 21 de agosto, quais modelos usou, como avaliou seus riscos e quais limites aplicou. O episódio mostra como a disputa entre custo, desempenho e segurança nacional está deixando de ser uma questão restrita aos laboratórios de IA — e passando a fazer parte das decisões cotidianas de empresas de tecnologia de todos os setores.