A abordagem da DeepSeek para a independência de chips não é um movimento único, mas uma estratégia em fases que opera em três prazos distintos.
Longo prazo: Um chip de inferência proprietário. O elemento mais ambicioso é o desenvolvimento de um chip personalizado da DeepSeek, projetado do zero para tarefas de inferência R. A empresa está trabalhando com parceiros externos de design de chips e vem expandindo sua equipe interna de design, embora o projeto ainda esteja em estágio inicial de planejamento e desenvolvimento RT. Um chip próprio bem-sucedido daria à DeepSeek autonomia estratégica, isolando-a de interrupções na cadeia de suprimentos e dos caprichos de qualquer fornecedor de hardware R.
Médio prazo: A migração para a Ascend da Huawei. No curto e médio prazo, a DeepSeek já moveu cargas de trabalho significativas de inferência para a série de chips Ascend 950 da Huawei. O modelo V4 da empresa, um modelo de mistura de especialistas (MoE) com trilhões de parâmetros, foi especificamente otimizado para rodar inteiramente no hardware Ascend 950PR da Huawei RS. A DeepSeek concedeu acesso antecipado ao seu modelo V4 a fornecedores domésticos como a Huawei, enquanto o reteve notavelmente de fabricantes de chips dos EUA, incluindo Nvidia e AMD, uma ruptura significativa com as normas da indústria RFE. Esse movimento demonstrou que a DeepSeek poderia implantar IA de produção em escala sem depender de hardware dos EUA ES.
Curto prazo: Eficiência algorítmica. Os modelos da DeepSeek sempre enfatizaram a eficiência algorítmica e arquitetônica, reduzindo o poder computacional bruto necessário para treinamento e inferência IR. Técnicas como mistura de especialistas (MoE), ativação seletiva e aprendizado por transferência permitem que a DeepSeek entregue desempenho de ponta em chips menos capazes, tornando a transição para hardware doméstico mais viável II. Esse foco na eficiência de inferência é uma das principais razões pelas quais a lacuna entre os processadores de IA fabricados na China e os chips dos EUA, mais robustos, diminuiu R.
A força motriz por trás do avanço da DeepSeek em hardware é o efeito cumulativo dos controles de exportação dos EUA, que progressivamente cortaram o acesso da China aos chips de IA mais avançados do mundo. Washington proibiu a exportação de chips tão capazes quanto o A100 da Nvidia desde outubro de 2022, e as restrições foram apertadas desde então para incluir a série Blackwell e requisitos de licenciamento específicos para o H20 CBR. Um alto funcionário do governo Trump chegou a alegar que a DeepSeek treinou seu modelo mais recente nos chips Blackwell mais avançados da Nvidia, violando as regulamentações de exportação dos EUA R.
A DeepSeek demonstrou que pode alcançar desempenho de IA de ponta apesar dessas restrições, através de pura engenhosidade de engenharia IC. No entanto, a dependência de um único fornecedor dominante — mesmo um doméstico como a Huawei — continua sendo um risco estratégico. Os esforços anteriores da DeepSeek para treinar modelos em hardware Ascend da Huawei foram, segundo relatos, recebidos com falhas e atrasos persistentes, forçando a empresa a voltar a usar chips da Nvidia para treinamento, usando os da Huawei apenas para inferência TA. Esse histórico conturbado ressalta por que a DeepSeek quer eventualmente controlar seu próprio destino.
As ambições de chip da DeepSeek são sustentadas por sua primeira rodada de captação de recursos externa, concluída em junho de 2026. A empresa levantou mais de 50 bilhões de yuans, aproximadamente US$ 7,4 bilhões, com uma avaliação superior a US$ 50 bilhões, tornando-se a startup de IA mais valiosa da China RFT. A rodada foi liderada pelo fundador Liang Wenfeng, que contribuiu pessoalmente com 20 bilhões de yuans (cerca de US$ 2,9 bilhões), enquanto os investidores âncora incluíram a gigante de tecnologia Tencent (10 bilhões de yuans) e a fabricante de baterias CATL (5 bilhões de yuans) VR. Outros participantes incluíram JD.com, NetEase e IDG Capital YT.
A estrutura do negócio foi incomum: os investidores colocaram seus fundos em uma sociedade de propósito específico (limited partnership) administrada por Liang, sem direitos de voto direto na DeepSeek e sujeitos a um período de carência de cinco anos RT. Essa estrutura permite que Liang mantenha o controle estratégico mesmo enquanto levanta capital externo massivo.
O momento é crucial. Projetar, fabricar e produzir um chip de IA personalizado é um empreendimento de vários anos que normalmente custa centenas de milhões a bem mais de um bilhão de dólares. O fundo de US$ 7,4 bilhões fornece o poder de fogo financeiro para financiar esse esforço, enquanto continua a desenvolver modelos de IA de próxima geração e construir a infraestrutura de data center necessária V.
A estratégia de chips da DeepSeek é um exemplo clássico de inovação defensiva sob pressão. Diante de um ambiente de hardware que se torna mais restrito a cada trimestre, a empresa está se diversificando em três frentes: extraindo mais desempenho do hardware existente por meio de melhorias algorítmicas, transferindo cargas de trabalho atuais para um parceiro doméstico (Huawei) e construindo para a independência de longo prazo com um design de chip personalizado. A rodada de captação de US$ 7,4 bilhões dá à DeepSeek a pista financeira para levar isso adiante, transformando sua estratégia de hardware de um plano de contingência em uma vantagem competitiva potencialmente decisiva.