De aanwerving is strategisch getimed. Het technische rapport van DeepSeek's V3 beschrijft al het distilleren van redeneervermogen uit zijn R1-serie modellen A. Gu's MiniLLM-methodologie — die gebruikmaakt van reverse KL-divergentie voor generatieve distillatie — zou direct de efficiëntie en kostenstructuur van toekomstige modellen kunnen verbeteren.
DeepSeek sloot op 16 juni 2026 zijn allereerste externe financieringsronde af en haalde ongeveer $7,4 miljard (50 miljard yuan) op bij een post-money waardering van $52 tot $59 miljard RFF. De ronde maakt DeepSeek de meest waardevolle AI-startup in China F.
Belangrijke voorwaarden van de deal:
Het kapitaal verschaft een oorlogskas om top talent zoals Gu aan te trekken, de enorme rekenkracht te financieren die nodig is voor training op V4-schaal (1,6T-parameter MoE-modellen), en de API-prijzen ruim onder die van OpenAI en Anthropic te houden NO.
DeepSeek bracht V4 preview-modellen — met open gewichten onder MIT- en Apache 2.0-licenties — uit op 22–24 april 2026 RDA. Het Tencent News-rapport stelt dat de "V4 正式版" (officiële/eindversie) medio juli 2026 zal worden gelanceerd N.
Beide werden uitgebracht met open gewichten op Hugging Face en API-eindpunten tegen aanzienlijk lagere prijzen dan Amerikaanse frontiermodellen — ongeveer 1/34e van de kosten van Claude Opus 4.7 voor invoer CHA.
Op 1 mei 2026 publiceerde het Center for AI Standards and Innovation (CAISI) van de Amerikaanse overheid, onderdeel van NIST, een evaluatie met de conclusie: "DeepSeek V4 is het meest capabele Chinese AI-model dat door CAISI tot nu toe is geëvalueerd" op het gebied van cyber, software-engineering, natuurwetenschappen en abstract redeneren N. Bloomberg berichtte onafhankelijk over dezelfde bevinding B.
De CAISI-evaluatie merkte echter ook op dat V4-Pro ongeveer acht maanden achterloopt op de toonaangevende Amerikaanse frontiermodellen op het gebied van redeneren en wiskunde NBG. In termen van geschatte Elo-scores scoorde V4 Pro rond de 800, terwijl GPT-5.5 een score van 1260 behaalde IL.
Dit is een cruciale nuance: de aanwijzing als "meest capabele Chinese model" bevestigt DeepSeeks leiderschap in China, maar kwantificeert ook publiekelijk de kloof met OpenAI en Anthropic.
Alle drie de zetten zijn strak gesynchroniseerd en versterken elkaar:
De aanwerving van Gu Yuxian injecteert wereldwijde distillatie-expertise op het exacte moment dat DeepSeek V4 uitbrengt — een model dat al distillatietechnieken gebruikt. Gu's methoden zouden direct de efficiëntie en kostenstructuur van toekomstige modellen kunnen verbeteren, waardoor DeepSeek meer kan doen met minder rekenkracht.
De kapitaalronde van $7,4 miljard verschaft de oorlogskas om agressief talent zoals Gu aan te trekken, de enorme rekenkracht voor V4-schaaltraining te financieren en de API-prijzen ruim onder die van Amerikaanse concurrenten te houden.
De volledige V4-release is het productvoertuig dat moet bewijzen dat DeepSeek de door NIST geïdentificeerde achterstand van ongeveer acht maanden kan verkleinen. Het is de publieke demonstratie dat de strategie werkt.
DeepSeek racet om zijn onderzoek-en-ontwikkelingscyclus te versnellen door gelijktijdig kapitaal te injecteren, toptalent op het gebied van distillatie aan te trekken en V4 in productie te nemen — allemaal gericht op het zo snel mogelijk dichten van de gekwantificeerde kloof met Amerikaanse frontiermodellen. Of deze driesporenstrategie zal slagen, hangt af van hoe snel algoritmische innovatie de hardwarebeperkingen kan compenseren en of de volgende generatie modellen de achterstand van acht maanden kan verkleinen.