Le recrutement a commencé dès le 20 mai avec deux postes clés (Product Manager et Ingénieur R&D Harness) basés à Pékin . Mais le vrai coup d'accélérateur est venu le 25 juin : DeepSeek a publié 33 offres d'emploi réparties en sept catégories, avec l'objectif affiché de « doubler la taille de tous les départements »
. En août, les recrutements campus incluaient déjà des postes de « Full Stack Developer (Agent Harness Team) »
.
Pour diriger cette équipe stratégique, DeepSeek a recruté en mars 2026 Cui Tianyi, un ancien ingénieur logiciel de Jane Street et co-fondateur du fonds TSY Capital . Le 1er août, Cui a lancé un appel à testeurs bêta publics qui a suscité un engouement phénoménal : 769 candidatures, 712 dépôts GitHub open-source uniques et plus de 1,2 million d'étoiles cumulées
.
La beta du framework agentique a été ouverte le 2 août 2026, ciblant les développeurs open-source, tandis que le lancement officiel reste à annoncer . Parallèlement, DeepSeek a activé ses premiers comptes officiels sur les réseaux sociaux (notamment WeChat, la super-application de Tencent) le 12 août pour promouvoir le « DeepSeek Harness Team », un signal fort de ses ambitions commerciales
.
Le 31 juillet 2026, DeepSeek a publié la version officielle de son modèle vedette : DeepSeek-V4-Flash-0731. Il s'agit de la version « production-ready » de son modèle Mixture-of-Experts (MoE) efficace : 284 milliards de paramètres au total, dont seulement 13 milliards activés par token, avec un contexte de 1 million de tokens .
Le modèle a été « re-post-trained » spécifiquement pour les tâches de codage agentique. Les résultats sont sans appel : sur les neuf benchmarks d'agents publiés par DeepSeek, la version Flash-0731 surpasse désormais la version Pro Preview, pourtant plus coûteuse .
Parmi les améliorations clés :
La documentation de Nvidia mentionne explicitement que V4 Pro est adapté aux « applications d'IA agentiques, aux scénarios d'utilisation d'outils et à la résolution de problèmes complexes » .
Pendant des années, DeepSeek a fonctionné sans financement externe, soutenu uniquement par les fonds de son hedge fund parent High-Flyer . Tout a changé en 2026.
La trajectoire de valorisation est spectaculaire : d'environ 50 milliards de dollars en juin à un objectif de 74 milliards en juillet, avec une introduction en Bourse (IPO) prévue pour 2027 sur le STAR Market de Shanghai .
DeepSeek opère dans un contexte de restrictions à l'exportation de puces américaines qui limitent l'accès des entreprises chinoises aux GPU NVIDIA les plus avancés . Ces contraintes, loin de freiner la startup, ont stimulé l'innovation : l'architecture Mixture-of-Experts de DeepSeek, avec seulement 13 milliards de paramètres activés par token, est née de cette nécessité de faire plus avec moins. La capacité du V4-Flash à surpasser des modèles plus grands sur les benchmarks agentiques est considérée comme une réponse directe aux limites matérielles
.
La transformation de DeepSeek s'inscrit dans un mouvement plus large des laboratoires d'IA chinois (comme Alibaba avec Qwen, Baidu avec Ernie, ou Zhipu AI) qui ont considérablement réduit l'écart avec les modèles américains. La stratégie open-source de DeepSeek et ses tarifs API nettement inférieurs à ceux de la concurrence ont mis la pression sur les coûts des acteurs américains, tandis que sa percée dans le codage agentique cible directement la couche applicative la plus précieuse commercialement — la génération de code — là où Anthropic (Claude Code) et GitHub (Copilot) dominent actuellement .