DeepSeek contratou Yuxian Gu, da Universidade de Tsinghua, principal autor do MiniLLM, artigo de destilação de conhecimento com quase 5.000 citações. A empresa fechou sua primeira rodada de captação externa, de US$ 7,4 bilhões, com Tencent e CATL como âncoras, avaliada entre US$ 52 e US$ 59 bilhões.
Resposta de pesquisa

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for How does DeepSeek's recent recruitment of Tsinghua AI researcher Gu Yuxian, known for his work on. Article summary: All four claims are confirmed and fit together as a synchronized, three-pronged strategy. Here is the evidence, point by point:. Topic tags: general, academic, education, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it usefu
No primeiro semestre de 2026, a DeepSeek executou uma manobra sincronizada em três frentes que revela como o laboratório chinês de IA pretende encurtar a distância para a OpenAI e a Anthropic. A empresa contratou um dos principais pesquisadores em destilação de conhecimento da Universidade de Tsinghua, fechou uma rodada de captação bilionária e prepara o lançamento da versão final do seu modelo V4 — tudo em questão de semanas. Cada movimento, isoladamente, já sinaliza ambição; juntos, formam uma estratégia coerente para comprimir o ciclo de P&D e competir na fronteira da inteligência artificial.
Em 5 de julho de 2026, a mídia chinesa Tencent News reportou que Yuxian Gu (顾煜贤) — doutorando da Universidade de Tsinghua, vencedor da Bolsa Especial de Pós-Graduação de Tsinghua em 2025 e das bolsas Apple Scholars e Ant In-Tech em 2025 — ingressou formalmente na DeepSeek N. O nome de Gu já aparecia na lista de autores do artigo técnico do DeepSeek V4.
Gu é o autor principal do MiniLLM (ICLR 2024), um artigo seminal sobre destilação de conhecimento on-policy para grandes modelos de linguagem, que já acumula quase 5.000 citações AAP. Sua pesquisa foca no treinamento e implantação eficientes de LLMs sob recursos computacionais limitados. Suas próprias palavras estão alinhadas com o ethos da DeepSeek: "Quando o hardware é limitado, a inovação algorítmica se torna a chave para superar o gargalo computacional" L.
A contratação é estrategicamente oportuna. O relatório técnico do DeepSeek V3 já descreve a destilação da capacidade de raciocínio dos modelos da série R1 A. A metodologia MiniLLM de Gu — que usa a divergência KL reversa para destilação generativa — pode melhorar diretamente a eficiência e a estrutura de custos de modelos futuros.
A DeepSeek fechou sua primeira rodada de captação externa em 16 de junho de 2026, levantando aproximadamente US$ 7,4 bilhões (50 bilhões de yuans) com uma avaliação pós-dinheiro entre US$ 52 e US$ 59 bilhões RFF. A rodada torna a DeepSeek a startup de IA mais valiosa da China F.
Principais termos do acordo:
O capital fornece um caixa de guerra para contratar os melhores talentos, como Gu, financiar o imenso poder computacional necessário para o treinamento do V4 (modelos MoE com 1,6 trilhão de parâmetros) e sustentar preços de API bem abaixo dos da OpenAI e Anthropic NO.
A DeepSeek lançou os modelos de prévia do V4 — com pesos abertos sob licenças MIT e Apache 2.0 — em 22 a 24 de abril de 2026 RDA. A reportagem da Tencent News afirma que a "V4 正式版" (versão oficial/final) será lançada em meados de julho de 2026 N.
A família V4 consiste em duas variantes Mixture-of-Experts RHA:
Ambos foram lançados com pesos abertos no Hugging Face e endpoints de API a preços significativamente mais baixos do que os modelos de fronteira dos EUA — cerca de 1/34 do custo do Claude Opus 4.7 por token de entrada CHA.
Em 1º de maio de 2026, o Centro de Padrões e Inovação em IA (CAISI) do governo dos EUA, ligado ao NIST, publicou uma avaliação afirmando: "O DeepSeek V4 é o modelo de IA da RPC mais capaz já avaliado pelo CAISI" nos domínios de cibersegurança, engenharia de software, ciências naturais e raciocínio abstrato N. A Bloomberg reportou de forma independente a mesma conclusão B.
No entanto, a avaliação do CAISI também observou que o V4-Pro fica atrás dos principais modelos de fronteira dos EUA em aproximadamente oito meses em benchmarks de raciocínio e matemática NBG. Em termos de pontuação Elo estimada, o V4 Pro marcou cerca de 800, enquanto o GPT-5.5 marcou 1260 IL.
Esta é uma nuance crítica: a designação de "modelo chinês mais capaz" confirma a liderança da DeepSeek dentro da China, mas também quantifica publicamente a lacuna para a OpenAI e a Anthropic.
Os três movimentos são fortemente sincronizados e se reforçam mutuamente:
A contratação de Gu Yuxian injeta expertise de classe mundial em destilação no momento exato em que a DeepSeek está lançando o V4 — um modelo que já usa técnicas de destilação. Os métodos de Gu podem melhorar diretamente a eficiência e a estrutura de custos de modelos futuros, ajudando a DeepSeek a fazer mais com menos poder computacional.
A captação de US$ 7,4 bilhões fornece o caixa de guerra para contratar agressivamente talentos como Gu, financiar o imenso poder computacional para o treinamento em escala do V4 e sustentar preços de API bem abaixo dos concorrentes americanos.
O lançamento completo do V4 é o veículo de produto que deve provar que a DeepSeek pode fechar a lacuna de ~8 meses identificada pelo NIST. É a demonstração pública de que a estratégia está funcionando.
A DeepSeek está correndo para comprimir seu ciclo de P&D, injetando capital simultaneamente, adquirindo os melhores talentos em destilação e colocando o V4 em produção — tudo com o objetivo de fechar a lacuna quantificada em relação aos modelos de fronteira dos EUA o mais rápido possível. O sucesso dessa estratégia tripla dependerá da velocidade com que a inovação algorítmica pode compensar as restrições de hardware e se a próxima geração de modelos conseguirá reduzir a defasagem de oito meses.
Studio Global AI
Esta página inclui uma resposta baseada na fonte que você pode continuar em Studio Global.
DeepSeek contratou Yuxian Gu, da Universidade de Tsinghua, principal autor do MiniLLM, artigo de destilação de conhecimento com quase 5.000 citações.
DeepSeek contratou Yuxian Gu, da Universidade de Tsinghua, principal autor do MiniLLM, artigo de destilação de conhecimento com quase 5.000 citações. A empresa fechou sua primeira rodada de captação externa, de US$ 7,4 bilhões, com Tencent e CATL como âncoras, avaliada entre US$ 52 e US$ 59 bilhões.
O lançamento da versão final do DeepSeek V4 está previsto para meados de julho de 2026; a versão de prévia já é considerada pelo governo dos EUA o modelo chinês mais capaz já avaliado.