DeepSeek 喺 2026 年上半年啟動三線作戰策略:招攬清華大學頂尖蒸餾技術研究員顧煜賢(MiniLLM 第一作者)、完成 74 億美元(騰訊、CATL 領投)首輪外部融資,以及準備喺 7 月中推出 V4 模型正式版。 美國 NIST 下屬 CAISI 喺 5 月評估指出,DeepSeek V4 Pro 係佢哋測試過最強嘅中國 AI 模型,但仍然落後美國前沿模型大約 8 個月,Elo 評分約 800 對比 GPT 5.5 嘅 1260。

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for How does DeepSeek's recent recruitment of Tsinghua AI researcher Gu Yuxian, known for his work on. Article summary: All four claims are confirmed and fit together as a synchronized, three-pronged strategy. Here is the evidence, point by point:. Topic tags: general, academic, education, news, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it usefu
2026 年頭半年,中國 AI 實驗室 DeepSeek 做咗一連串同步嘅大動作,揭示咗佢哋點樣部署追趕 OpenAI 同 Anthropic。公司喺短短幾星期內,先後請咗一位清華大學嘅頂尖 AI 研究員、完成咗一筆破紀錄嘅 74 億美元融資,仲準備好全面推出 V4 模型。每一步都獨立顯示出佢哋嘅野心;夾埋一齊,就係一個完整嘅策略,目標係壓縮研發週期,喺前沿領域同美國公司競爭。
2026 年 7 月 5 日,內地媒體《騰訊新聞》報導,顧煜賢(Yuxian Gu)——清華大學博士生、2025 年清華大學研究生特等獎學金得主、2025 年蘋果博士獎學金同螞蟻 In-Tech 獎學金得主——已經正式加入 DeepSeek 。喺 DeepSeek V4 論文嘅作者名單入面,已經見到佢個名。
顧煜賢係 MiniLLM(ICLR 2024)嘅第一作者,呢篇關於大語言模型在線知識蒸餾嘅里程碑論文,累積咗接近 5,000 次引用 。佢嘅研究專注喺有限運算資源下,點樣有效率噉訓練同部署大語言模型。佢自己嘅講法同 DeepSeek 嘅理念好吻合:「當硬件資源受限時,算法創新就成為突破計算瓶頸嘅關鍵」
。
今次招攬嘅時機好有戰略意義。DeepSeek 嘅 V3 技術報告已經提到,由 R1 系列模型蒸餾推理能力 。顧煜賢嘅 MiniLLM 方法——用反向 KL 散度嚟做生成式蒸餾——可以直接改善未來模型嘅效率同成本結構。
DeepSeek 喺 2026 年 6 月 16 日完成咗史上第一次外部融資,籌得大約 74 億美元(500 億人民幣),投後估值達到 520 億至 590 億美元 。呢輪融資令 DeepSeek 成為中國最有價值嘅 AI 初創公司
。
呢輪融資嘅關鍵條款:
呢筆資金提供咗一個強大嘅彈藥庫,用嚟招攬好似顧煜賢咁嘅頂尖人才、資助 V4 規模訓練所需嘅龐大算力(1.6 萬億參數 MoE 模型),以及維持遠低於 OpenAI 同 Anthropic 嘅 API 價格 。
DeepSeek 喺 2026 年 4 月 22 日至 24 日,以 MIT 同 Apache 2.0 許可證,開源咗 V4 預覽模型 。《騰訊新聞》報導指出,「V4 正式版」會喺 2026 年 7 月中推出
。
兩個模型都喺 Hugging Face 開放權重,API 價格遠低於美國前沿模型——輸入成本大約係 Claude Opus 4.7 嘅 34 分之 1 。
2026 年 5 月 1 日,美國國家標準與技術研究院(NIST)旗下嘅人工智能標準與創新中心(CAISI)發表咗一份評估報告,指出:「DeepSeek V4 係 CAISI 至今評估過最強嘅中國 AI 模型」,涵蓋網絡安全、軟件工程、自然科學同抽象推理等領域 。彭博社亦有獨立報導同一發現
。
不過,CAISI 嘅評估同時指出,V4-Pro 喺推理同數學基準上,落後領先嘅美國前沿模型大約 8 個月 。以估計嘅 Elo 評分計,V4 Pro 大約 800 分,而 GPT-5.5 就有 1260 分
。
呢個係一個好重要嘅細節:「中國最強模型」呢個稱號確認咗 DeepSeek 喺中國嘅領導地位,但同時亦都公開量化咗佢同 OpenAI 同 Anthropic 嘅差距。
呢三步動作係高度同步、互相配合嘅:
招攬顧煜賢:喺 DeepSeek 推出 V4 呢個已經用緊蒸餾技術嘅模型時,注入世界級嘅蒸餾技術專長。顧煜賢嘅方法可以直接改善未來模型嘅效率同成本結構,幫 DeepSeek 用更少算力做到更多嘢。
74 億美元融資:提供一個強大嘅彈藥庫,用嚟好似搶顧煜賢噉嘅人才、資助 V4 規模訓練嘅龐大算力,以及維持遠低於美國競爭對手嘅 API 價格。
V4 正式版推出:係產品層面嘅驗證,必須證明 DeepSeek 可以收窄 NIST 所指出嘅大約 8 個月差距。呢個係個策略奏效嘅公開證明。
DeepSeek 正喺度競賽,希望透過同步注入資金、搶奪頂尖蒸餾技術人才,以及將 V4 推入量產,壓縮研發週期——全部目標都係為咗盡快收窄同美國前沿模型之間嘅量化差距。呢個三管齊下嘅策略最終能否成功,取決於算法創新有幾快可以補償硬件限制,以及下一代模型可以將嗰 8 個月嘅差距縮細幾多。
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
DeepSeek 喺 2026 年上半年啟動三線作戰策略:招攬清華大學頂尖蒸餾技術研究員顧煜賢(MiniLLM 第一作者)、完成 74 億美元(騰訊、CATL 領投)首輪外部融資,以及準備喺 7 月中推出 V4 模型正式版。
DeepSeek 喺 2026 年上半年啟動三線作戰策略:招攬清華大學頂尖蒸餾技術研究員顧煜賢(MiniLLM 第一作者)、完成 74 億美元(騰訊、CATL 領投)首輪外部融資,以及準備喺 7 月中推出 V4 模型正式版。 美國 NIST 下屬 CAISI 喺 5 月評估指出,DeepSeek V4 Pro 係佢哋測試過最強嘅中國 AI 模型,但仍然落後美國前沿模型大約 8 個月,Elo 評分約 800 對比 GPT 5.5 嘅 1260。
三項行動環環相扣:資金用嚟搶人才同燒算力、顧煜賢嘅蒸餾技術可以直接提升未來模型效率、V4 正式版就係要證明呢個策略行得通,目標係盡快收窄同美國嘅距離。