Việc tuyển dụng này có thời điểm chiến lược. Báo cáo kỹ thuật của DeepSeek V3 đã mô tả việc chưng cất khả năng suy luận từ các mô hình dòng R1 A. Phương pháp MiniLLM của Gu – sử dụng phân kỳ KL ngược (reverse KL divergence) để chưng cất sinh – có thể trực tiếp cải thiện hiệu quả và cấu trúc chi phí của các mô hình tương lai.
DeepSeek đã chốt vòng gọi vốn bên ngoài đầu tiên vào ngày 16 tháng 6 năm 2026, huy động được khoảng 7,4 tỷ USD (50 tỷ nhân dân tệ) với định giá sau vốn là 52 đến 59 tỷ USD RFF. Vòng gọi vốn này đưa DeepSeek trở thành startup AI có giá trị nhất tại Trung Quốc F.
Các điều khoản chính của thương vụ:
Nguồn vốn này cung cấp một quỹ chiến tranh để thuê những nhân tài hàng đầu như Gu, tài trợ cho khối lượng tính toán khổng lồ cần thiết cho việc đào tạo mô hình quy mô V4 (mô hình MoE 1,6 nghìn tỷ tham số), và duy trì mức giá API thấp hơn nhiều so với OpenAI và Anthropic NO.
DeepSeek đã phát hành các mô hình xem trước V4 – với trọng số mở theo giấy phép MIT và Apache 2.0 – vào các ngày 22–24 tháng 4 năm 2026 RDA. Báo cáo của Tencent News cho biết "V4 正式版" (phiên bản chính thức) sẽ ra mắt vào giữa tháng 7 năm 2026 N.
Cả hai đều được phát hành với trọng số mở trên Hugging Face và các điểm cuối API với mức giá thấp hơn đáng kể so với các mô hình tiên tiến của Mỹ – khoảng 1/34 chi phí của Claude Opus 4.7 cho đầu vào CHA.
Vào ngày 1 tháng 5 năm 2026, Trung tâm Đổi mới và Tiêu chuẩn AI (CAISI) thuộc NIST của chính phủ Mỹ đã công bố một đánh giá nêu rõ: "DeepSeek V4 là mô hình AI Trung Quốc mạnh nhất được CAISI đánh giá cho đến nay" trên các lĩnh vực an ninh mạng, kỹ thuật phần mềm, khoa học tự nhiên và suy luận trừu tượng N. Bloomberg cũng đưa tin độc lập về phát hiện này B.
Tuy nhiên, đánh giá của CAISI cũng chỉ ra rằng V4-Pro thua kém các mô hình tiên tiến hàng đầu của Mỹ khoảng tám tháng trong các bài kiểm tra về suy luận và toán học NBG. Về điểm Elo ước tính, V4 Pro đạt khoảng 800, trong khi GPT-5.5 đạt 1260 IL.
Đây là một sắc thái quan trọng: danh hiệu "mô hình Trung Quốc mạnh nhất" xác nhận vị thế dẫn đầu của DeepSeek trong nước, nhưng nó cũng định lượng một cách công khai khoảng cách với OpenAI và Anthropic.
Cả ba động thái đều được phối hợp chặt chẽ và củng cố lẫn nhau:
Việc tuyển dụng Gu Yuxian đưa chuyên môn chưng cất AI đẳng cấp thế giới vào đúng thời điểm DeepSeek đang phát hành V4 – một mô hình vốn đã sử dụng các kỹ thuật chưng cất. Phương pháp của Gu có thể trực tiếp cải thiện hiệu quả và cấu trúc chi phí của các mô hình tương lai, giúp DeepSeek làm được nhiều hơn với ít tài nguyên tính toán hơn.
Khoản huy động 7,4 tỷ USD cung cấp quỹ chiến tranh để mạnh tay tuyển dụng nhân tài như Gu, tài trợ cho khối lượng tính toán khổng lồ để đào tạo mô hình quy mô V4, và duy trì mức giá API thấp hơn nhiều so với các đối thủ Mỹ.
Phiên bản chính thức V4 là phương tiện sản phẩm phải chứng minh DeepSeek có thể thu hẹp khoảng cách khoảng 8 tháng mà NIST đã xác định. Đây là minh chứng công khai cho thấy chiến lược đang hiệu quả.
DeepSeek đang chạy đua để rút ngắn chu kỳ R&D bằng cách đồng thời bơm vốn, mua lại nhân tài chưng cất hàng đầu và đưa V4 vào sản xuất – tất cả nhằm thu hẹp khoảng cách đã được định lượng với các mô hình tiên tiến của Mỹ nhanh nhất có thể. Liệu chiến lược ba mũi nhọn này có thành công hay không phụ thuộc vào tốc độ đổi mới thuật toán có thể bù đắp cho những hạn chế về phần cứng, và liệu thế hệ mô hình tiếp theo có thể thu hẹp khoảng cách tám tháng hay không.