Theo TechCrunch, DeepSeek đã ra mắt hai bản xem trước của mô hình mới nhất — DeepSeek V4 Flash và DeepSeek V4 Pro — vào ngày 24/4/2026, như một bản cập nhật sau V3.2 và R1 . Cả hai được mô tả là mô hình hỗn hợp chuyên gia, thường gọi là mixture-of-experts hoặc MoE, với cửa sổ ngữ cảnh 1 triệu token .
Điểm “1 triệu token” mới là phần dễ thấy giá trị thực tế nhất. TechCrunch mô tả mức ngữ cảnh này là đủ để người dùng đưa những kho mã lớn hoặc tài liệu dài vào prompt, khiến V4 trở nên đáng chú ý với các việc như rà soát mã, phân tích tài liệu và những quy trình cần đầu vào dài .
Kiến trúc MoE cũng quan trọng. Cùng báo cáo này cho biết mô hình hỗn hợp chuyên gia có thể giảm chi phí suy luận bằng cách chỉ kích hoạt một phần mô hình cho từng tác vụ, thay vì dùng toàn bộ tham số mỗi lần . V4 Pro được báo cáo có tổng cộng 1,6 nghìn tỷ tham số, nhưng các bằng chứng được trích dẫn không cho thấy chỉ riêng số tham số đã đủ chứng minh ưu thế ở nhóm mô hình tuyến đầu .
Lịch ra mắt khiến sự so sánh gần như không thể tránh khỏi. Một bài viết hướng tới giới phát triển cho biết OpenAI phát hành GPT-5.5 vào ngày 23/4/2026, còn DeepSeek V4 Preview xuất hiện chưa đầy 24 giờ sau đó . Bài của TechCrunch về DeepSeek V4 cũng ghi ngày 24/4/2026 . Một bản tổng hợp tin AI khác đặt việc OpenAI ra GPT-5.5 và DeepSeek ra V4 trong cùng một thời điểm cạnh tranh rộng hơn về mô hình và hạ tầng .
Tuy nhiên, đây không chỉ là câu chuyện của hai công ty. Cùng bài viết hướng tới nhà phát triển còn liệt kê Claude Opus 4.7, Gemini 3.1 Pro, Llama 4, Qwen 3 và Gemma 4 trong cùng khung thời gian phát hành kéo dài sáu tuần . Vì vậy, cách hiểu thuyết phục hơn là DeepSeek V4 đã rơi đúng vào một chu kỳ ra mắt mô hình dồn dập bất thường, chứ không phải một mình nó buộc một thế hệ OpenAI mới phải lộ diện.
Không nguồn nào trong nhóm được trích dẫn xác minh một bản phát hành GPT-5.6 chính thức, một điểm chuẩn công khai của GPT-5.6, hay một vụ rò rỉ đã được xác nhận. Các nguồn cụ thể liên quan đến OpenAI trong hồ sơ này nói về GPT-5.5, không phải GPT-5.6 .
Nguồn duy nhất được trích dẫn có kết nối trực tiếp DeepSeek V4 với GPT-5.6 là một mục YouTube do người dùng tạo. Cách diễn đạt của mục này là DeepSeek V4 có thể đã thúc đẩy OpenAI thử nghiệm GPT-5.6 sớm hơn dự kiến . Đó là một tuyên bố yếu hơn rất nhiều so với việc nói GPT-5.6 đã được phát hành, bị “lật tẩy” hoặc bị đánh bại. Dựa trên bằng chứng hiện có, “DeepSeek phơi bày GPT-5.6” là cách đóng khung lan truyền, không phải một sự kiện đã được kiểm chứng .
Mối đe dọa chiến lược của DeepSeek V4 không chỉ nằm ở một tiêu đề về điểm chuẩn. Nó nằm ở sự kết hợp giữa ngữ cảnh dài, cơ chế chi phí của MoE và áp lực giá rất mạnh . Fortune mô tả bản xem trước V4 là đi kèm mức giá rất thấp, trong khi khoảng cách hiệu năng giữa DeepSeek và các mô hình hàng đầu của Mỹ đang thu hẹp, từ đó đặt câu hỏi về “hào lũy” cạnh tranh của các hãng đi trước .
Sự kết hợp này đặc biệt đáng chú ý với những nhóm phải xử lý nhiều token: tài liệu dài, kho mã lớn, các lệnh gọi mô hình lặp lại, hoặc hệ thống kiểu tác nhân AI. Lời hứa ở đây không đơn giản là “mô hình lớn hơn”, mà là suy luận rẻ hơn và nhận đầu vào dài hơn — nếu mô hình hoạt động đủ tốt cho tác vụ cụ thể .
Một báo cáo cho biết tài liệu kỹ thuật của DeepSeek tự tuyên bố V4-Pro dẫn trước đáng kể các mô hình mã nguồn mở khác trên các điểm chuẩn về tri thức thế giới, và chỉ kém nhẹ mô hình đóng Gemini 3.1 Pro . Cùng báo cáo cũng nói việc kiểm chứng độc lập các tuyên bố điểm chuẩn này vẫn đang diễn ra .
Chi tiết đó rất quan trọng. Cho đến khi các bên đánh giá bên ngoài tái lập được kết quả, nên xem V4 là một đối thủ nghiêm túc hơn là một “người thắng cuộc” đã được chốt. So sánh hữu ích nhất không phải là một điểm số gây chú ý, mà là hiệu năng trên khối lượng công việc thật, ở mức chi phí, độ trễ và độ ổn định mà sản phẩm cần.
Cụm “chiến tranh AI toàn cầu” là một phép ẩn dụ truyền thông. Các nguồn được trích dẫn có ủng hộ nhận định rằng cuộc đua AI đang nóng lên: một báo cáo đặt V4 trong bối cảnh cuộc đua AI toàn cầu sau GPT-5.5, và một nguồn khác nói bản cập nhật này xuất hiện khi cạnh tranh AI Mỹ - Trung gia tăng .
Nhưng bằng chứng hiện có cho thấy đây là cạnh tranh về năng lực mô hình, giá cả, hạ tầng và chiến lược dành cho nhà phát triển — không phải một cuộc chiến do riêng một bản xem trước của DeepSeek gây ra . Phân biệt điều này là cần thiết, vì thổi phồng câu chuyện sẽ khiến việc đánh giá mô hình theo bằng chứng thực tế trở nên khó hơn.
Hãy xem DeepSeek V4 là một đối tượng cần đánh giá, không phải một màn đăng quang. Nên thử nó ở đúng những nhóm việc mà các điểm mạnh được báo cáo có thể tạo khác biệt: xử lý tài liệu ngữ cảnh dài, prompt với kho mã lớn, tác vụ tác nhân nhiều bước và suy luận khối lượng cao .
Kiểm thử chi phí cũng cần nghiêm ngặt không kém kiểm thử năng lực. Một mô hình có giá quảng cáo rẻ vẫn có thể trở nên tốn kém nếu prompt quá lớn, đầu ra quá dài, độ trễ kém hoặc độ ổn định thấp đến mức phải chạy lại nhiều lần. Câu hỏi thực tế là liệu cơ chế MoE và cửa sổ ngữ cảnh dài của V4 có chuyển thành chi phí đầu-cuối thấp hơn cho một ứng dụng cụ thể hay không .
Nhịp phát hành nhanh cũng củng cố nhu cầu linh hoạt. Bài viết dành cho giới phát triển về chu kỳ GPT-5.5 đến DeepSeek V4 cho rằng các đội xây dựng sản phẩm đang chuyển sang định tuyến đa mô hình, tức ứng dụng chọn mô hình khác nhau cho từng tác vụ thay vì gắn chặt với một nhà cung cấp . Không phải đội nào cũng cần kiến trúc đó ngay lập tức, nhưng bài học chung khá rõ: lựa chọn mô hình AI đang trở thành một mục tiêu luôn dịch chuyển.
DeepSeek V4 là một bản ra mắt có thật, đáng chú ý về kỹ thuật và xuất hiện vào thời điểm cạnh tranh rất nhạy. Nó đưa cửa sổ ngữ cảnh 1 triệu token, cơ chế chi phí MoE và áp lực giá vào đúng tuần mà GPT-5.5 được nhắc đến rộng rãi .
Nhưng dựa trên các bằng chứng được trích dẫn, DeepSeek V4 chưa “lật tẩy” GPT-5.6. Kết luận vững hơn là áp lực, không phải bằng chứng: DeepSeek V4 đã làm cuộc đua mô hình thời GPT-5.5 leo thang, trong khi các tuyên bố hiệu năng lớn nhất vẫn cần kiểm chứng độc lập .