DeepSeek V4 và Qwen 3.8: Cuộc chiến giá AI Trung Quốc định hình lại toàn cầu năm 2026
DeepSeek V4 chính thức ra mắt toàn cầu (tháng 7/2026) dưới dạng mã nguồn mở MIT, mô hình MoE 1,6 nghìn tỷ tham số, hỗ trợ ngữ cảnh 1M token, giá chỉ 0,14–0,87 USD/triệu token — rẻ hơn GPT 5.5 khoảng 100 lần ở đầu ra. Alibaba trình làng Qwen 3.8 (2,4 nghìn tỷ tham số, sparse MoE) vào ngày 19/7/2026, tuyên bố 'chỉ xếp...
Đăng bởiBiên tập bằng DeepSeek-V4-FlashHình ảnh được tạo bằng GPT Image 1.5
DeepSeek V4 chính thức ra mắt toàn cầu (tháng 7/2026) dưới dạng mã nguồn mở MIT, mô hình MoE 1,6 nghìn tỷ tham số, hỗ trợ ngữ cảnh 1M token, giá chỉ 0,14–0,87 USD/triệu token — rẻ hơn GPT 5.5 khoảng 100 lần ở đầu ra.
Alibaba trình làng Qwen 3.8 (2,4 nghìn tỷ tham số, sparse MoE) vào ngày 19/7/2026, tuyên bố 'chỉ xếp sau Claude Fable 5', nhưng 0/321 điểm chuẩn theo dõi được xác minh tính đến ngày 20/7; chưa có trọng số cuối, giấy p...
Cuộc chiến giá AI Trung Quốc đã hạ thấp chi phí suy luận toàn cầu: đầu ra của DeepSeek V4 Flash chỉ 0,28 USD/triệu token, rẻ hơn 107 lần so với 30 USD/triệu token của GPT 5.5, và giấy phép MIT cho phép tự lưu trữ, tạo...
Search & fact-check with cited sources for What are the latest major developments in Chinese AI as DeepSeek launches V4 to general availabilDeepSeek V4 has shipped to general availability with open weights, while Alibaba's Qwen 3.8 remains in preview with bold but unverified performance claims.
Prompt AI
Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the latest major developments in Chinese AI as DeepSeek launches V4 to general availabil. Article summary: Here is a comprehensive, sourced breakdown of the two developments and their competitive context.. Topic tags: general, education, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustr
openai.com
Mùa hè năm 2026 chứng kiến hai thông báo lớn từ các phòng thí nghiệm AI Trung Quốc, cùng nhau xác định một giai đoạn mới trong cuộc cạnh tranh AI toàn cầu: DeepSeek đã phát hành mô hình V4 ra thị trường đại chúng với mức giá mang tính đột phá, và Alibaba đã hé lộ mô hình lớn nhất từ trước đến nay của mình, Qwen 3.8. Những phát triển này không chỉ tái định hình ranh giới kỹ thuật, mà còn thay đổi cả nền kinh tế của việc tiếp cận AI trên toàn thế giới.
DeepSeek V4: Phát hành, Mã nguồn mở và Giá rẻ mang tính đột phá
DeepSeek đã phát hành V4 dưới dạng bản xem trước vào ngày 22–24 tháng 4 năm 2026, với trọng số mở hoàn toàn theo giấy phép MIT . Bản xem trước này đã được nâng cấp lên V4 chính thức vào giữa tháng 7 năm 2026, bổ sung định giá giờ cao điểm (gấp 2 lần giá cơ bản trong giờ làm việc tại Bắc Kinh 9–12 và 14–18) trong khi giá giờ thấp điểm vẫn không thay đổi .
Studio Global AI
Tiếp tục nghiên cứu của bạn
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Câu trả lời ngắn gọn cho "DeepSeek V4 và Qwen 3.8: Cuộc chiến giá AI Trung Quốc định hình lại toàn cầu năm 2026" là gì?
DeepSeek V4 chính thức ra mắt toàn cầu (tháng 7/2026) dưới dạng mã nguồn mở MIT, mô hình MoE 1,6 nghìn tỷ tham số, hỗ trợ ngữ cảnh 1M token, giá chỉ 0,14–0,87 USD/triệu token — rẻ hơn GPT 5.5 khoảng 100 lần ở đầu ra.
Những điểm chính cần xác nhận đầu tiên là gì?
DeepSeek V4 chính thức ra mắt toàn cầu (tháng 7/2026) dưới dạng mã nguồn mở MIT, mô hình MoE 1,6 nghìn tỷ tham số, hỗ trợ ngữ cảnh 1M token, giá chỉ 0,14–0,87 USD/triệu token — rẻ hơn GPT 5.5 khoảng 100 lần ở đầu ra. Alibaba trình làng Qwen 3.8 (2,4 nghìn tỷ tham số, sparse MoE) vào ngày 19/7/2026, tuyên bố 'chỉ xếp sau Claude Fable 5', nhưng 0/321 điểm chuẩn theo dõi được xác minh tính đến ngày 20/7; chưa có trọng số cuối, giấy p...
Tôi nên làm gì tiếp theo trong thực tế?
Cuộc chiến giá AI Trung Quốc đã hạ thấp chi phí suy luận toàn cầu: đầu ra của DeepSeek V4 Flash chỉ 0,28 USD/triệu token, rẻ hơn 107 lần so với 30 USD/triệu token của GPT 5.5, và giấy phép MIT cho phép tự lưu trữ, tạo...
Cả hai biến thể đều đa phương thức (văn bản, hình ảnh, video), hỗ trợ đầu ra JSON và cuộc gọi công cụ, đồng thời có sẵn qua API và web .
Định giá (trên triệu token)
Biến thể
Đầu vào (giờ thấp điểm)
Đầu ra (giờ thấp điểm)
Cache Hit
V4-Pro
0,435 USD
0,87 USD
Giảm 90%
V4-Flash
0,14 USD
0,28 USD
Giảm 90%
DeepSeek cũng đã chạy chương trình khuyến mãi giảm 75% trên V4-Pro cho đến đầu tháng 5 năm 2026 . Để so sánh, giá đầu ra của GPT-5.5 là ~30 USD/MTok, khiến V4-Flash rẻ hơn khoảng 107 lần về đầu ra .
Hiệu suất và Vị thế cạnh tranh
Kết quả điểm chuẩn của DeepSeek V4 kể một câu chuyện nhiều sắc thái:
Codeforces: V4-Pro-Max đạt 3206 — xếp hạng cao nhất trong tất cả các mô hình đã thử nghiệm, vượt qua GPT-5.4 (3168) .
SWE-bench Verified: 80,6%; SWE-bench Pro: 55,4% (so với ~57,7% của GPT-5.5 trên SWE-bench Pro) .
GPQA Diamond: V4-Pro-Max đạt 90,1% — cạnh tranh với GPT-5.4 xHigh (93,0%) và Opus-4.6 Max (91,3%) .
Terminal-Bench 2.0: V4 đạt 67,9% so với 82,7% của GPT-5.5, một khoảng cách đáng chú ý trong mã hóa tác nhân .
Lưu ý quan trọng từ đánh giá CAISI của NIST (tháng 5 năm 2026): Các điểm chuẩn tự báo cáo của DeepSeek tuyên bố ngang bằng với GPT-5.4 và Opus 4.6, nhưng đánh giá độc lập của CAISI cho thấy V4 "kém năng lực hơn đáng kể" trên các điểm chuẩn không công khai, cho thấy một số điểm số tự báo cáo có thể bị thổi phồng . Chỉ số Thông minh của Artificial Analysis đánh giá GPT-5.5 (cao) ở mức 53 so với DeepSeek V4 Pro (Lý luận, Nỗ lực cao) ở mức *41 — GPT-5.5 thông minh hơn và nhanh hơn (69 so với 56 tok/s), nhưng DeepSeek rẻ hơn đáng kể (0,18 USD so với 4,35 USD/MTok ở chế độ lý luận) .
Alibaba Qwen 3.8: Bản xem trước với tuyên bố táo bạo và không có dữ liệu có thể kiểm chứng
Nhóm Qwen của Alibaba đã hé lộ Qwen 3.8 Max tại Hội nghị AI Thế giới ở Thượng Hải vào ngày 19 tháng 7 năm 2026. Đây là mô hình hàng đầu đầu tiên của nhóm trên 1 nghìn tỷ tham số.
Thông số kỹ thuật đã biết
Thuộc tính
Chi tiết
Tổng tham số
2,4 nghìn tỷ (sparse MoE)
Kiến trúc
Mixture-of-Experts, đa phương thức (văn bản + thị giác đã xác nhận)
Cửa sổ ngữ cảnh
983.616 token trên endpoint Qwen Cloud ; được nhắc lại là ~1M trong một số nguồn
Đầu ra tối đa
64.000 token
Giấy phép
Chưa được công bố; Alibaba cho biết sẽ mở trọng số "sớm"
Định giá
Chưa có mức giá thanh toán theo lần nào được công bố. Quyền truy cập hiện tại thông qua đăng ký qua Qwen Chat và các đối tác API được chọn. BenchLM liệt kê giá của Qwen 3.8 Max Preview là "Chưa được niêm yết" . Một số trình theo dõi bên thứ ba hiển thị giá tự động ở mức 1,50 USD/5,00 USD trên triệu token đầu vào/đầu ra, nhưng điều này không được Alibaba xác nhận .
Hiệu suất: Một tuyên bố tiếp thị với không có điểm số nào có thể kiểm chứng
Alibaba tuyên bố Qwen 3.8 là "chỉ xếp sau Fable 5" (mô hình Claude hàng đầu của Anthropic), điều này sẽ đặt nó lên trên GPT-5.5 và DeepSeek V4 trong bảng xếp hạng của riêng Alibaba . Những cải tiến được tuyên bố trong mã hóa, năng suất chuyên nghiệp, phát triển toàn diện, phân tích dữ liệu và quy trình làm việc văn phòng so với Qwen 3.7 Max .
Tuy nhiên, không có điểm chuẩn độc lập nào được công bố. BenchLM, một trang web theo dõi điểm chuẩn, theo dõi 321 điểm chuẩn cho Qwen 3.8 Max Preview với 0 kết quả đã được xác minh tính đến ngày 20 tháng 7 năm 2026 . Như một phân tích đã nói, "Qwen 3.8 đáng để thử nghiệm, nhưng còn quá sớm để coi nó như một sự thay thế sản xuất ổn định cho Kimi K3, GPT-5.6 Sol, hoặc Claude Fable 5" .
Để làm bối cảnh, những người tiền nhiệm của Qwen đã đặt một nền tảng vững chắc: Qwen 3.6-Max-Preview (ngày 20 tháng 4 năm 2026) là một mô hình chỉ có văn bản với 35B tổng / 3B tham số hoạt động, ngữ cảnh 262K, tuyên bố đứng số một trên sáu điểm chuẩn mã hóa và tác nhân . Qwen 3.7-Max (tháng 5 năm 2026) đã mở rộng lên cửa sổ ngữ cảnh 1M token với khả năng tác nhân lý luận . Nhưng cả hai đều không được coi là cấp độ tiên phong ngoài mã hóa tác nhân.
Bối cảnh cạnh tranh: Ai dẫn đầu và Ai định giá
DeepSeek V4 so với GPT-5.5
Lợi thế về giá: DeepSeek V4 rẻ hơn 97–107 lần so với GPT-5.5 về giá đầu ra .
Thế mạnh về mã hóa: V4 dẫn đầu về lập trình cạnh tranh (Codeforces, LiveCodeBench), trong khi GPT-5.5 dẫn đầu về mã hóa tác nhân ứng dụng (Terminal-Bench 82,7% so với 67,9%, SWE-bench Pro 58,6% so với 55,4%) .
Trí thông minh tổng quát: Các đánh giá của bên thứ ba (Artificial Analysis, NIST CAISI) luôn đặt GPT-5.5 lên trên .
Ngang bằng về cửa sổ ngữ cảnh: Cả hai đều cung cấp ngữ cảnh 1M token, nhưng GPT-5.5 là mô hình OpenAI đầu tiên mà toàn bộ cửa sổ 1M thực sự có thể sử dụng được mà không bị suy giảm .
Qwen 3.8 so với Claude Fable 5 và GPT-5.5
Alibaba định vị rõ ràng Qwen 3.8 là "chỉ xếp sau Fable 5" . Nếu tuyên bố này đúng dưới sự đánh giá độc lập, nó sẽ đặt Qwen 3.8 lên trên GPT-5.5 và vượt xa DeepSeek V4. Nhưng với không có điểm chuẩn nào được xác minh, đây vẫn là một tuyên bố tiếp thị, không phải một sự thật đã được thiết lập. Fable 5 của Anthropic dường như là nhà lãnh đạo tiên phong hiện tại được công nhận theo cách đóng khung của riêng Alibaba .
Cuộc chiến giá đã thay đổi mọi thứ
Việc định giá mạnh mẽ của DeepSeek đã thúc đẩy một cuộc đua xuống đáy về chi phí API. V4-Flash ở mức 0,14 USD/M đầu vào rẻ hơn đáng kể so với bất kỳ mô hình tiên phong phương Tây nào. Alibaba vẫn chưa thiết lập giá cho Qwen 3.8, nhưng Qwen 3.6 đã được định giá mạnh mẽ (~1,25 USD/7,50 USD đầu vào/đầu ra) .
Giấy phép MIT mã nguồn mở cho DeepSeek V4 có nghĩa là việc tự lưu trữ cũng có thể thực hiện được, làm giảm thêm biên lợi nhuận cho các nhà cung cấp mã nguồn đóng . Như một phân tích đã nói, hiệu quả thực tế là "các nhà phát triển giờ đây có thể truy cập khả năng gần tiên phong (về các tác vụ mã hóa) với chi phí chỉ bằng một phần nhỏ so với GPT-5.5 hoặc Claude."
Những điểm chính
DeepSeek V4 là một mô hình đã được phát hành, trọng số mở, 1,6T MoE, nằm sau GPT-5.5 khoảng 10–20% về trí thông minh tổng quát nhưng dẫn đầu về mã hóa cạnh tranh và rẻ hơn nhiều bậc độ lớn. Đánh giá độc lập của NIST CAISI đã làm dịu các điểm chuẩn tự báo cáo của nó.
Qwen 3.8 là một mô hình 2,4T MoE trong giai đoạn xem trước mà Alibaba tuyên bố là "chỉ xếp sau Fable 5" — nhưng với không có điểm chuẩn nào được xác minh và không có giá công bố, điều này hiện đang là khát vọng, chứ không phải đã được thiết lập.
GPT-5.5 vẫn là nhà lãnh đạo trí thông minh tổng thể (Artificial Analysis Index 53 so với 41 của DeepSeek) và là nhà lãnh đạo trong mã hóa tác nhân (Terminal-Bench 82,7%), nhưng đắt hơn 100 lần.
Cuộc chiến giá AI Trung Quốc đã vĩnh viễn hạ thấp chi phí suy luận trên toàn cầu, làm cho các khả năng cạnh tranh tiên phong trở nên dễ tiếp cận hơn nhiều đối với các nhà phát triển và buộc các nhà cung cấp phương Tây phải cạnh tranh về cả hiệu suất và giá cả.