Mô hình open weight chiếm 62% lưu lượng token trên Vercel AI Gateway vào thứ Bảy trước ngày 25/8/2026, sau đó giữ 54% vào thứ Ba, so với 46% của mô hình độc quyền. DeepSeek V4 Flash là chất xúc tác chính: bản trọng số cập nhật cải thiện đáng kể khả năng tác vụ tự động nhưng vẫn giữ lợi thế về chi phí.
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What drove the record surge in usage of low-cost Chinese open-weight AI models—particularly DeepSeek’s latest lightweight model—on Vercel’s. Article summary: The surge was driven by developers shifting high-volume workloads to inexpensive Chinese open-weight models, led by DeepSeek V4 Flash: a lightweight model whose updated weights improved agentic performance substantially.. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts wi
Một sự dịch chuyển về bài toán chi phí và năng lực đang diễn ra trên AI Gateway của Vercel. Vào thứ Ba, ngày 25/8/2026, các mô hình open-weight — tức mô hình có trọng số được công bố để có thể tải xuống hoặc triển khai linh hoạt hơn — chiếm 54% tổng lượng token đi qua cổng này, vượt mức 46% của các mô hình độc quyền. Vào thứ Bảy trước đó, tỷ lệ mô hình open-weight từng chạm mức kỷ lục 62%, còn mô hình đóng ở 38%.4
Động lực trực tiếp phía sau là DeepSeek V4 Flash. Bản trọng số cập nhật giúp mô hình cải thiện hiệu năng trong lập trình, sử dụng công cụ và các quy trình tác vụ tự động, nhưng không biến nó thành một sản phẩm có mức giá cao.19
| Mốc được ghi nhận trong tháng 8 | Mô hình open-weight | Mô hình độc quyền |
|---|---|---|
| Thứ Bảy trước đó | 62% | 38% |
| Thứ Ba, 25/8 | 54% | 46% |
Như vậy, mô hình open-weight dẫn trước 8 điểm phần trăm vào ngày 25/8 và từng dẫn trước 24 điểm ở mốc kỷ lục trước đó. Tuy nhiên, đây là tỷ lệ token được xử lý qua gateway, không phải thước đo doanh thu, lợi nhuận hay số lượng doanh nghiệp đang sử dụng từng mô hình.
Vercel cho biết DeepSeek V4 Flash bắt đầu sử dụng bản trọng số cập nhật theo mặc định trên AI Gateway. Điểm Terminal-Bench của mô hình tăng từ 56,9 trong bản xem trước tháng 4 lên 82,7 — cải thiện 25,8 điểm.19 Người dùng hiện tại không cần đổi model ID hay sửa mã ứng dụng để nhận bản trọng số mới, qua đó giảm đáng kể rào cản chuyển đổi.19
Sức hút của V4 Flash vì thế không chỉ nằm ở việc rẻ. Khả năng xử lý tác vụ tự động tốt hơn khiến mô hình phù hợp với các khối lượng công việc lập trình và sử dụng công cụ ở quy mô lớn. Định vị ở phân khúc tối ưu hiệu quả cũng cho phép nhà phát triển kiểm soát chi phí suy luận — chi phí để mô hình tạo ra câu trả lời.
Theo mô tả sản phẩm của Vercel, V4 Flash hỗ trợ suy luận, sử dụng công cụ và bộ nhớ đệm ngầm, với cửa sổ ngữ cảnh 1 triệu token.27
Giá tiếp tục củng cố lợi thế này. Reuters đưa tin DeepSeek V4 Pro ra mắt với giá đầu vào khoảng gấp 9 lần và giá đầu ra gấp 14 lần V4 Flash, cho thấy khoảng cách rõ rệt giữa mẫu máy ưu tiên hiệu quả và sản phẩm cao cấp của cùng công ty.17 Các so sánh độc lập cũng cho thấy V4 Flash có lợi thế giá đáng kể, dù kết quả benchmark thay đổi tùy bài kiểm tra và cấu hình.25
Các báo cáo hiện có liên hệ sự suy giảm lưu lượng của mô hình độc quyền với nhu cầu kinh doanh yếu hơn đối với Fable 5 — một mô hình đắt tiền của Anthropic.4 Lý giải này hợp lý với những tác vụ mà nhà phát triển coi trọng thông lượng và chi phí trên mỗi đơn vị hơn là năng lực tối đa. Tuy vậy, số liệu gateway chưa đủ để chứng minh đây là nguyên nhân duy nhất đối với mọi khách hàng hoặc mọi yêu cầu.
Theo mô tả của Vercel, Fable 5 vẫn được định vị cho các tác vụ kéo dài, mơ hồ và nhiều bước.3 Vì vậy, biến động lưu lượng trong tháng 8 có vẻ giống một quyết định định tuyến mô hình hơn là phán quyết rằng mô hình mở luôn tốt hơn: dùng mẫu rẻ hơn cho khối lượng công việc phù hợp, còn dành mô hình độc quyền cao cấp cho những nhiệm vụ đủ quan trọng để biện minh cho mức giá cao hơn.
Điểm cần lưu ý nhất là sự khác biệt giữa mức sử dụng và doanh thu. Trong một báo cáo trước đó, Vercel cho biết mô hình open-weight tăng lên 29% tổng lượng token của gateway nhưng chỉ chiếm chưa đến 4% mức chi tiêu.44 Khoảng cách này xuất hiện vì số token không phản ánh đơn giá của token đầu vào và đầu ra.
Do đó, việc mô hình open-weight vượt mốc 50% trong tháng 8 cho thấy chúng đang xử lý phần lớn hơn trong khối lượng công việc của gateway, chứ chưa chứng minh chúng tạo ra nhiều doanh thu hơn cho nhà cung cấp. Các mô hình độc quyền vẫn có thể chiếm phần lớn ngân sách dù xử lý ít token hơn, đơn giản vì giá mỗi token cao hơn.
Dữ liệu trên gợi ý một chiến lược định tuyến mô hình có chủ đích hơn:
Bức tranh tháng 8 của Vercel cho thấy mô hình open-weight có thể giành phần lớn lưu lượng sản xuất khi kết hợp đủ năng lực với chi phí thấp hơn đáng kể. DeepSeek V4 Flash là ví dụ nổi bật nhất, nhưng xu hướng rộng hơn là lựa chọn mô hình rẻ nhất vẫn đáp ứng đủ độ tin cậy cho từng loại công việc — thay vì lập tức thay thế toàn bộ mô hình độc quyền.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Mô hình open weight chiếm 62% lưu lượng token trên Vercel AI Gateway vào thứ Bảy trước ngày 25/8/2026, sau đó giữ 54% vào thứ Ba, so với 46% của mô hình độc quyền.
Mô hình open weight chiếm 62% lưu lượng token trên Vercel AI Gateway vào thứ Bảy trước ngày 25/8/2026, sau đó giữ 54% vào thứ Ba, so với 46% của mô hình độc quyền. DeepSeek V4 Flash là chất xúc tác chính: bản trọng số cập nhật cải thiện đáng kể khả năng tác vụ tự động nhưng vẫn giữ lợi thế về chi phí.
Thị phần token không đồng nghĩa với thị phần doanh thu; dữ liệu trước đó của Vercel cho thấy mô hình open weight có thể xử lý nhiều token nhưng chỉ chiếm dưới 4% mức chi tiêu.