DeepSeek thay đổi biểu giá API từ phẳng sang hai mức cao điểm/thấp điểm từ ngày 16/8/2026, khiến giá V4 Pro đầu ra tăng từ 0,87 USD lên 3,96 USD/triệu token vào giờ cao điểm — tương đương mức tăng 355%. Bài kiểm tra độc lập từ Composio cho thấy mô hình V4 Flash chỉ hoàn thành 53,8% các tác vụ tác tử phức tạp, với sự...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What pricing changes did DeepSeek implement for its V4 API models on August 16, 2026, how does the new peak and off-peak tiered structure co. Article summary: **Pi Agent** led in both success rate (20/30) and cost efficiency ($0.028/task).. Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative visual, not as factual evidence
Ngày 16 tháng 8 năm 2026, DeepSeek đã thực hiện một trong những thay đổi giá quan trọng nhất trên thị trường AI API, thay thế biểu giá cố định theo token bằng cấu trúc cao điểm/thấp điểm, đẩy chi phí tăng lên tới 1.555% đối với một số loại token . Cùng tuần đó, hãng kiểm thử độc lập Composio tiết lộ rằng mô hình V4 Flash hàng đầu của DeepSeek chỉ hoàn thành 53,8% các tác vụ tác tử trong thế giới thực trên tám khung điều phối (orchestration harness) khác nhau, phơi bày một khoảng cách lớn giữa điểm số trên bảng xếp hạng và độ tin cậy trong sản xuất
. Cùng với nhau, những diễn biến này buộc các doanh nghiệp phải xem xét lại tổng chi phí và mức độ trưởng thành về điều phối cần thiết để triển khai DeepSeek V4 ở quy mô lớn.
Bắt đầu từ 16:00 UTC ngày 16 tháng 8 năm 2026, DeepSeek chuyển từ một mức giá cố định duy nhất sang mô hình định giá hai tầng cho cả V4-Flash và V4-Pro . Giờ cao điểm là 01:00–04:00 UTC và 06:00–10:00 UTC (tổng cộng 7 giờ mỗi ngày); tất cả các giờ còn lại là giờ thấp điểm
. Giá giờ thấp điểm bằng một nửa giá giờ cao điểm, nhưng mọi loại token vẫn tăng so với mức giá cố định trước đây
.
| Mô hình | Loại token | Giá cố định trước đây | Thấp điểm (mới) | Cao điểm (mới) | Thay đổi hiệu quả |
|---|---|---|---|---|---|
| V4-Flash | Đầu vào (cache miss) | 0,14 USD | 0,21 USD | 0,42 USD | +50% thấp điểm, +200% cao điểm |
| V4-Flash | Đầu vào (cache hit) | 0,0028 USD | 0,007 USD | 0,014 USD | +150% thấp điểm, +400% cao điểm |
| V4-Flash | Đầu ra | 0,28 USD | 0,42 USD | 0,84 USD | +50% thấp điểm, +200% cao điểm |
| V4-Pro | Đầu vào (cache miss) | 0,435 USD | 0,99 USD | 1,98 USD | +128% thấp điểm, +355% cao điểm |
| V4-Pro | Đầu vào (cache hit) | 0,003625 USD | 0,03 USD | 0,06 USD | +728% thấp điểm, +1.555% cao điểm |
| V4-Pro | Đầu ra | 0,87 USD | 1,98 USD | 3,96 USD | +128% thấp điểm, +355% cao điểm |
Dữ liệu giá từ bảng giá công bố của DeepSeek và các trang theo dõi độc lập .
Mức tăng lớn nhất là đầu vào cache-hit của V4-Pro, từ 0,003625 USD lên 0,06 USD vào giờ cao điểm — mức tăng khoảng 1.555% . DeepSeek cho biết sự thay đổi này nhằm phân bổ tài nguyên hiệu quả hơn và khuyến khích người dùng lên lịch cho các khối lượng công việc không khẩn cấp trong khung giờ thấp điểm
.
Vào tháng 8 năm 2026, hãng kiểm thử độc lập Composio đã đánh giá DeepSeek V4 Flash trên tám khung điều phối tác tử (agent orchestration harness) khác nhau với 30 quy trình làm việc nhiều bước, có chủ đích khó, trải rộng trên các công cụ trực tiếp bao gồm Gmail, GitHub, Slack và Google Sheets . Mỗi tác vụ có thời gian chờ 900 giây và tất cả các khung đều sử dụng cùng một bộ công cụ Composio MCP được lưu trữ
.
Kết quả tổng thể: trong tổng số 240 lần chạy, chỉ có 129 lần thành công — tỷ lệ đạt 53,8%. Chỉ 6 trong số 30 quy trình làm việc được hoàn thành thành công bởi tất cả các khung .
| Khung điều phối | Tỷ lệ đạt (trên 30 tác vụ) | Chi phí cho mỗi tác vụ thành công |
|---|---|---|
| Pi Agent | 20/30 (66,7%) | 0,028 USD |
| Prime Agent | ~15/24 (62,5% số lần chạy hợp lệ) | 0,131 USD |
| OMP (Oh My Pi) | 17/30 (56,7%) | 0,103 USD |
| Claude Code | 16/30 (53,3%) | 0,195 USD |
| Codex | 16/30 (53,3%) | 0,081 USD |
| Deep Agents (LangChain) | 16/30 (53,3%) | 0,045 USD |
| Hermes Agent | 15/30 (50,0%) | 0,056 USD |
| OpenCode | 14/30 (46,7%) | 0,067 USD |
Dữ liệu từ kết quả được công bố của Composio .
Pi Agent dẫn đầu cả về tỷ lệ thành công (20/30) và hiệu quả chi phí (0,028 USD/tác vụ) . Mỗi khung lại giành chiến thắng ở một chỉ số khác nhau — tỷ lệ thành công, chi phí và tốc độ —, điều đó có nghĩa là việc lựa chọn khung điều phối cũng quan trọng như năng lực của mô hình
. Khoảng cách 20 điểm giữa khung tốt nhất và kém nhất cho thấy sự nhạy cảm cực độ đối với framework tác tử, cấu hình công cụ, bộ nhớ đệm (caching), số lần thử lại (retries) và ngăn xếp nhà cung cấp
.
Sự kết hợp giữa giá cao hơn và kết quả thực tế không đồng đều đã làm thay đổi quan điểm của các nhà phân tích về sự phù hợp của DeepSeek V4 với doanh nghiệp.
VentureBeat lưu ý rằng cùng một mô hình V4 Flash cho ra kết quả khác nhau đáng kể tùy thuộc vào khung, công cụ và ngăn xếp bộ nhớ đệm — cho thấy các doanh nghiệp phải đầu tư vào sự trưởng thành về khâu điều phối song song với việc lựa chọn mô hình . Chính Composio cũng chỉ ra rằng chỉ riêng việc lựa chọn khung đã thay đổi tỷ lệ thành công ba tác vụ, chi phí gần 3 lần và tốc độ 2,2 lần
.
Ngay cả trong giờ thấp điểm, mọi loại token đều đắt hơn trước đây. Các nhà phân tích cho rằng điều này thay đổi cách tính ROI cho các khối lượng công việc tác tử có khối lượng lớn, đặc biệt là các tác vụ chăm sóc khách hàng và quy trình tạo mã nguồn trước đây vốn dựa vào mức giá cực kỳ thấp của DeepSeek .
Các điểm chuẩn tác tử chính thức của DeepSeek (82,7 trên Terminal-Bench 2.1, 70,3 trên Toolathlon-Verified) trông rất ấn tượng, nhưng tỷ lệ thành công 53,8% trong thế giới thực là một lời nhắc nhở rằng điểm số trên bảng xếp hạng không đảm bảo độ tin cậy trong môi trường sản xuất với các API trực tiếp, giới hạn tốc độ và quy trình làm việc trạng thái .
Lưu lượng API định tuyến qua các máy chủ tại Trung Quốc, tạo ra những thách thức về tuân thủ cho các doanh nghiệp được quản lý. Các nhà phân tích khuyên nên lập kế hoạch kiến trúc cẩn thận cho quản trị dữ liệu, nhật ký kiểm toán và kiểm soát quyền đối với công cụ . Đối với các ngành được quản lý chặt chẽ, tự lưu trữ (self-hosting) các trọng số mở vẫn là con đường khả thi duy nhất để đưa vào sản xuất
.
Khung đánh giá doanh nghiệp của BayTech Consulting khuyến nghị DeepSeek V4 cho các tác vụ tóm tắt tài liệu không nhạy cảm, tạo mã nguồn trên kho lưu trữ mở và soạn thảo nội dung khối lượng lớn — nhưng kêu gọi đánh giá nghiêm ngặt từng khối lượng công việc trước khi cam kết đưa vào sản xuất .
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
DeepSeek thay đổi biểu giá API từ phẳng sang hai mức cao điểm/thấp điểm từ ngày 16/8/2026, khiến giá V4 Pro đầu ra tăng từ 0,87 USD lên 3,96 USD/triệu token vào giờ cao điểm — tương đương mức tăng 355%.
DeepSeek thay đổi biểu giá API từ phẳng sang hai mức cao điểm/thấp điểm từ ngày 16/8/2026, khiến giá V4 Pro đầu ra tăng từ 0,87 USD lên 3,96 USD/triệu token vào giờ cao điểm — tương đương mức tăng 355%. Bài kiểm tra độc lập từ Composio cho thấy mô hình V4 Flash chỉ hoàn thành 53,8% các tác vụ tác tử phức tạp, với sự chênh lệch tới 20 điểm phần trăm giữa các khung điều phối (harness).
Pi Agent là khung điều phối hiệu quả nhất, đạt tỷ lệ thành công 66,7% với chi phí chỉ 0,028 USD mỗi tác vụ, trong khi OpenCode chỉ đạt 46,7%.