Giá API của DeepSeek V4 Flash và V4 Pro tăng từ 50% đến hơn 1.100%, tùy mô hình, loại token và thời điểm sử dụng. DeepSeek áp dụng giá cao điểm gấp đôi giá thấp điểm; các khung cao điểm là 01:00–04:00 và 06:00–10:00 UTC.
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeek và OpenAI vừa đưa ra hai câu trả lời rất khác nhau cho cùng một bài toán kinh tế của ngành AI: làm sao thu hút lượng sử dụng khổng lồ trong khi chi phí vận hành và suy luận mô hình ngày càng tăng.
DeepSeek đang rời xa chiến lược API giá siêu thấp, đồng mức. OpenAI lại mở rộng quyền truy cập miễn phí để củng cố độ phủ của ChatGPT với người dùng phổ thông. Đây không phải hai sản phẩm tương đương—một bên là hạ tầng API dành cho nhà phát triển, bên kia là dịch vụ trò chuyện cho người tiêu dùng—nhưng cùng cho thấy cuộc đua AI đã vượt ra ngoài việc so sánh giá token rẻ nhất. Trọng tâm mới là quyền truy cập, thói quen sử dụng, khả năng điều phối lưu lượng và doanh thu bền vững.
DeepSeek bắt đầu áp dụng bảng giá mới từ 16:00 UTC ngày 16/8/2026. Công ty tách giá cao điểm và thấp điểm cho hai dòng V4-Flash và V4-Pro; giá thấp điểm bằng một nửa giá cao điểm. Các khung cao điểm là 01:00–04:00 và 06:00–10:00 UTC, còn lại là giờ thấp điểm.
| Mô hình | Thời điểm | Token đầu vào trúng bộ nhớ đệm | Token đầu vào không trúng bộ nhớ đệm | Token đầu ra |
|---|---|---|---|---|
| V4-Flash | Thấp điểm | 0,007 USD | 0,22 USD | 0,66 USD |
| V4-Flash | Cao điểm | 0,014 USD | 0,44 USD | 1,32 USD |
| V4-Pro | Thấp điểm | 0,022 USD | 0,66 USD | 1,98 USD |
| V4-Pro | Cao điểm | 0,044 USD | 1,32 USD | 3,96 USD |
Đơn giá tính bằng USD trên mỗi 1 triệu token. “Trúng bộ nhớ đệm” và “không trúng bộ nhớ đệm” đều chỉ token đầu vào.
Điểm đáng chú ý là “thấp điểm” không đồng nghĩa với việc mọi mức giá đều thấp hơn trước. Giá token đầu ra V4-Flash ở giờ thấp điểm đã là 0,66 USD, cao hơn mức cũ 0,28 USD. Với V4-Pro, giá đầu ra tăng từ mức khuyến mại 0,87 USD lên 1,98 USD trong giờ thấp điểm.
Mức tăng phụ thuộc vào mô hình, loại token và thời gian sử dụng. Reuters cho biết bảng giá mới cao hơn mức cũ từ 50% đến 1.100%.
Mức tăng theo phần trăm lớn nhất nằm ở token đầu vào đã được lưu trong bộ nhớ đệm, vốn có giá gốc rất thấp. Vì vậy, tác động thực tế với nhà phát triển còn tùy vào tỷ lệ cache hit, lượng đầu vào chưa lưu, số token đầu ra và việc hệ thống hoạt động vào khung giờ nào.
Chẳng hạn, giá token đầu ra V4-Pro hiện cao hơn khoảng 128% trong giờ thấp điểm so với mức khuyến mại cũ 0,87 USD, và cao hơn khoảng 355% trong giờ cao điểm.
Dù tăng mạnh, DeepSeek vẫn có giá thấp hơn nhiều mô hình AI đóng của Mỹ nếu so với các mức giá trước đây được công bố cho những hệ thống hàng đầu. Bảng giá khuyến mại trước đó đưa chi phí đầu ra V4-Pro xuống khoảng 0,87 USD cho mỗi 1 triệu token, thấp hơn đáng kể so với các đối thủ Mỹ hàng đầu. Vì vậy, thay đổi này làm thu hẹp lợi thế chi phí của DeepSeek nhưng chưa xóa bỏ lợi thế đó.
Giả sử một nhà phát triển tạo 10 triệu token đầu ra V4-Pro mỗi tháng:
Như vậy, riêng chi phí token đầu ra tăng thêm khoảng 11,10–30,90 USD mỗi tháng, tùy thời điểm chạy. Phép tính này chưa bao gồm token đầu vào, phí cache hit, thuế và các khoản phí nền tảng khác.
Với một ứng dụng đang vận hành thực tế, vấn đề lớn hơn có thể nằm ở cơ cấu lưu lượng chứ không chỉ số token đầu ra. Hệ thống có lời nhắc dài, tỷ lệ tái sử dụng cache thấp hoặc tập trung nhiều truy vấn vào giờ cao điểm sẽ chịu mức tăng khác nhau. Do đó, việc dời các tác vụ theo lô sang giờ thấp điểm và theo dõi tỷ lệ cache hit sẽ trở nên quan trọng hơn.
OpenAI chọn một hướng hoàn toàn khác với ChatGPT. GPT-5.6 Luna trở thành mô hình mặc định cho người dùng gói Free và Go; công ty đồng thời công bố trò chuyện văn bản không giới hạn cùng nút Think dành cho những câu hỏi khó hơn.
Tuy nhiên, cần hiểu đúng chữ “không giới hạn”: chính sách này áp dụng cho trò chuyện bằng văn bản, không phải mọi tính năng của ChatGPT. Tải tệp, hình ảnh, giọng nói, tạo ảnh và các công cụ khác vẫn có giới hạn, đồng thời quyền sử dụng còn chịu các biện pháp chống lạm dụng.
Đây là chiến lược mở rộng phân phối tới người tiêu dùng, không phải một đợt điều chỉnh giá API. OpenAI đang giảm rào cản cho việc sử dụng hằng ngày và giữ một mô hình có năng lực trong trải nghiệm ChatGPT mặc định. Theo TechCrunch, ChatGPT gần đây đã vượt mốc 1 tỷ người dùng mỗi tuần.
Giá token thấp đã giúp các mô hình Trung Quốc giành được lượng sử dụng đáng kể từ giới phát triển. Một số liệu của Vercel AI Gateway cho thấy các mô hình mã nguồn mở có trọng số do Trung Quốc phát triển xử lý 29% tổng số token sản xuất trên nền tảng vào tháng 6/2026, tăng từ khoảng một phần chín vào tháng 4; trong khi chúng chỉ chiếm dưới 4% tổng chi tiêu. Con số này phản ánh lưu lượng trên riêng gateway của Vercel, không phải toàn bộ thị trường AI toàn cầu.
Sự khác biệt đó rất quan trọng. Tỷ trọng token cho biết khối lượng công việc đi qua một hệ thống, nhưng tự nó không chứng minh doanh thu, lợi nhuận, mức độ trung thành của khách hàng hay sức mạnh thị trường lâu dài. Nhà phát triển có thể chuyển lưu lượng giữa nhiều nhà cung cấp, đặc biệt với các tác vụ nhạy cảm về chi phí.
Bảng giá mới cho thấy mục tiêu của DeepSeek không còn chỉ là giành càng nhiều lượt sử dụng càng tốt. Định giá theo thời gian cho phép công ty phân bổ công suất theo nhu cầu và thu phí cao hơn khi lưu lượng tập trung. Tài liệu chính thức của DeepSeek mô tả đây là biện pháp phân bổ tài nguyên hợp lý hơn, đồng thời khuyến khích người dùng sắp xếp tác vụ dựa trên nhu cầu thực tế.
Động thái này diễn ra trong bối cảnh nhiều công ty AI Trung Quốc khác cũng bắt đầu thu phí hoặc cân nhắc tăng giá. Các báo cáo về thị trường Trung Quốc cho biết Moonshot AI và ByteDance đã đưa ra các gói trả phí, còn Alibaba chuẩn bị đi theo hướng này, cho thấy ngành đang chuyển dần từ trợ giá mạnh sang tìm kiếm doanh thu.
Điều đó chưa chứng minh DeepSeek hay các đối thủ đã có lợi nhuận. Nhưng nó cho thấy thị phần giành được nhờ giá rẻ cuối cùng vẫn phải được chuyển thành doanh thu trên mỗi token, hợp đồng định kỳ hoặc một mô hình kinh doanh đủ bền vững.
Việc đưa Luna vào gói miễn phí nhấn mạnh lợi thế phân phối hơn là mục tiêu cung cấp API rẻ nhất. Bằng cách mở rộng trò chuyện văn bản và bổ sung nút Think dễ nhận thấy, OpenAI muốn ChatGPT trở thành thói quen thường xuyên của người dùng, trong khi vẫn giới hạn các tính năng tiêu tốn nhiều tài nguyên hơn.
Sự tương phản giữa hai chiến lược khá rõ:
Hai chiến lược này vẫn có thể cùng tồn tại. Một nhà phát triển có thể chọn DeepSeek cho các tác vụ khối lượng lớn, trong khi người dùng cá nhân chọn ChatGPT để hỏi đáp và hỗ trợ công việc hằng ngày. Tuy vậy, cả hai công ty đều muốn hệ sinh thái của mình khó bị thay thế hơn: DeepSeek dựa vào hiệu năng trên chi phí và khả năng định tuyến của nhà phát triển; OpenAI dựa vào độ quen thuộc của sản phẩm và độ phủ người dùng.
DeepSeek vẫn là một lựa chọn chi phí thấp, nhưng sau đợt điều chỉnh, mô tả “mô hình rẻ nhất” đã không còn đủ đầy đủ. Nhà phát triển nên tính tổng hóa đơn dựa trên token đầu vào cache hit, token đầu vào cache miss, lượng token đầu ra và tỷ trọng lưu lượng rơi vào giờ cao điểm.
Bốn câu hỏi thực tế hiện nay là:
Cạnh tranh AI giữa Trung Quốc và Mỹ ngày càng ít xoay quanh câu hỏi bên nào đưa ra mức giá quảng cáo thấp nhất. DeepSeek đang kiểm chứng liệu các phòng thí nghiệm Trung Quốc có thể biến lợi thế hiệu năng trên chi phí thành hiệu quả kinh tế bền vững hay không. OpenAI lại kiểm chứng liệu quyền truy cập miễn phí và thói quen sử dụng của người tiêu dùng có thể tạo ra quyền kiểm soát hệ sinh thái lâu dài hay không.
Ở cả hai phía, bài toán cốt lõi vẫn giống nhau: biến lượng sử dụng khổng lồ thành một mô hình kinh doanh đủ sức tiếp tục chi trả cho chi phí tính toán ngày càng lớn của các mô hình AI tiên tiến.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
Giá API của DeepSeek V4 Flash và V4 Pro tăng từ 50% đến hơn 1.100%, tùy mô hình, loại token và thời điểm sử dụng.
Giá API của DeepSeek V4 Flash và V4 Pro tăng từ 50% đến hơn 1.100%, tùy mô hình, loại token và thời điểm sử dụng. DeepSeek áp dụng giá cao điểm gấp đôi giá thấp điểm; các khung cao điểm là 01:00–04:00 và 06:00–10:00 UTC.
Với 10 triệu token đầu ra V4 Pro mỗi tháng, chi phí tăng từ mức cũ 8,70 USD lên 19,80 USD nếu chạy thấp điểm hoặc 39,60 USD nếu chạy cao điểm.