DeepSeek báo cáo V4 Pro 0813 tăng từ 72,1 lên 87,9 điểm trên Terminal Bench 2.1, từ 52,7 lên 83,3 trên CyberGym và từ 12,8 lên 62,7 trên DeepSWE; tuy nhiên các kết quả này vẫn do chính hãng công bố. Harness mã nguồn mở theo giấy phép MIT mở rộng cuộc cạnh tranh từ API mô hình sang lớp runtime dành cho tác vụ, nơi cá...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What does DeepSeek’s move to general availability for its 1.6-trillion-parameter V4 Pro 0813 flagship model—released through the app’s Exper. Article summary: DeepSeek’s GA release appears to be a strategic pivot from a low-cost model vendor toward an integrated agent platform: a stronger flagship model, an open developer runtime, demand-shaping pricing, and capital-intensive . Topic tags: general, news, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
Việc DeepSeek đưa V4 Pro 0813 lên trạng thái sẵn sàng phổ biến (general availability) cho thấy công ty đang thay đổi trọng tâm chiến lược. Đây không chỉ là bản nâng cấp của một mô hình chủ lực, mà còn đi kèm runtime agent mã nguồn mở, cơ chế giá được thiết kế theo nhu cầu và kế hoạch hạ tầng đủ lớn để hỗ trợ mở rộng dài hạn.
Những con số năng lực ấn tượng nhất hiện vẫn là tuyên bố của DeepSeek. Vì vậy, kết luận thận trọng hơn không phải là V4 Pro đã chắc chắn vượt qua mọi đối thủ, mà là DeepSeek đang cố gắng cạnh tranh trên toàn bộ chuỗi công nghệ agent.
Theo bảng so sánh do DeepSeek công bố, V4 Pro 0813 cải thiện đáng kể so với bản xem trước hồi tháng 4 trên các bài kiểm thử liên quan đến kỹ thuật phần mềm và tác vụ agent:
Các số liệu này xuất phát từ bảng đối chiếu do DeepSeek công bố và được nhiều bài viết về màn ra mắt dẫn lại. Trên Terminal-Bench 2.1, mức 87,9 điểm được báo cáo chỉ thấp hơn 0,1 điểm so với con số 88,0 gắn với Fable 5 của Anthropic trong cùng bảng so sánh.
Nếu được xác nhận độc lập, kết quả này sẽ đưa V4 Pro 0813 đến gần nhóm dẫn đầu ở các tác vụ thường thấy trong coding agent: điều hướng kho mã, sử dụng công cụ, chạy lệnh và hoàn thành quy trình phần mềm nhiều bước.
Tuy nhiên, cần đặt một dấu hỏi rõ ràng đối với câu chuyện benchmark. Các điểm số do nhà cung cấp tự báo cáo, trong khi những thông tin hiện có chưa chứng minh rằng chúng đã được tái lập độc lập trên cùng một bộ công cụ đánh giá. Mức tăng rất lớn trên DeepSWE đáng chú ý, nhưng tự nó chưa đủ để chứng minh độ tin cậy tương đương trong môi trường thực tế.
Thông báo có ý nghĩa chiến lược hơn có thể là DeepSeek Harness, một runtime agent mã nguồn mở được phát hành theo giấy phép MIT. Dự án nằm giữa mô hình ngôn ngữ và môi trường phát triển của người dùng, giúp điều phối công cụ, tệp tin, lệnh, phiên làm việc và quy trình nhiều bước. Kho mã của DeepSeek mô tả đây là một agent harness mã nguồn mở, đồng thời công khai các phụ thuộc của bên thứ ba.
Điều này làm thay đổi mục tiêu cạnh tranh. DeepSeek không còn chỉ tranh giành các lệnh gọi API với những nhà cung cấp mô hình khác. Với Harness, công ty đang tiến vào lớp workflow và công cụ phát triển vốn được các sản phẩm như Claude Code và Codex chú trọng. Đây là nơi nhà phát triển quyết định agent hoạt động ra sao, được phép truy cập công cụ nào và người dùng còn kiểm soát runtime ở mức nào.
Dự án nhanh chóng thu hút sự quan tâm lớn. Các số liệu theo dõi bên thứ ba cho thấy Harness vượt 20.000 lượt đánh dấu sao trên GitHub chỉ khoảng một giờ sau khi ra mắt và vượt 141.000 lượt vào ngày 17 tháng 8. Dù vậy, số sao trên GitHub không đồng nghĩa với số hệ thống triển khai thực tế, người dùng duy trì lâu dài hay các tích hợp an toàn.
Cũng có những lý do thực tế để thận trọng. Harness v0.1 vẫn là bản xem trước dành cho nhà phát triển, và các thay đổi có thể phá vỡ khả năng tương thích được dự báo trước. Kiến trúc ưu tiên plugin giúp agent dễ tùy biến hơn, nhưng đồng thời làm tăng độ phức tạp vận hành. Mỗi công cụ hoặc plugin bổ sung đều kéo theo câu hỏi về quyền hạn, bảo trì, xử lý lỗi và quyền truy cập dữ liệu.
Việc điều phối nhiều bước cùng phần mô tả công cụ dài cũng có thể làm tăng lượng token tiêu thụ. Khi đó, mức giá được quảng bá cho riêng mô hình sẽ không phản ánh đầy đủ chi phí của một workflow tự động hoàn chỉnh.
Hơn 2.000 đề xuất plugin cho thấy cộng đồng quan tâm, chứ chưa chứng minh một kho plugin đã trưởng thành hoặc đáng tin cậy. Các đội ngũ muốn đánh giá Harness nên thử plugin trong môi trường cách ly, kiểm tra quyền truy cập và đo tổng chi phí hoàn thành tác vụ thay vì chỉ nhìn vào tốc độ tăng trưởng của kho mã.
Cải tổ giá API của DeepSeek đáng chú ý vì thay thế cách định giá cố định trước đây bằng cơ chế tính phí phụ thuộc thời điểm. Cấu trúc được công bố ban đầu mô tả các khung giờ cao điểm theo giờ Bắc Kinh, trong khi một số công cụ theo dõi giá sau đó liệt kê các khung giờ tương đương theo UTC. Do lịch công bố chưa được các nguồn mô tả hoàn toàn thống nhất, nhà phát triển nên kiểm tra giờ hiện hành trên tài liệu giá chính thức của DeepSeek trước khi lên lịch workload.
Hướng thay đổi về giá thì rõ ràng hơn lịch cụ thể. Theo các báo cáo về biểu giá mới, token đầu ra của V4 Pro tăng từ 0,87 USD cho mỗi một triệu token lên 1,98 USD ngoài giờ cao điểm và 3,96 USD trong giờ cao điểm. Tùy mô hình, loại token và thời điểm tính phí, một số hạng mục trong dòng V4 được cho là tăng hơn 1.100%.
Với nhà phát triển, tác động thực tế gồm:
Đây không chỉ là quyết định kiếm tiền. Giá cao điểm còn có thể đóng vai trò công cụ quản lý công suất, khuyến khích các workload linh hoạt rời khỏi những giờ có nhu cầu cao nhất. Cách làm này cho thấy DeepSeek bắt đầu xem năng lực suy luận là một nguồn lực hạ tầng hữu hạn, thay vì coi giá thấp là động lực tăng trưởng chủ đạo.
Ngay cả ở mức 3,96 USD cho mỗi một triệu token đầu ra trong giờ cao điểm, V4 Pro vẫn rẻ hơn đáng kể so với mức 50 USD cho mỗi một triệu token đầu ra được các bài viết về màn ra mắt dùng để so sánh với Fable 5. Lợi thế giá này vẫn có ý nghĩa đối với các workload coding và agent quy mô lớn.
Tuy nhiên, hiệu quả kinh tế không còn tương đương với khái niệm “gần như miễn phí”. Mức tăng 355% trong giờ cao điểm so với giá cũ 0,87 USD làm thay đổi bài toán đối với các hệ thống sản xuất tạo ra lượng đầu ra lớn. Các đội ngũ nên tính chi phí của một tác vụ thành công — bao gồm lần thử lại, lệnh gọi công cụ, ngữ cảnh và độ trễ — thay vì chỉ so sánh giá niêm yết trên mỗi triệu token.
Kết quả là một đề xuất giá trị quen thuộc hơn: DeepSeek có thể vẫn đem lại tỷ lệ năng lực trên chi phí tốt, nhưng đang yêu cầu khách hàng trả nhiều hơn cho năng lực cao cấp và điều chỉnh workload theo giới hạn công suất của công ty.
Chiến lược rộng hơn phù hợp với các thông tin về tài chính và hạ tầng của DeepSeek. Reuters đưa tin công ty đã huy động hơn 50 tỷ nhân dân tệ, tương đương khoảng 7,4 tỷ USD, trong vòng gọi vốn đầu tiên. Bloomberg đưa tin DeepSeek lên kế hoạch cho một dự án trung tâm dữ liệu tại Ulanqab, Nội Mông, với mục tiêu bổ sung khoảng một gigawatt công suất tính toán.
Các thông tin này không chứng minh mọi phần trong chiến lược sẽ thành công, cũng không bảo đảm cơ sở được lên kế hoạch sẽ hoàn thành đúng tiến độ. Nhưng chúng cho thấy công ty đang hướng đến mô hình vận hành cần nhiều vốn hơn.
Sự kết hợp giữa nâng cấp mô hình, runtime mở, định giá khác biệt, nguồn vốn bên ngoài và công suất trung tâm dữ liệu dự kiến gợi lên bốn mục tiêu liên kết:
Đây là tư thế rất khác so với việc chủ yếu cạnh tranh bằng cách trở thành nhà cung cấp mô hình có năng lực với giá thấp nhất.
DeepSeek V4 Pro 0813 đáng được thử nghiệm, đặc biệt trong lập trình, tự động hóa kho mã và workflow sử dụng công cụ. Nhưng các tổ chức nên tự xác minh ít nhất bốn yếu tố:
Cách đọc thuyết phục nhất về màn ra mắt này vì thế mang tính chiến lược hơn là chỉ nhìn vào các con số. DeepSeek đang cố chuyển mình từ một nhà cung cấp mô hình giá rẻ thành nền tảng agent tích hợp. V4 Pro 0813 cung cấp tuyên bố về năng lực, Harness tạo ra bề mặt dành cho nhà phát triển, giá cao điểm giúp kiểm soát nhu cầu, còn nguồn vốn mới cùng công suất tính toán dự kiến hỗ trợ luận điểm về hạ tầng.
Lợi thế đó có trở nên bền vững hay không sẽ phụ thuộc vào kết quả benchmark độc lập, độ ổn định của phần mềm, mức an toàn của hệ sinh thái plugin và việc nhà phát triển còn thấy đủ giá trị sau các đợt tăng giá hay không.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
DeepSeek báo cáo V4 Pro 0813 tăng từ 72,1 lên 87,9 điểm trên Terminal Bench 2.1, từ 52,7 lên 83,3 trên CyberGym và từ 12,8 lên 62,7 trên DeepSWE; tuy nhiên các kết quả này vẫn do chính hãng công bố.
DeepSeek báo cáo V4 Pro 0813 tăng từ 72,1 lên 87,9 điểm trên Terminal Bench 2.1, từ 52,7 lên 83,3 trên CyberGym và từ 12,8 lên 62,7 trên DeepSWE; tuy nhiên các kết quả này vẫn do chính hãng công bố. Harness mã nguồn mở theo giấy phép MIT mở rộng cuộc cạnh tranh từ API mô hình sang lớp runtime dành cho tác vụ, nơi các sản phẩm như Claude Code và Codex đang hiện diện.
Giá token đầu ra của V4 Pro tăng từ 0,87 USD lên 1,98 USD ngoài giờ cao điểm và 3,96 USD trong giờ cao điểm, trong khi DeepSeek được cho là đã huy động hơn 7,4 tỷ USD và lên kế hoạch bổ sung 1 GW công suất tính toán t...