DeepSeek phát hành V4.1 Flash ngày 10/9/2026, là mô hình đa phương thức gốc thuộc kiến trúc mới và dùng tên API deepseek flash. Từ 04:00 UTC ngày 14/9 (12:00 giờ Bắc Kinh), yêu cầu gửi tới V4 Pro sẽ tự động được chuyển sang V4.1 Flash và tính theo mức giá Flash cho tới khi V4.1 Pro ra mắt.
Đăng bởiBiên tập bằng GPT-5.6 TerraHình ảnh được tạo bằng GPT Image 2
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Chinese AI startup DeepSeek announce with the launch of its V4.1 Flash model on September 11, 2026, including how the slimmed-down. Article summary: DeepSeek launched V4.1-Flash on September 10, not September 11. It positioned the smaller, open-weight model as a new-architecture successor that combines native visual understanding with lower-cost, faster inference—and. Topic tags: general, news, general web, user generated, government. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermark
DeepSeek đã chính thức phát hành DeepSeek-V4.1-Flash vào ngày 10/9/2026. Đây không chỉ là một model mới: với người đang dùng API V4-Pro, thay đổi quan trọng nhất là yêu cầu của họ sẽ được tự động chuyển sang V4.1-Flash từ ngày 14/9. DeepSeek đặt cược vào mô hình có hỗ trợ hình ảnh tích hợp, chi phí token thấp và khả năng suy luận nhanh hơn. 1
3
10
Từ 04:00 UTC ngày 14/9 — tương ứng 12:00 giờ Bắc Kinh — các yêu cầu gửi tới V4-Pro sẽ tự động được định tuyến sang V4.1-Flash. Trong giai đoạn này, các yêu cầu đó sẽ được tính theo biểu giá Flash, cho tới khi V4.1-Pro xuất hiện. 3
Điều đó có nghĩa là đội ngũ vẫn giữ endpoint cũ không nên mặc định rằng hành vi đầu ra sẽ hoàn toàn giống trước. Với hệ thống đang vận hành ở môi trường sản xuất, nhất là các luồng gọi công cụ, lập trình, tác tử AI hoặc xử lý hình ảnh, nên chạy bộ kiểm thử riêng để đối chiếu chất lượng phản hồi, độ trễ và hành vi gọi công cụ trước thời điểm chuyển đổi.
DeepSeek cũng đã ngừng các model thế hệ trước là V4-Flash và V4-Flash-Vision-Exp. Model mới được gọi qua API với tên deepseek-flash. 10
16
DeepSeek mô tả V4.1-Flash là model nhỏ nhất trong họ kiến trúc mới của hãng. Theo công ty, kiến trúc này được thiết kế để nâng trần năng lực, suy luận nhanh hơn, tăng thông lượng và có thể mở rộng lên các model lớn hơn. 1
10
Điểm nổi bật là khả năng hiểu thị giác đa phương thức tích hợp sẵn: dữ liệu hình ảnh và văn bản được xử lý ngay trong model cốt lõi, thay vì dựa vào một mô-đun thị giác gắn thêm. 10
16
Theo thông tin DeepSeek công bố và các bài viết về đợt ra mắt, V4.1-Flash là model mixture-of-experts (MoE) có tổng cộng 552 tỷ tham số, dùng kiến trúc causal encoder-decoder. Model kích hoạt 8 tỷ tham số khi xử lý đầu vào và 16 tỷ tham số khi tạo đầu ra. Trọng số model được phát hành theo giấy phép MIT, theo các báo cáo về sự kiện này. 16
DeepSeek cho biết thiết kế mới nâng khả năng xử lý, tốc độ suy luận và thông lượng. Các bài viết về đợt phát hành cũng cho rằng V4.1-Flash vượt V4-Pro ở tác vụ lập trình và tác tử AI, trong khi chi phí vận hành thấp hơn. 1
Tuy nhiên, đây vẫn chủ yếu là tuyên bố về hiệu năng từ DeepSeek và các nguồn tường thuật đợt ra mắt, chưa phải bằng chứng từ đánh giá độc lập xác nhận V4.1-Flash luôn nhanh hơn hoặc tốt hơn V4-Pro, hay các model dẫn đầu khác, ở mọi loại tác vụ.
Hiệu quả sử dụng thực tế còn phụ thuộc prompt, loại công việc, hạ tầng phần cứng, mức độ đồng thời và cách triển khai gọi công cụ. Vì vậy, V4.1-Flash phù hợp để thử nghiệm trong các ứng dụng đa phương thức, quy trình viết mã và hệ tác tử nơi chi phí suy luận cùng thông lượng là tiêu chí quan trọng, nhưng không nên bỏ qua đánh giá theo chính dữ liệu và yêu cầu của từng sản phẩm.
DeepSeek điều chỉnh giá Flash từ ngày 10/9. Trong khung giờ thấp điểm, giá niêm yết là:
Giá giờ cao điểm cao gấp đôi mức thấp điểm. 15
Mức giá này cho thấy DeepSeek muốn cạnh tranh không chỉ bằng năng lực model mà còn bằng chi phí triển khai. API rẻ hơn có thể giúp nhà phát triển mở rộng các tác vụ như chuỗi gọi tác tử, tương tác ngữ cảnh dài hoặc yêu cầu kết hợp ảnh và văn bản.
Đổi lại, định giá quyết liệt đặt ra bài toán kinh doanh cho các nhà cung cấp AI: giá thấp có thể kéo thêm người dùng và thị phần, nhưng cũng làm giảm doanh thu trên mỗi token và gây sức ép lên biên lợi nhuận. Các nguồn được cung cấp không đủ cơ sở để khẳng định tác động trực tiếp, tức thời lên giá cổ phiếu của MiniMax, Z.AI hay Alibaba; vì thế cần thận trọng với những nhận định kiểu này.
Đợt ra mắt diễn ra ngay sau khi Reuters đưa tin DeepSeek đã làm việc với CITIC Securities để chuẩn bị cho khả năng IPO trong nước trên STAR Market của Thượng Hải — sàn tập trung vào doanh nghiệp công nghệ. Theo các nguồn của Reuters, công ty có thể khởi động quy trình niêm yết trong năm 2026, song quy mô và thời điểm chào bán vẫn chưa rõ.
Một model có trọng số mở, hỗ trợ đa phương thức và giá API thấp có thể củng cố câu chuyện sản phẩm của DeepSeek trước một đợt niêm yết tiềm năng. Nhưng đây là suy luận, không phải lý do chính thức mà công ty đưa ra cho việc phát hành. Đồng thời, chiến lược giá rẻ cũng khiến nhà đầu tư phải đặt câu hỏi liệu lượng sử dụng tăng lên có thể bù phần doanh thu giảm trên mỗi đơn vị suy luận hay không.
Vài ngày trước khi V4.1-Flash ra mắt, một cảnh báo chung của chính phủ Mỹ cáo buộc DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun và Z.AI đã thực hiện hoạt động trích xuất năng lực từ các model tiên phong của Mỹ thông qua chiến dịch chưng cất tri thức ở quy mô công nghiệp. Cảnh báo này cho rằng hàng tỷ token đã bị lấy qua hàng triệu yêu cầu từ các model như Claude, GPT, Gemini và Grok, nhiều khả năng với sự nhận biết của chính phủ Trung Quốc. 17
Đây là các cáo buộc của chính phủ Mỹ, không phải kết luận của tòa án. Trung Quốc bác bỏ các cáo buộc là vô căn cứ, cho rằng Mỹ dùng vấn đề này để bảo vệ thế độc quyền trong ngành AI; phía Trung Quốc cũng nhấn mạnh tự chủ công nghệ nhưng để ngỏ khả năng đối thoại.
Sự trùng hợp giữa một đợt ra mắt model lớn của Trung Quốc và tranh cãi này phản ánh hai lực kéo đang định hình thị trường AI: cạnh tranh nhanh về công nghệ và giá thành, song song với sự giám sát ngày càng chặt về quyền truy cập model, dữ liệu huấn luyện và dòng chảy công nghệ xuyên biên giới.
V4.1-Flash là nỗ lực của DeepSeek nhằm đưa một model nhỏ hơn trong họ kiến trúc mới thành lựa chọn mặc định cho phạm vi người dùng API rộng hơn. Hỗ trợ đa phương thức gốc, trọng số mở, các cải thiện hiệu quả mà hãng tuyên bố và mức giá thấp là trọng tâm của chiến lược này. 10
15
16
Với người dùng V4-Pro, việc cần làm trước mắt rất rõ ràng: chuẩn bị cho đợt chuyển model tự động vào ngày 14/9 và tự kiểm thử các quy trình quan trọng. Còn các tuyên bố về vị thế dẫn đầu của V4.1-Flash sẽ cần thời gian cùng những đánh giá độc lập để được xác thực. 3
17
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
DeepSeek phát hành V4.1 Flash ngày 10/9/2026, là mô hình đa phương thức gốc thuộc kiến trúc mới và dùng tên API deepseek flash.
DeepSeek phát hành V4.1 Flash ngày 10/9/2026, là mô hình đa phương thức gốc thuộc kiến trúc mới và dùng tên API deepseek flash. Từ 04:00 UTC ngày 14/9 (12:00 giờ Bắc Kinh), yêu cầu gửi tới V4 Pro sẽ tự động được chuyển sang V4.1 Flash và tính theo mức giá Flash cho tới khi V4.1 Pro ra mắt.
DeepSeek công bố giá ngoài giờ cao điểm từ 0,003 USD đến 0,60 USD cho mỗi triệu token, nhưng các so sánh về tốc độ và chất lượng vẫn chủ yếu là tuyên bố từ hãng.