AWS và NVIDIA dự kiến triển khai thêm 2 triệu GPU NVIDIA trên hạ tầng toàn cầu của AWS trong giai đoạn 2027–2028, bên cạnh kế hoạch bổ sung hơn 1 triệu GPU từ năm 2026. Lô phần cứng mới dự kiến gồm các nền tảng Blackwell Ultra, Rubin và Rubin Ultra, cùng hệ thống CPU Vera, mạng tốc độ cao và hạ tầng dạng rack cho AI...
Câu trả lời nghiên cứu

Create a landscape editorial hero image for this Studio Global article: What did Amazon Web Services and NVIDIA announce on August 27, 2026, regarding AWS’s planned deployment of 2 million additional NVIDIA GPUs. Article summary: AWS and NVIDIA announced a major expansion of their AI-infrastructure partnership: AWS plans to deploy 2 million additional NVIDIA GPUs globally in 2027–28, on top of more than 1 million NVIDIA GPUs it had already planne. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
AWS và NVIDIA đang mở rộng quan hệ hợp tác AI với kế hoạch để AWS triển khai thêm 2 triệu GPU NVIDIA trên hạ tầng toàn cầu trong giai đoạn 2027 và 2028. Con số này được đưa ra chỉ vài tháng sau khi AWS công bố kế hoạch bổ sung hơn 1 triệu GPU NVIDIA từ năm 2026, trong bối cảnh nhu cầu huấn luyện và vận hành mô hình AI tiếp tục tăng nhanh. 369
Điểm đáng chú ý không chỉ nằm ở số lượng GPU. Thỏa thuận mới cho thấy hai công ty đang hướng tới một chiến lược hạ tầng nhiều thế hệ, kết hợp bộ tăng tốc AI, CPU, mạng, mô hình mở, xử lý dữ liệu, robot và các hệ thống phục vụ những môi trường yêu cầu bảo mật cao.
Số GPU bổ sung dự kiến bao gồm các nền tảng NVIDIA Blackwell Ultra, Rubin và Rubin Ultra. Điều này cho thấy AWS không đặt cược vào một dòng chip duy nhất, mà đang chuẩn bị năng lực điện toán cho nhiều thế hệ phần cứng NVIDIA trong tương lai. 168
Hai bên chưa công bố giá trị tài chính của thỏa thuận. Vì vậy, con số 2 triệu nên được hiểu là kế hoạch triển khai trên hạ tầng AWS, không phải số GPU đã được lắp đặt hoặc sẽ lập tức sẵn sàng cho khách hàng. 14
Quy mô này cũng phản ánh cách các nhà cung cấp đám mây đang chuẩn bị trước cho nhu cầu AI. Kế hoạch mới được công bố chỉ khoảng năm tháng sau khi AWS nói sẽ bổ sung hơn 1 triệu GPU NVIDIA từ năm 2026. Các báo cáo liên quan cho biết nhu cầu của khách hàng đã vượt kỳ vọng ban đầu, thúc đẩy hai công ty nâng mức cam kết. 39
AWS và NVIDIA mô tả hợp tác mở rộng là nỗ lực xây dựng hạ tầng AI tích hợp. Ngoài GPU, phạm vi hợp tác còn gồm hệ thống dựa trên CPU NVIDIA Vera, công nghệ mạng, mô hình mở, xử lý dữ liệu, robot và các “nhà máy AI”. 16
Lý do là một hệ thống AI quy mô lớn cần nhiều hơn chip tăng tốc. CPU đảm nhiệm việc điều phối và cung cấp dữ liệu cho tác vụ; mạng tốc độ cao kết nối các bộ xử lý; còn hệ thống lưu trữ và xử lý dữ liệu giúp đưa thông tin qua các quy trình huấn luyện, suy luận.
Với cách tiếp cận này, AWS và NVIDIA đang định vị quan hệ hợp tác như một nền tảng đồng bộ để mở rộng AI, thay vì chỉ cung cấp thêm các máy chủ đám mây có GPU.
Các nhóm ứng dụng được nhắm tới gồm AI tác vụ — những hệ thống có thể thực hiện chuỗi nhiệm vụ nhiều bước — và AI vật lý, chẳng hạn các ứng dụng liên quan đến robot. 68
Việc đưa hạ tầng dựa trên CPU NVIDIA Vera vào AWS giúp quan hệ hợp tác vượt ra ngoài phạm vi các bộ tăng tốc GPU. Vera được giới thiệu như một phần của hệ thống hạ tầng tổng thể, hoạt động cùng GPU và công nghệ mạng của NVIDIA. 1011
Với khách hàng, điều này có thể dẫn tới các phiên bản máy chủ AI được thiết kế như một hệ thống CPU–GPU hoàn chỉnh, thay vì xem GPU là một linh kiện tách biệt. Mô hình này đặc biệt phù hợp với các tác vụ cần điều phối phức tạp, truyền dữ liệu lớn hoặc kết nối mô hình AI với các công cụ bên ngoài.
Việc mở rộng hợp tác với NVIDIA không đồng nghĩa AWS từ bỏ chip AI do mình phát triển. AWS vẫn tiếp tục xây dựng và cung cấp Trainium, đồng thời tăng cường khả năng kết nối giữa hai hệ sinh thái. Hai công ty cho biết họ sẽ mở rộng NVLink Fusion và phát triển bộ nhớ băng thông cao tùy biến cho các hệ thống dựa trên Trainium. 1113
Điều này cho thấy AWS đang theo đuổi chiến lược song song: cung cấp hạ tầng NVIDIA cho khách hàng muốn tận dụng hệ sinh thái phần cứng và phần mềm của NVIDIA, trong khi tiếp tục phát triển Trainium cho các workload được tối ưu trên chip riêng của AWS.
Vì vậy, quan hệ hợp tác nên được hiểu là mô hình mở rộng lựa chọn, thay vì quyết định “chọn NVIDIA hoặc Trainium”. Khách hàng có thể cân nhắc giữa hiệu năng, khả năng tương thích phần mềm, mức độ sẵn có và chi phí hạ tầng. Tuy nhiên, các thông tin hiện có chưa đủ để so sánh chính xác hiệu năng hoặc hiệu quả kinh tế của từng cấu hình trong tương lai.
AWS và NVIDIA cũng đề cập đến hạ tầng “nhà máy AI” bảo mật dành cho các workload của chính phủ Mỹ và lĩnh vực an ninh quốc gia. Các báo cáo về thỏa thuận cho biết những hệ thống này nhằm phục vụ các trường hợp sử dụng liên bang có yêu cầu bảo mật cao, bên cạnh hạ tầng AI thương mại. 810
Điều đó mở rộng thị trường mục tiêu của quan hệ hợp tác, từ các doanh nghiệp xây dựng ứng dụng tiêu dùng hoặc phần mềm doanh nghiệp sang những tổ chức có yêu cầu nghiêm ngặt về bảo mật, kiểm soát truy cập và cách thức triển khai.
Dù vậy, các nguồn hiện có chưa nêu đầy đủ chi tiết kỹ thuật hoặc trạng thái chứng nhận của những môi trường này. Vì thế, thông báo mới chỉ nên được xem là định hướng hợp tác, chưa phải mô tả hoàn chỉnh về cấu hình triển khai cuối cùng.
Về mặt chiến lược, lợi ích của hai bên khá rõ ràng. NVIDIA có thêm một kênh phân phối lớn trên nền tảng đám mây cho nhiều thế hệ sản phẩm AI, còn AWS có thêm năng lực điện toán và nhiều hệ thống tích hợp NVIDIA để cung cấp cho khách hàng. 26
AWS đồng thời có thể củng cố hình ảnh một nhà cung cấp hạ tầng AI linh hoạt. Khách hàng có thể sử dụng hệ thống tối ưu cho NVIDIA, hệ thống dựa trên Trainium hoặc các cấu hình kết nối thành phần của cả hai hệ sinh thái.
Sự linh hoạt này có thể trở nên quan trọng khi workload AI không còn chỉ tập trung vào huấn luyện các mô hình lớn. Nhu cầu đang mở rộng sang suy luận, AI tác vụ, xử lý dữ liệu, robot và các ứng dụng AI vật lý.
Tuy nhiên, đây vẫn là một kế hoạch, không phải bằng chứng cho thấy toàn bộ 2 triệu GPU sẽ hoạt động trước cuối năm 2028. Tiến độ thực tế còn phụ thuộc vào sản xuất phần cứng, xây dựng trung tâm dữ liệu, nguồn điện, mạng kết nối và nhu cầu của khách hàng.
Các nguồn hiện có xác nhận quy mô và phạm vi mà hai công ty dự kiến theo đuổi, nhưng chưa cho biết cụ thể số GPU sẽ được triển khai theo từng khu vực, sản phẩm hoặc dịch vụ AWS.
AWS và NVIDIA đã công bố kế hoạch bổ sung 2 triệu GPU NVIDIA trong giai đoạn 2027–2028, nối tiếp kế hoạch AWS triển khai hơn 1 triệu GPU từ năm 2026. Lộ trình mới bao gồm Blackwell Ultra, Rubin và Rubin Ultra, cùng CPU Vera, công nghệ mạng, nhà máy AI, xử lý dữ liệu và hạ tầng robot. 136
Thông điệp lớn hơn là cuộc cạnh tranh hạ tầng AI trên đám mây đang chuyển từ việc cung cấp từng GPU riêng lẻ sang xây dựng các hệ thống quy mô rack hoàn chỉnh. AWS muốn kết hợp nền tảng NVIDIA với lộ trình Trainium của riêng mình, còn NVIDIA tiếp tục mở rộng hiện diện xuống nhiều lớp hạ tầng cần thiết để vận hành AI tác vụ và AI vật lý ở quy mô lớn.
Studio Global AI
Trang này bao gồm câu trả lời dựa trên nguồn mà bạn có thể tiếp tục bên trong Studio Global.
AWS và NVIDIA dự kiến triển khai thêm 2 triệu GPU NVIDIA trên hạ tầng toàn cầu của AWS trong giai đoạn 2027–2028, bên cạnh kế hoạch bổ sung hơn 1 triệu GPU từ năm 2026.
AWS và NVIDIA dự kiến triển khai thêm 2 triệu GPU NVIDIA trên hạ tầng toàn cầu của AWS trong giai đoạn 2027–2028, bên cạnh kế hoạch bổ sung hơn 1 triệu GPU từ năm 2026. Lô phần cứng mới dự kiến gồm các nền tảng Blackwell Ultra, Rubin và Rubin Ultra, cùng hệ thống CPU Vera, mạng tốc độ cao và hạ tầng dạng rack cho AI tác vụ và AI vật lý.
AWS vẫn duy trì chiến lược phát triển chip Trainium, đồng thời mở rộng NVLink Fusion và tích hợp bộ nhớ băng thông cao để tạo thêm lựa chọn giữa hệ sinh thái NVIDIA và chip AWS.