Bộ tăng tốc MI450 tùy chỉnh này không phải là sản phẩm có sẵn trên thị trường. Nó là một biến thể được đồng thiết kế, được chế tạo riêng cho các khối lượng công việc nội bộ của Meta. Theo SemiAnalysis, con chip này sử dụng kiến trúc chiplet (chip nhỏ) của AMD để tạo ra một phiên bản có tài nguyên tính toán và bộ nhớ giảm đáng kể, được tinh chỉnh đặc biệt cho tỷ lệ băng thông bộ nhớ trên mỗi đô la mà các hệ thống gợi ý yêu cầu .
Lý do của Meta, như đã được báo cáo, là để tối ưu hóa tỷ lệ tính toán CPU-GPU ở cấp độ rack (khung máy chủ) và cải thiện hiệu quả chi phí băng thông bộ nhớ cho các khối lượng công việc RecSys (Hệ thống gợi ý), vốn chạy hàng tỷ suy luận mỗi ngày .
| Thông số kỹ thuật | AMD Instinct MI455X tiêu chuẩn | Biến thể tùy chỉnh của Meta | Khác biệt |
|---|---|---|---|
| Chiplet tính toán | 8 (trên TSMC N2) | 4 | Ít hơn 50% |
| Số lượng và tổng bộ nhớ HBM4 | 12 × 36 GB (12‑Hi) = 432 GB | 6 × 24 GB (8‑Hi) = 144 GB | Ít hơn ~67% bộ nhớ |
| Băng thông bộ nhớ tổng cộng | ~19,6 TB/s | Giảm theo tỷ lệ | Thấp hơn đáng kể |
AMD Instinct MI455X tiêu chuẩn, cung cấp năng lượng cho hệ thống quy mô rack Helios của AMD, là một kiệt tác kỹ thuật được xây dựng trên kiến trúc CDNA 5. Nó sử dụng 8 chiplet tính toán trên tiến trình N2 (2nm) của TSMC và 12 ngăn xếp HBM4 12-Hi để cung cấp 432 GB bộ nhớ . Phiên bản tùy chỉnh của Meta cắt giảm một nửa số chiplet tính toán—xuống còn 4—và giảm xuống còn 6 ngăn xếp HBM4 8-Hi, chỉ mang lại 144 GB bộ nhớ . Về cơ bản, đây là một nửa silicon tính toán và một phần ba băng thông bộ nhớ của MI455X đầy đủ.
Bởi vì chip sử dụng ít chiplet và ngăn xếp HBM hơn, biến thể của Meta cũng nhỏ hơn về mặt vật lý, tiêu thụ ít điện năng hơn và giảm độ phức tạp của bao bì, từ đó giảm chi phí cho mỗi bộ tăng tốc .
SemiAnalysis đã đưa ra một số chỉ trích gay gắt nhắm vào quyết định của Meta:
Lời phàn nàn cốt lõi là bằng cách cắt giảm chip, Meta hy sinh tính linh hoạt và khả năng thích ứng trong tương lai để tối ưu hóa chi phí trong ngắn hạn, có khả năng tự khóa mình khỏi các phần cứng mạnh mẽ hơn cần thiết cho các khối lượng công việc AI tiên tiến .
Tuy nhiên, không phải tất cả các nhà quan sát đều đồng ý. Một số người bảo vệ cách tiếp cận này lưu ý rằng các hệ thống gợi ý không cần đến năng lực của các mô hình ngôn ngữ lớn (LLM) tiên tiến. Điều chúng cần là băng thông trên mỗi đô la cho một tác vụ được chạy hàng tỷ lần mỗi ngày, khiến cho con chip bị cắt giảm trở thành một sự chuyên biệt hóa hợp lý hơn là một sai lầm .
Vào ngày 24 tháng 2 năm 2026, Meta và AMD đã công bố một quan hệ đối tác chiến lược 5 năm, trị giá 60 tỷ USD để triển khai lên tới 6 gigawatt GPU AMD Instinct cho cơ sở hạ tầng AI của Meta . Các điều khoản chính bao gồm:
Con chip 'Half-MI450' tùy chỉnh là biểu hiện sản phẩm cụ thể đầu tiên của siêu thỏa thuận này: một con chip được thiết kế riêng cho nhu cầu suy luận gợi ý của Meta, được thiết kế để tối đa hóa hiệu quả chi phí và năng lượng cho mỗi lần suy luận ở quy mô rack khổng lồ, chính xác là những gì mà quan hệ đối tác 60 tỷ USD được cấu trúc để thực hiện .