Được phát triển chung bởi AMD, Supermicro và Spectro Cloud, nền tảng này đã được công bố vào ngày 5 tháng 8 năm 2026 tại hội nghị Ai4 2026 ở Las Vegas . Dưới đây là cách nó hoạt động, chi phí và đối tượng phù hợp.
AMD Instinct Coder sử dụng định tuyến mô hình thông minh dựa trên chính sách như một điểm khác biệt cốt lõi . Các yêu cầu mã nguồn thông thường — tạo mã, tóm tắt, tái cấu trúc — được phục vụ cục bộ bởi mô hình GLM-5.2 hỗn hợp chuyên gia (mixture-of-experts) do AMD tối ưu hóa (tổng cộng 744B tham số, với khoảng 40B được kích hoạt cho mỗi token) . Các truy vấn suy luận phức tạp hơn có thể được chuyển tiếp đến các mô hình tiên tiến như OpenAI GPT, Anthropic Claude hoặc Google Gemini khi mô hình cục bộ không xử lý được . Thiết kế suy luận phân tầng này chính là cơ chế đằng sau những tuyên bố về tiết kiệm chi phí .
Hệ thống tham chiếu là một thiết bị tích hợp trong rack (rack-integrated), được xác nhận trước, và được bán như một mã hàng duy nhất (single SKU) :
| Linh kiện | Thông số kỹ thuật |
|---|---|
| CPU | 2x Bộ xử lý AMD EPYC 9575F (64 lõi mỗi CPU, 3.3 GHz) |
| GPU | 8x Bộ tăng tốc AMD Instinct MI325X (256 GB HBM3E mỗi GPU, băng thông đỉnh 6 TB/s), có sẵn bản làm mát bằng không khí hoặc chất lỏng |
| Mạng | 2x SmartNIC AMD Pensando Pollara 400 Gb/s |
| Khung máy | Supermicro AS-8126GS-TNMR, được xác nhận và tích hợp rack đầy đủ |
Hệ thống được thiết kế như một thiết bị "cắm vào, bật lên là chạy" (plug-and-play), có sẵn dưới dạng một mã hàng duy nhất vào cuối quý ra mắt .
PaletteAI Inference Launchpad của Spectro Cloud là lớp phần mềm làm cho phần cứng trở nên hữu dụng. Nó cung cấp :
AMD và Spectro Cloud tuyên bố nền tảng có thể giảm chi phí token AI mã nguồn tới 70% so với việc gửi tất cả yêu cầu đến các API mô hình tiên tiến trên đám mây . Tài liệu của AMD cũng đề cập đến thời gian hoàn vốn chỉ trong sáu tháng cho khoản đầu tư này . Các tuyên bố này chưa được xác minh độc lập và mức tiết kiệm thực tế sẽ phụ thuộc vào khối lượng công việc, mô hình sử dụng và giá API đám mây của từng tổ chức .
Dan McNamara (Phó Chủ tịch Cấp cao & Tổng Giám đốc, Mảng Máy tính & AI Doanh nghiệp, AMD):
"Các tổ chức cần quyền kiểm soát nơi mã được xử lý, mô hình nào được sử dụng và chi phí sử dụng đó là bao nhiêu. AMD Instinct Coder kết hợp sức mạnh tính toán hiệu năng cao của AMD với hệ sinh thái phần mềm mở cùng công nghệ của Supermicro và Spectro Cloud, mang đến cho khách hàng một cách đơn giản để chạy nhiều khối lượng công việc hơn tại chỗ, sử dụng các mô hình tiên tiến một cách có chọn lọc và tự vận hành cơ sở hạ tầng."
Tenry Fu (Đồng sáng lập & Giám đốc điều hành, Spectro Cloud):
"Các tổ chức không nên phải lựa chọn giữa khả năng của các mô hình tiên tiến và lợi ích kinh tế cùng khả năng kiểm soát của suy luận cục bộ."
Vik Malyala (Phó Chủ tịch Cấp cao, Mảng AI và Doanh nghiệp, Supermicro):
Vai trò của Supermicro bao gồm xác nhận trước (pre-validation), tích hợp rack (rack integration) và chứng nhận hệ thống (system qualification) để giảm độ phức tạp khi triển khai và rút ngắn thời gian từ khi nhận phần cứng đến khi đưa vào sản xuất suy luận .
Nền tảng được ra mắt tại Ai4 2026 (ngày 4–6 tháng 8 tại Las Vegas) . Sự ra mắt này nhằm giải quyết một vấn đề cấp bách của doanh nghiệp: khi các tổ chức mở rộng quy mô các tác nhân AI mã nguồn (AI coding agents) qua các nhóm phát triển và quy trình tự động hóa, chi phí token đang tăng nhanh. Nhà áp dụng sớm BMC đã triển khai nền tảng này cho công việc Helix Agentic Engineering của mình .
AMD Instinct Coder được định vị như một giải pháp thay thế được quản trị, tại chỗ cho các trợ lý mã nguồn thuần đám mây, cân bằng giữa năng lực, chi phí và khả năng kiểm soát cho các doanh nghiệp không thể hoặc không muốn gửi mã nguồn độc quyền của mình cho các bên thứ ba.