พัฒนาโดยความร่วมมือของ AMD, Supermicro และ Spectro Cloud แพลตฟอร์มนี้เปิดตัวเมื่อวันที่ 5 สิงหาคม 2026 ในงานประชุม Ai4 2026 ที่ลาสเวกัส ต่อไปนี้คือรายละเอียดการทำงาน ต้นทุน และกลุ่มเป้าหมาย
หัวใจสำคัญของ AMD Instinct Coder คือการ จัดเส้นทางโมเดลอย่างชาญฉลาดตามนโยบาย (policy-based, intelligent model routing) คำขอเขียนโค้ดทั่วไป เช่น การสร้างโค้ด สรุป หรือปรับโครงสร้าง จะถูกประมวลผลในพื้นที่ (local) โดยโมเดล GLM-5.2 ที่ปรับแต่งโดย AMD ซึ่งเป็นโมเดลแบบ mixture-of-experts ขนาด 744 พันล้านพารามิเตอร์ (แต่จะเปิดใช้งานประมาณ 4 หมื่นล้านพารามิเตอร์ต่อหนึ่ง Token) ส่วนคำถามที่ซับซ้อนสามารถส่งต่อไปยังโมเดลระดับสูงอื่นๆ เช่น OpenAI GPT, Anthropic Claude หรือ Google Gemini เมื่อโมเดลภายในไม่สามารถจัดการได้ การออกแบบแบบแบ่งชั้นนี้เป็นกลไกสำคัญที่ทำให้สามารถลดต้นทุนได้ตามที่อ้าง
ระบบอ้างอิงเป็นอุปกรณ์ที่ผ่านการรับรองล่วงหน้า ติดตั้งบนแร็ค และจัดส่งเป็นรหัส SKU เดียว :
| ส่วนประกอบ | สเปก |
|---|---|
| ซีพียู | AMD EPYC 9575F จำนวน 2 ตัว (64 คอร์ต่อตัว, 3.3 GHz) |
| จีพียู | AMD Instinct MI325X จำนวน 8 ตัว (หน่วยความจำ HBM3E 256 GB ต่อตัว, แบนด์วิดท์สูงสุด 6 TB/s) มีทั้งแบบระบายความร้อนด้วยอากาศหรือของเหลว |
| ระบบเครือข่าย | AMD Pensando Pollara SmartNICs ความเร็ว 400 Gb/s จำนวน 2 ตัว |
| โครงเครื่อง | Supermicro AS-8126GS-TNMR ผ่านการรับรองและติดตั้งบนแร็คอย่างสมบูรณ์ |
ระบบนี้ถูกออกแบบมาให้เป็นอุปกรณ์ "เสียบปลั๊ก เปิดเครื่อง ก็ใช้งานได้ทันที" โดยจะวางจำหน่ายเป็นรหัส SKU เดียวภายในสิ้นไตรมาสที่เปิดตัว
ซอฟต์แวร์ PaletteAI Inference Launchpad จาก Spectro Cloud คือชั้นซอฟต์แวร์ที่ทำให้ฮาร์ดแวร์มีประโยชน์อย่างเต็มที่ โดยมีหน้าที่ :
AMD และ Spectro Cloud อ้างว่าแพลตฟอร์มนี้ สามารถลดต้นทุน Token สำหรับการเขียนโค้ด AI ได้สูงสุดถึง 70% เมื่อเทียบกับการส่งคำขอทั้งหมดไปยัง API ของโมเดลระดับสูงบนคลาวด์ เอกสารของ AMD เองยังระบุระยะเวลาคืนทุน (payback period) สั้นเพียง 6 เดือน สำหรับเงินลงทุนครั้งแรก ข้ออ้างเหล่านี้ยังไม่ได้รับการยืนยันจากบุคคลที่สาม และผลประหยัดที่เกิดขึ้นจริงจะขึ้นอยู่กับประเภทของงาน ลักษณะการใช้งาน และราคา API ของระบบคลาวด์ของแต่ละองค์กร
แดน แม็คนามารา (Dan McNamara) (SVP & GM, Compute & Enterprise AI, AMD):
"องค์กรต่างๆ ต้องการการควบคุมว่าข้อมูลโค้ดจะถูกประมวลผลที่ไหน ใช้โมเดลใด และมีค่าใช้จ่ายเท่าไร AMD Instinct Coder ผสานรวมพลังการประมวลผลประสิทธิภาพสูงของ AMD เข้ากับระบบนิเวศซอฟต์แวร์แบบเปิดร่วมกับเทคโนโลยีของ Supermicro และ Spectro Cloud ทำให้ลูกค้ามีวิธีที่ง่ายในการทำงานในพื้นที่มากขึ้น ใช้โมเดลระดับสูงอย่างเฉพาะเจาะจง และดำเนินการโครงสร้างพื้นฐานได้ด้วยตนเอง"
เทนรี ฟู (Tenry Fu) (ผู้ร่วมก่อตั้งและซีอีโอ, Spectro Cloud):
"องค์กรไม่ควรต้องเลือกระหว่างความสามารถของโมเดลระดับสูงกับเรื่องเศรษฐศาสตร์และการควบคุมของการประมวลผลในพื้นที่"
วิค มายาลา (Vik Malyala) (SVP, AI and Enterprise, Supermicro):
บทบาทของ Supermicro ครอบคลุมถึงการรับรองล่วงหน้า การประกอบแร็ค และการตรวจสอบคุณภาพระบบ เพื่อลดความซับซ้อนในการปรับใช้และทำให้ระยะเวลาจากการส่งมอบฮาร์ดแวร์จนถึงการประมวลผลจริงสั้นลง
แพลตฟอร์มนี้เปิดตัวครั้งแรกในงาน Ai4 2026 (4-6 สิงหาคม ที่ลาสเวกัส) การเปิดตัวครั้งนี้เป็นการตอบสนองต่อปัญหาสำคัญขององค์กร เมื่อองค์กรต่างๆ ขยายขนาดการใช้งาน AI coding agents ไปทั่วทั้งทีมพัฒนาและเวิร์กโฟลว์อัตโนมัติ ค่าใช้จ่าย Token ก็เพิ่มสูงขึ้นอย่างรวดเร็ว ผู้ใช้งานในระยะแรกอย่าง BMC ได้นำแพลตฟอร์มนี้ไปใช้งานในงาน Helix Agentic Engineering แล้ว
AMD Instinct Coder ถูกวางตำแหน่งให้เป็นทางเลือกแบบ on-premises ที่มีการกำกับดูแลสำหรับผู้ช่วยเขียนโค้ดบนคลาวด์ล้วน โดยสร้างสมดุลระหว่างความสามารถ ต้นทุน และการควบคุมสำหรับองค์กรที่ไม่สามารถหรือไม่ต้องการส่งโค้ดต้นฉบับที่เป็นกรรมสิทธิ์ไปยัง API ของบุคคลที่สาม