הפלטפורמה פותחה במשותף על ידי AMD, Supermicro ו-Spectro Cloud, והוכרזה ב-5 באוגוסט 2026 בכנס Ai4 2026 בלאס וגאס . הנה כל מה שצריך לדעת עליה: איך היא עובדת, מה היא עולה, ולמי היא מיועדת.
החידוש המרכזי של AMD Instinct Coder הוא ניתוב מודלים חכם מבוסס מדיניות . בקשות קידוד שגרתיות - כמו יצירת קוד, תמצות או שינוי מבנה (refactoring) - מטופלות באופן מקומי על ידי מודל GLM-5.2 של AMD (דגם mixture-of-experts עם 744 מיליארד פרמטרים, מתוכם כ-40 מיליארד מופעלים לכל אסימון) . בקשות מורכבות יותר, שהמודל המקומי לא יכול לטפל בהן, מועברות למודלים מתקדמים בענן כמו OpenAI GPT, Anthropic Claude או Google Gemini . התכנון הזה, של עיבוד בשלבים, הוא המנגנון שעומד מאחורי החיסכון בעלויות .
המערכת היא מכשיר מוכח מראש, משולב במתלה (rack-integrated), שנמכר כיחידת SKU אחת :
| רכיב | מפרט |
|---|---|
| מעבדים (CPUs) | 2x AMD EPYC 9575F (64 ליבות כל אחד, 3.3 GHz) |
| מאיצים גרפיים (GPUs) | 8x AMD Instinct MI325X (256 GB HBM3E כל אחד, רוחב פס שיא של 6 TB/s), זמינים בגרסת קירור אוויר או נוזל |
| רשת | 2x AMD Pensando Pollara 400 Gb/s SmartNICs |
| מארז | Supermicro AS-8126GS-TNMR, מאומת ומשולב במתלה |
המערכת תוכננה כ"מכשיר שמחברים, מפעילים - וזה עובד" .
Spectro Cloud PaletteAI Inference Launchpad היא שכבת התוכנה שהופכת את החומרה לשימושית. היא מספקת :
AMD ו-Spectro Cloud טוענות שהפלטפורמה יכולה להפחית את עלויות אסימוני קידוד ה-AI בעד 70% לעומת שליחת כל הבקשות למודלי ענן . בחומרים של AMD עצמה נטען שתקופת ההחזר על ההשקעה יכולה להיות קצרה כמו חצי שנה . טענות אלו לא אומתו באופן בלתי תלוי, והחיסכון בפועל יהיה תלוי בתמהיל העבודה, דפוסי השימוש במחירי ממשקי ה-API של מודלי הענן .
דן מקנמרה (Dan McNamara), סגן נשיא בכיר ומנהל כללי, חטיבת Compute ו-Enterprise AI ב-AMD:
"ארגונים צריכים שליטה על איפה הקוד מעובד, באילו מודלים משתמשים ומה העלות של השימוש הזה. AMD Instinct Coder משלבת יכולות מחשוב גבוהות של AMD עם מערכת אקולוגית של תוכנה פתוחה וטכנולוגיות של Supermicro ו-Spectro Cloud, ומעניקה ללקוחות דרך פשוטה להריץ יותר עומסי עבודה מקומית, להשתמש במודלים מתקדמים באופן סלקטיבי ולתפעל את התשתית בעצמם."
טנדי פו (Tenry Fu), מייסד שותף ומנכ"ל Spectro Cloud:
"ארגונים לא צריכים לבחור בין היכולות של מודלים מתקדמים לבין הכלכלה והשליטה של עיבוד מקומי."
ויק מליאלה (Vik Malyala), סגן נשיא בכיר, חטיבת AI וארגונים ב-Supermicro:
תפקידה של Supermicro כולל אימות מוקדם, אינטגרציה במתלה והכשרת המערכת, במטרה לצמצם את מורכבות הפריסה ולקצר את הדרך מחומרה שנמסרה להסקה בייצור .
הפלטפורמה נחשפה בכנס Ai4 2026 (4-6 באוגוסט בלאס וגאס) . ההשקה נותנת מענה לכאב אמיתי של ארגונים: ככל שארגונים מרחיבים את השימוש בסוכני קידוד AI בצוותי הפיתוח ובזרימות העבודה האוטומטיות, עלויות האסימונים מזנקות. מאמצת מוקדמת, חברת BMC, כבר פרסה את הפלטפורמה לעבודת Helix Agentic Engineering שלה .
AMD Instinct Coder ממוצבת כאלטרנטיבה מנוהלת ומקומית לכלי סיוע בקידוד מבוססי ענן בלבד, המאזנת בין יכולת, עלות ושליטה עבור ארגונים שלא יכולים או לא רוצים לשלוח קוד מקור קנייני לממשקי API של צד שלישי.