התזה שעומדת מאחורי העדכון הדרמטי הזה היא פשוטה: מהפכת ה-AI עוברת מאימון (training) להסקת מסקנות (inference), ועומסי העבודה של העתיד - מערכות AI אוטונומיות ורבות-שלבים - דורשות הרבה יותר כוח עיבוד CPU ממה שהתעשייה ציפתה .
עומסי עבודה של AI סוכני צפויים להוות כשני שלישים משוק שרתי ה-CPU של 220 מיליארד דולר עד 2030 . מערכות אלו מבצעות משימות מורכבות באופן אוטונומי, ומסתמכות במידה רבה על CPU לטיפול בנתונים ותיאום לצד ביצוע מודלים מבוססי GPU .
הסקת מסקנות הפכה למקרה השימוש הדומיננטי ב-AI. בשנת 2026, לראשונה, עומסי ההסקה צורכים כ-60% מקיבולת המחשוב העולמית בתחום ה-AI, ועוקפים את האימון . המעבר הזה מעדיף ארכיטקטורות מבוססות CPU מכיוון שהגשת מודלים בקנה מידה גדול דורשת כמויות עצומות של שרתי CPU מארחים, שרתי inference ותשתית תומכת .
AMD גם רואה את שוק המחשוב והעיבוד המותאם הגבוה (high-performance and adaptive computing) כולו מגיע ל-2 טריליון דולר עד 2030, לעומת 365 מיליארד דולר ב-2025 . שוק הסיליקון למרכזי נתונים לבדו צפוי לעלות על טריליון דולר .
הוכרזה בכנס Advancing AI 2026 ב-23 ביולי 2026, Helios היא מערכת ה-AI המשולבת הראשונה של AMD במתלה שלם עם קירור נוזלי, הכוללת 72 GPU מסוג Instinct MI455X, CPUs מסוג EPYC Venice ורשתות Pensando . היא בייצור מלא החל מיולי 2026, עם משלוחים לשותפים עד סוף הרבעון השלישי (ספטמבר 2026) והרחבת כמויות ברבעון הרביעי .
המתלה מספק עד 2.9 אקסהפלופס של תפוקת inference ב-FP4 ו-1.4 אקסהפלופס של תפוקת אימון ב-FP8, עם רוחב פס interconnect של 260 TB/s . המחיר המוערך למתלה Helios מלא הוא כ-5.25 מיליון דולר .
בנוי על תהליך N2 (2nm) של TSMC, Venice כולל עד 256 ליבות לשקע על ידי אריזה של 32 ליבות Zen 6c על כל אחד מ-8 קוביות ה-chiplet . ייצור המוני החל במתקן TSMC בטייוואן במאי 2026, עם ייצור עתידי מתוכנן במתקן TSMC באריזונה (אך כמויות משמעותיות לא צפויות שם לפני 2028) .
Venice נמצא כרגע בדגימה אצל לקוחות ויימסר במתלות Helios כמו גם בשרתים עצמאיים מאוחר יותר ב-2026 ובתחילת 2027 . גרסת EPYC 9006 SP7, המיועדת לביצועי sandbox עתירי צפיפות, מתוכננת להישלח ברבעון הרביעי של 2026 .
AMD הבטיחה התחייבויות משמעותיות משלוש חברות ה-AI המובילות, בהיקף מצטבר של כ-14 ג'יגה-ואט של קיבולת מחשוב :
| לקוח | התחייבות | פרטים |
|---|---|---|
| OpenAI | ~6 GW | עסקה הוכרזה באוקטובר 2025. כ-10% ממניות AMD הונפקו כאופציות ביצועים. OpenAI צפויה להעלות את Helios לאינטרנט החל ברבעון הרביעי של 2026 . |
| Meta | ~6 GW | עסקה הוכרזה בפברואר 2026. כוללת שבבים מותאמים אישית מסדרת MI450 וארכיטקטורת מתלה Helios שפותחה במשותף באמצעות פרויקט Open Compute. Meta עדיין מאמתת פלטפורמות EPYC . |
| Anthropic | עד 2 GW | עסקה הוכרזה ביולי 2026. AMD התחייבה להשקעה אסטרטגית של עד 5 מיליארד דולר. הג'יגה-ואט הראשון של קיבולת GPU מסדרת MI450 צפוי להישלח במחצית הראשונה של 2027 . |
לקוחות נוספים כוללים את מיקרוסופט (פורסת מתלי Helios במרכזי הנתונים של Azure) ו- אורקל (בונה סופרקלאסטר Helios עם 50,000 GPUs) .
ערימת התוכנה ROCm של AMD עשתה התקדמות ניכרת אך עדיין מפגרת אחרי CUDA של Nvidia בתחומים מרכזיים:
מה שעובד:
פערים שנותרו:
בשורה התחתונה: ROCm הוא כעת בר-ייצור עבור inference ו-תחרותי בעלות לטוקן (מדווח כזול ב-25-40% מ-Nvidia בעבור עומסי inference על חומרה מקבילה), אך CUDA שומרת על יתרון משמעותי בכלים, תהליכי training ורוחב התמיכה במסגרות .
תוצאות הרבעון השני של AMD תומכות היטב בכיוון האסטרטגי של החברה:
| מדד | רבעון 2, 2026 | שינוי לעומת אשתקד |
|---|---|---|
| הכנסות כוללות | 11.5 מיליארד דולר | שיא |
| הכנסות ממרכזי נתונים | 6.7 מיליארד דולר | יותר מהכפלה |
| מרכזי נתונים כאחוז מסך ההכנסות | ~58% | לעומת 42% לפני שנה |
| צמיחת הכנסות שרתי CPU | מעל 70% | מונעת מ-inference/AI סוכני |
ההנהלה ציינה בשיחת המשקיעים כי "inference ו-AI סוכני מגדילים את הצורך במחשוב שרתי CPU" כמניע המבני מאחורי העלאת ה-TAM . AMD מצפה שהכנסות ה-AI ממרכזי נתונים יגיעו ל"עשרות מיליארדי דולרים" עד 2027, כאשר הכנסות שרתי CPU בלבד צפויות לצמוח ביותר מ-70% ב-2027 .
מגמת הרווח הגולמי: כשAMD עוברת ממכירת שבבים בודדים למערכות מתלה משולבות כמו Helios - האורזות GPUs, CPUs ורשתות בחבילה אחת - המרווחים הממוצעים עלולים לעמוד בפני אתגרים בהשוואה למכירת שבבים טהורים. השוק עוקב אחר האם AMD תוכל לשמור על התרחבות המרווחים כשהיא הופכת לספקית מערכות בדומה ל-Nvidia.
ריכוזיות שרשרת האספקה ב-TSMC: AMD מסתמכת על TSMC גם לייצור CPU (N2) וגם לייצור GPU (N3/N4) החדשניים . Venice עולה לייצור ב-TSMC טייוואן, ולפי AMD תוכנן ייצור עתידי במתקן TSMC באריזונה, אך קיבולת זו אינה מקוונת עדיין עבור קווי הייצור החדשניים . מתחים גיאו-פוליטיים סביב טייוואן ותחרות על הקצאת רקיקי TSMC מול אפל, Nvidia ואחרות נותרים סיכונים חומריים בטווח הקרוב, במיוחד כשAMD מתכננת לשלוח את Helios בקנה מידה של ג'יגה-ואט החל מסוף 2026.
AMD מבצעת אסטרטגיה שאפתנית וברורה הנשענת על נקודת מפנה בעומסי העבודה של AI - מאימון להסקה, ממודלים מבודדים לסוכנים אוטונומיים. מפת הדרכים החומרתית (Helios ו-Venice) נמצאת בייצור, הלקוחות הגדולים מחויבים בקנה מידה חסר תקדים, והתוצאות הפיננסיות משקפות את השינוי. השאלות הפתוחות המרכזיות הן האם ROCm תצליח לסגור את הפער מול CUDA במהירות מספקת והאם אילוצי שרשרת האספקה יאפשרו ל-AMD לעמוד בלוח הזמנים האגרסיבי שלה.