המסר המרכזי של אנבידיה בפסגת AI Infra היה שמפעלי AI צריכים להימדד לפי טוקנים סוכניים מאומתים לכל מגה־ואט, ולא לפי ביצועי שיא בלבד. החברה שילבה אופטימיזציית חשמל ברמת המדף עם ניהול עומסי עבודה שמגיב לאירועי רשת החשמל, כדי לשמר שירותי הסקה בעדיפות גבוהה.
פורסם על ידינערך באמצעות GPT-5.6 Terraהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Nvidia present on the opening day of its AI Infra Summit about transforming AI factories from systems optimized primarily for raw p. Article summary: Nvidia’s opening-day message was that an AI factory should be measured not only by peak compute, but by validated agentic tokens produced per megawatt—requiring integrated design across silicon, systems, networking, soft. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
האתגר המרכזי של תשתיות בינה מלאכותית אינו עוד רק כמה מאיצים אפשר לדחוס למדף שרתים. במקרים רבים, צוואר הבקבוק הוא החשמל הזמין לאתר. ביום הפתיחה של AI Infra Summit 2026, אנבידיה טענה כי המדד החשוב למפעל AI הוא מספר הטוקנים הסוכניים לכל מגה־ואט — כלומר, כמה עבודת הסקה שימושית אפשר להפיק במסגרת תקציב החשמל של המתקן. 2
3
איאן באק, סגן נשיא לארגוני hyperscale ולמחשוב עתיר ביצועים באנבידיה, הציג את האסטרטגיה באירוע שנערך בסנטה קלרה. המסר היה רחב מביצועי GPU: מפעל AI זקוק לתיאום בין מחשוב, רשתות, תוכנת הסקה, קירור, בקרת הספק ותפעול מול רשת החשמל, ככל שהחשמל הופך למשאב מגביל. 1
2
3
הנתון המוחשי ביותר שהוצג הגיע מספקית ענן ה-AI Lambda, שביצעה אימות ראשון בסביבת פריסה ל-DSX MaxLPS של אנבידיה על שרתי HGX B200. לפי אנבידיה, DSX MaxLPS מנטרת את צריכת החשמל של ה-GPUים ושל המדפים, ומקצה מחדש מרווח הספק פנוי בין הצמתים. 2
3
באשכול של חמישה מדפים ו-19 צמתים, Lambda הפעילה 19 צמתים בתקציב חשמל שבדרך כלל היה מספיק ל-16 צמתים בעוצמה מלאה. לפי התוצאות המדווחות, תפוקת הטוקנים של האשכול גדלה ב-24% — מכ-4 מיליון לכ-5 מיליון טוקנים בשנייה — וביצועים לוואט השתפרו ב-23%. 2
3
המשמעות היא תפעולית, לא רק טכנולוגית: קיבולת של מרכזי נתונים מוגבלת לעיתים לפי ההספק שמסופק בפועל לאתר. כאשר לעומסי העבודה יש דפוסי צריכת חשמל משתנים, ניהול של ההספק הפנוי עשוי להגדיל את התפוקה בלי חיבור חשמל חדש ובלי להגדיל את תקציב ההספק של המתקן.
אנבידיה הציגה גם את הפוטנציאל שהיא מייחסת לפריסות עתידיות של Vera Rubin NVL72. לדבריה, DSX MaxLPS עשויה לאפשר עד 40% יותר קיבולת GPU במסגרת אותו תקציב הספק באתר, ועד 35% יותר תפוקת טוקנים, בהתאם לתנאי הפריסה. 2
3
חשוב להבחין בין הנתונים: המדידות של Lambda הן תוצאות מדווחות מסביבת פריסה מבוססת Blackwell; נתוני Vera Rubin הם תחזיות של אנבידיה לפלטפורמה עתידית. 2
3
הנושא המרכזי השני היה גמישות: מפעל AI, לפי אנבידיה, צריך להיות מסוגל להגיב לתנאי רשת החשמל בלי להניח שכל עומס עבודה דחוף באותה מידה.
במפעל ה-AI Eos של אנבידיה, פלטפורמת Conductor של Emerald AI עבדה עם Silicon Valley Power, חברת החשמל העירונית של סנטה קלרה, במסגרת תוכנית מסחרית לעומס גמיש. אנבידיה דיווחה כי המערכת הגיבה ליותר מ-200 אותות ביקוש מחברת החשמל, ובאירוע שהודגם הפחיתה את צריכת המתקן מ-4 מגה־ואט ל-3 מגה־ואט בתוך פחות מדקה. הדבר נעשה באמצעות הורדת העדיפות של עבודות מחשוב גמישות, בעוד הסקה בעדיפות גבוהה המשיכה לפעול. 2
3
אנבידיה הציגה את התוכנית כדוגמה מוקדמת ליכולת שמיועדת ל-DSX Flex. החברה מתארת את DSX Flex כמערכת שתקבל אותות של הפחתת עומס, תגובה לביקוש ומחירי חשמל, ואז תחיל סדרי עדיפויות על עומסי העבודה: משימות שאפשר לדחות ייעצרו ויחודשו, בעוד שירותים קריטיים יישארו פעילים. ההדגמה ב-Eos עצמה הייתה הוכחת היתכנות מסחרית מוקדמת, ולא התקנת DSX Flex. 2
3
עבור מפעילי מרכזי נתונים, ההבחנה הזו חשובה: לא כל אימון מודל, עיבוד אצווה או משימת רקע דורשים זמן תגובה זהה לזה של שירות הסקה פעיל. התייחסות למחשוב כאל עומס גמיש יכולה לאפשר השתתפות בתוכניות של רשת החשמל, תוך הגנה על העומסים בעלי הערך העסקי הגבוה יותר.
ההכרזות בפסגה הציגו את אנבידיה לא רק כספקית רכיבים, אלא כספקית פלטפורמה למפעלי AI. הערימה המוצעת כוללת מחשוב Vera Rubin, קישוריות scale-up באמצעות NVLink, תוכנת ההסקה Dynamo, רשתות Ethernet ו-SuperNIC, רכיבי תשתית BlueField, אופטימיזציית הספק ברמת המדף ותפעול עומסי עבודה שמודע לתנאי רשת החשמל. 2
במסגרת הזו הוצג גם Groq 3 LPX. אנבידיה מתארת אותו כמאיץ הסקה אינטראקטיבי עבור Vera Rubin, המיועד לדרישות השהיה נמוכה והקשר רחב של מערכות סוכניות. 1
12 המקורות שסופקו תומכים בתיאור התפקיד הזה, אך אינם מבססים באופן עצמאי טענות מדויקות יותר לגבי מועד ההשקה, השוואה של פי 35 בתפוקה למגה־ואט או ביצועים במודלים עם יותר משני טריליון פרמטרים.
המסר התשתיתי מגיע בזמן שעסקי מרכזי הנתונים של אנבידיה ממשיכים להתרחב. ברבעון השני של שנת הכספים 2027, שהסתיים ב-26 ביולי 2026, דיווחה אנבידיה על הכנסות של 96.2 מיליארד דולר — עלייה של 106% לעומת השנה הקודמת — ובהן הכנסות של 89.0 מיליארד דולר מפעילות מרכזי הנתונים. 17 תחזית החברה לרבעון השלישי הייתה הכנסות של 108 מיליארד דולר, פלוס או מינוס 2%.
28
30
ההקשר הפיננסי מסביר מדוע אנבידיה מדגישה תפעול בקנה מידה של מפעל. ככל שלקוחות פורסים יותר קיבולת AI, השאלות המעשיות הן איך להשיג חשמל, איך להגדיל תפוקה תחת מגבלות הספק קבועות, ואיך לשמור על זמינות שירותי ההסקה בעת אירועי חשמל ושיבושים תפעוליים.
אנבידיה לא טוענת שביצועי שיא של מאיצים הפסיקו להיות חשובים. הטענה שלה היא שביצועי שיא לבדם כבר אינם מספיקים לכלכלה של מפעל AI.
המדד שהיא מציעה — טוקנים מאומתים לכל מגה־ואט — מחבר בין ביצועי החומרה לבין אילוצי הייצור שאיתם מתמודדים מפעילים: הספק האתר, אירועי רשת החשמל, עדיפות בין עומסי עבודה וזמינות המערכת. העלייה המדווחת של 24% בתפוקה אצל Lambda היא נקודת נתונים ראשונית מפריסה; הטענות הרחבות יותר של אנבידיה לגבי Vera Rubin ו-DSX עדיין מהוות מפת דרכים שתידרש לאימות אצל לקוחות. 2
3
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
המסר המרכזי של אנבידיה בפסגת AI Infra היה שמפעלי AI צריכים להימדד לפי טוקנים סוכניים מאומתים לכל מגה־ואט, ולא לפי ביצועי שיא בלבד.
המסר המרכזי של אנבידיה בפסגת AI Infra היה שמפעלי AI צריכים להימדד לפי טוקנים סוכניים מאומתים לכל מגה־ואט, ולא לפי ביצועי שיא בלבד. החברה שילבה אופטימיזציית חשמל ברמת המדף עם ניהול עומסי עבודה שמגיב לאירועי רשת החשמל, כדי לשמר שירותי הסקה בעדיפות גבוהה.
תוצאות Lambda הן אימות מדווח על מערכות Blackwell, בעוד התחזיות עבור Vera Rubin הן הערכות של אנבידיה שעדיין יצטרכו להיבחן בפריסות לקוחות.