Nvidias huvudbudskap är att AI fabriker bör bedömas efter verifierade agentiska token per megawatt, snarare än enbart maximal beräkningskapacitet. Lambda rapporterade 24 procent högre tokenflöde och 23 procent bättre prestanda per watt med DSX MaxLPS på Blackwell baserade system.
Publicerad avRedigerad med GPT-5.6 TerraBilder genererade med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Nvidia present on the opening day of its AI Infra Summit about transforming AI factories from systems optimized primarily for raw p. Article summary: Nvidia’s opening-day message was that an AI factory should be measured not only by peak compute, but by validated agentic tokens produced per megawatt—requiring integrated design across silicon, systems, networking, soft. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Tillgången på el blir i allt högre grad flaskhalsen för AI-infrastruktur – inte bara hur många acceleratorer som ryms i ett rack. När Nvidia öppnade AI Infra Summit 2026 argumenterade bolaget för ett nytt nyckeltal för AI-fabriker: agentiska token per megawatt. Med andra ord: hur mycket användbart inferensarbete en anläggning faktiskt kan leverera inom sin tillgängliga eleffekt. 2
3
Ian Buck, Nvidias vice vd för hyperscale och högpresterande datorsystem, presenterade inriktningen vid evenemanget i Santa Clara. Budskapet sträckte sig långt bortom GPU-prestanda. För att en AI-fabrik ska fortsätta vara produktiv när elkapaciteten sätter gränser krävs samspel mellan beräkning, nätverk, inferensprogramvara, kylning, effektstyrning och drift mot elnätet. 1
2
3
Det mest konkreta resultatet kom från AI-molnleverantören Lambda, som genomfört den första valideringen av Nvidias DSX MaxLPS i en driftsmiljö på HGX B200-servrar. Enligt Nvidia övervakar DSX MaxLPS effektförbrukningen på GPU- och racknivå och omfördelar tillgänglig effektmarginal mellan noder. 2
3
I det redovisade klustret, med fem rack och 19 noder, körde Lambda 19 noder inom en effektbudget som normalt räcker för 16 noder på full effekt. Det gav enligt uppgifterna 24 procent högre tokenflöde för klustret – från ungefär 4 till 5 miljoner token per sekund – och 23 procent bättre prestanda per watt. 2
3
Poängen är praktisk, inte bara teoretisk. Datacenter begränsas ofta av den eleffekt som faktiskt kan levereras till anläggningen. När arbetslaster har varierande effektprofiler kan programvara som utnyttjar outnyttjat effektutrymme öka den användbara produktionen utan ny elanslutning eller större effektbudget för anläggningen.
Nvidia beskrev också möjliga vinster för kommande installationer av Vera Rubin NVL72. Bolaget uppger att DSX MaxLPS kan möjliggöra upp till 40 procent mer GPU-kapacitet inom samma elram på anläggningsnivå och upp till 35 procent högre tokenflöde, beroende på förutsättningarna i installationen. 2
3
De siffrorna bör dock tolkas annorlunda än Lambdas resultat. Lambdas mätningar är rapporterade resultat från en driftsmiljö med Blackwell-system, medan siffrorna för Vera Rubin är Nvidias prognoser för en framtida plattform. 2
3
Det andra huvudtemat var flexibilitet: en AI-fabrik ska kunna reagera på elnätets förutsättningar utan att behandla varje arbetslast som lika tidskritisk.
Vid Nvidias AI-fabrik Eos användes Emerald AIs Conductor-plattform tillsammans med elbolaget Silicon Valley Power i ett kommersiellt program för flexibel belastning. Nvidia uppgav att systemet svarade på över 200 efterfrågesignaler från elnätet och vid ett demonstrerat tillfälle minskade anläggningens förbrukning från 4 MW till 3 MW på mindre än en minut. Det skedde genom att nedprioritera flexibel beräkning, medan inferens med högre prioritet kunde fortsätta. 2
3
Nvidia beskrev programmet som ett tidigt exempel på den funktionalitet som planeras för DSX Flex. Bolaget säger att DSX Flex ska kunna ta emot signaler om lastneddragning, efterfrågeflexibilitet och elpriser, och därefter styra arbetslaster efter prioritet. Uppskjutbara jobb ska kunna pausas och återupptas, medan kritiska tjänster hålls i gång. Demonstrationen vid Eos var däremot ett tidigare kommersiellt bevis på konceptet, inte en DSX Flex-installation. 2
3
För operatörer med begränsningar från elnätsbolag är skillnaden viktig. Modellträning, batchkörningar och offlinebearbetning behöver inte alltid samma svarstid som inferens i en produktionstjänst. Om beräkningskapacitet kan behandlas som en flexibel last kan anläggningen delta i nätprogram utan att äventyra de mest värdefulla arbetslasterna.
Topmötets presentationer positionerade Nvidia mindre som en ren komponentleverantör och mer som plattformsleverantör för AI-fabriker. Den föreslagna teknikstacken omfattar Vera Rubin-beräkning, NVLink-nätverk för uppskalning, inferensprogramvaran Dynamo, Ethernet- och SuperNIC-nätverk, BlueField-komponenter för infrastrukturen, effektoptimering på racknivå och elnätsmedveten drift av arbetslaster. 2
Groq 3 LPX ingick i den bredare positioneringen. Nvidia beskriver den som en interaktiv inferensaccelerator för Vera Rubin, avsedd för agentiska system med krav på låg fördröjning och stora kontextfönster. 1
12 Underlaget här stöder den rollen, men styrker inte självständigt mer specifika påståenden om lanseringstidpunkt, en jämförelse med 35 gånger högre genomströmning per megawatt eller prestanda för modeller med fler än två biljoner parametrar.
Budskapet kommer samtidigt som Nvidias datacenterverksamhet fortsätter att växa. Under det andra kvartalet i räkenskapsåret 2027, som avslutades den 26 juli 2026, rapporterade Nvidia en omsättning på 96,2 miljarder dollar, 106 procent högre än året före. Datacenterintäkterna uppgick till 89,0 miljarder dollar. 17 Bolagets prognos för tredje kvartalet var 108 miljarder dollar, plus eller minus 2 procent.
28
30
Det ger ett affärsmässigt sammanhang till betoningen på drift i fabriksskala. När kunder bygger ut sin AI-kapacitet handlar de centrala frågorna allt mer om att säkra el, höja produktionen inom fasta effektgränser och hålla inferenstjänster i gång vid störningar i elförsörjning och drift.
Nvidias budskap var inte att rå GPU-prestanda har blivit oviktig. Däremot räcker toppeffekt inte längre som enda mått på ekonomin i en AI-fabrik.
Bolagets föreslagna mått – verifierade token per megawatt – kopplar ihop hårdvarans prestanda med de begränsningar operatörer möter i praktiken: tillgänglig eleffekt, händelser i elnätet, arbetslastprioriteringar och systemens tillgänglighet. Lambdas rapporterade ökning på 24 procent är en tidig datapunkt från en driftsmiljö som stödjer tesen. Nvidias vidare löften för Vera Rubin och DSX är fortfarande en färdplan som behöver bekräftas i kundernas egna installationer. 2
3
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Nvidias huvudbudskap är att AI fabriker bör bedömas efter verifierade agentiska token per megawatt, snarare än enbart maximal beräkningskapacitet.
Nvidias huvudbudskap är att AI fabriker bör bedömas efter verifierade agentiska token per megawatt, snarare än enbart maximal beräkningskapacitet. Lambda rapporterade 24 procent högre tokenflöde och 23 procent bättre prestanda per watt med DSX MaxLPS på Blackwell baserade system.
Nvidia kopplar ihop effektoptimering i racket med arbetslaststyrning som kan reagera på signaler från elnätet utan att stoppa prioriterad inferens.