Tässä ovat keskeiset löydökset Artificial Analysisin AA AgentPerf mittarin ensimmäisistä tuloksista, jotka julkistettiin 12. Mittari on alan ensimmäinen avoin, usean laitetoimittajan vertailu, joka on suunniteltu erityisesti agenttimaiselle tekoälyn päättelylle – ei yksittäisille chat vastauksille.

Create a landscape editorial hero image for this Studio Global article: What did Nvidia achieve in the first published results of Artificial Analysis's AgentPerf benchmark, what does this new benchmark measure, a. Article summary: Here are the key findings from the first published results of Artificial Analysis's **AA-AgentPerf** benchmark, announced on June 12, 2026.. Topic tags: general, documentation, general web, user generated. Reference image context from search candidates: Reference image 1: visual subject "We measure real-world performance of AI accelerator systems during language model inference. ## AA-AgentPerf: The Hardware Benchmark for the Agent Era. AA-AgentPerf has been shaped" source context "AI Hardware Benchmarking & Performance Analysis" Reference image 2: visual subject "For years, co-founder and chief executive officer Jensen Huang and other higher-ups at Nvidia have
Tässä ovat keskeiset löydökset Artificial Analysisin AA-AgentPerf-testin ensimmäisistä julkisista tuloksista, jotka julkistettiin 12. kesäkuuta 2026.
AA-AgentPerf on alan ensimmäinen avoin, monien laitevalmistajien välinen laitteistotesti, joka on suunniteltu erityisesti agenttimaiselle tekoälyn päättelylle – ei yksittäisille chat-keskustelujen vastauksille . Käytännössä se siis testaa tekoälyn kykyä toimia itsenäisenä agenttina, esimerkiksi ohjelmoijana, joka suorittaa monivaiheisia tehtäviä.
Testissä mitataan, kuinka monta samanaikaista tekoälyn koodausagenttia järjestelmä pystyy pyörittämään ja samalla täyttämään tietyt palvelutasotavoitteet (SLO) tulostusnopeudelle (tokenia sekunnissa) ja vasteajalle (aika ensimmäiseen tokeniin, TTFT). Vertailu perustuu todellisiin koodausagenttien toimintahistorioihin, jotka on kerätty julkisista lähdekoodivarastoista yli 12 eri ohjelmointikielellä. Nämä tehtäväketjut yhdistelevät useita kielimallikutsuja, työkalukutsuja (joita simuloidaan realistisilla suorittimen viiveillä) ja jatkuvasti kasvavia konteksti-ikkunoita . Tulokset ilmoitetaan suhteutettuna jokaista laskentakiihdytintä (GPU) ja kulutettua megawattia kohden
.
Nvidian uusi lippulaiva suoriutui testistä poikkeuksellisen vahvasti:
Nämä tulokset ovat osa Nvidian määrätietoista ja monitahoista pyrkimystä asemoida Blackwell Ultra johtavaksi alustaksi laajamittaiseen agenttitekoälyyn:
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
Tässä ovat keskeiset löydökset Artificial Analysisin AA AgentPerf mittarin ensimmäisistä tuloksista, jotka julkistettiin 12.
Tässä ovat keskeiset löydökset Artificial Analysisin AA AgentPerf mittarin ensimmäisistä tuloksista, jotka julkistettiin 12. Mittari on alan ensimmäinen avoin, usean laitetoimittajan vertailu, joka on suunniteltu erityisesti agenttimaiselle tekoälyn päättelylle – ei yksittäisille chat vastauksille.
Se mittaa, kuinka monta samanaikaista tekoälyn koodausagenttia järjestelmä pystyy tukemaan täyttäen tietyt palvelutasotavoitteet (SLA) tulostusnopeudelle ja vasteajalle.