I OpenRouters opgørelse for 20.–26. juli behandlede Xiaomi MiMo V2.5 ifølge rapporter omkring 10,5 billioner tokens på en uge og førte en top fem med kinesiske modeller.
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Xiaomi’s MiMo‑V2.5 become the world’s most-used LLM by token volume by July 2026—reaching 10.5 trillion weekly and 31.2 trillion mon. Article summary: MiMo‑V2.5’s rise appears to be a distribution-and-economics win as much as a model-quality win: Xiaomi paired agent-oriented, native multimodal capability and a 1M-token context window with aggressively accessible API ac. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
OpenRouters rangliste for juli 2026 gav et markant billede af efterspørgslen på sprogmodeller i praksis: Xiaomis MiMo-V2.5 lå ifølge rapporter øverst med omkring 10,5 billioner tokens i ugen 20.–26. juli, mens kinesiskudviklede modeller besatte alle fem topplaceringer. MiMos fremgang skyldtes sandsynligvis ikke ét enkelt teknologisk gennembrud, men en kombination af agentfunktioner, tilgængelig implementering og en økonomi, der passer til store datamængder. 8
15
Overskriften handler om tokens, der er ruteet gennem OpenRouter – en platform, som giver adgang til flere modeller – og ikke om et komplet regnskab over al brug af sprogmodeller på verdensplan. De rapporterede tal for juli placerede MiMo på cirka 10,5 billioner ugentlige tokens og 31,2 billioner månedlige tokens. En opgørelse beregnede væksten fra 1,46 billioner tokens om ugen i maj til 10,46 billioner i juli til omtrent 616 %. 15
Det er relevante tal, fordi de viser, hvilke modeller udviklere valgte på en stor routingplatform. Men tokens er ikke det samme som API-kald, antal brugere, omsætning eller hvor forretningskritisk en løsning er. En model, der bruges til lange dokumenter eller flertrins-agenter, kan eksempelvis generere langt flere tokens pr. opgave end en model, der blot besvarer korte chatspørgsmål.
Den ofte citerede fordeling på 63,5 % til kinesiske modeller mod 35,5 % til amerikanske er også et platformspecifikt øjebliksbillede: Det dækker OpenRouter i en 28-dages periode frem til 26. juli. Det bør ikke beskrives som en optælling af al global AI-inference. 15
Xiaomi positionerede MiMo-V2.5 omkring agentbaserede funktioner og multimodal forståelse. Ifølge virksomheden understøtter modellen indbygget forståelse af billeder og lyd samt op til 1 million tokens i kontekst. 16
Det er særligt relevant for blandt andet softwareagenter, dokumenttung research, medieanalyse og assistenter, der bruger eksterne værktøjer. Sådanne systemer kan gentagne gange læse kontekst, planlægge næste skridt, kalde et værktøj, undersøge resultatet og justere svaret. Det er arbejdsgange, der naturligt bruger mange tokens.
MiMo gik i offentlig test 23. april 2026 og blev indledningsvis tilbudt gratis i en begrænset periode. 3 Hurtig adgang kan være lige så vigtig som benchmarkresultater: Udviklere kan afprøve modellen i rigtige applikationer, ændre deres routing og opskalere uden et langt indkøbsforløb.
Når flere modeller lever op til et teams kvalitetskrav, bliver de afgørende spørgsmål ofte praktiske: Hvad koster en færdig opgave? Kan tjenesten håndtere belastningen? Passer den ind i den eksisterende tekniske platform? Og kan virksomheden selv styre implementeringen?
Xiaomi markedsførte specifikt tokenplaner og token-effektivitet for MiMo-familien. 1 Senere udgav virksomheden V2.5-serien under den tilladende MIT-licens, som giver mulighed for kommerciel inference, videre træning og finjustering uden yderligere godkendelse.
2
Åbne modelvægte garanterer ikke udbredelse, men de giver kunder flere muligheder. Et team kan bruge en hostet API, selv køre modellen, finjustere den eller bevare en alternativ implementeringsvej. Det kan være særligt værdifuldt i løsninger med høj volumen, hvor pris pr. opgave og afhængighed af én leverandør hurtigt får stor betydning.
For perioden 20.–26. juli placerede rapporter baseret på OpenRouter-data MiMo-V2.5 som nummer ét, efterfulgt af DeepSeek V4 Flash, Tencent HY3, Zhipu GLM-5.2 og DeepSeek V4 Pro. 8 Andre rapporter fra juli beskrev ligeledes kinesiskudviklede modeller som ansvarlige for mere end 60 % af den ruteede trafik på platformen.
19
26
Den praktiske konklusion er ikke, at kinesiske modeller endeligt har overgået alle amerikanske modeller på ethvert mål. Ranglisten viser snarere, at konkurrencen om anvendelse i inference-laget er blevet langt mere åben. Modeller, der er gode nok, billige at køre og lette at integrere, kan tiltrække enorme produktionsvolumener, selv om diskussionen om førerskab blandt de allermest avancerede modeller fortsætter.
Der er også tegn på efterspørgsel på tværs af landegrænser. CNBC rapporterede, at amerikanske virksomheders andel af OpenRouter-tokens brugt på kinesiske modeller havde ligget over 30 % hver uge siden 8. februar og på et tidspunkt nået 46 %. 23 Det gør det sværere at forklare udviklingen som et rent hjemmemarkedsfænomen.
MiMos korte periode i front illustrerer en vigtig skelnen i AI-markedet:
I den sidste konkurrence belønnes et bredere sæt egenskaber: forholdet mellem pris og ydelse, kontekstkapacitet, multimodale input, integrationsmuligheder og kommercielle vilkår. MiMo samlede flere af disse egenskaber, mens Kinas modeløkosystem leverede flere alternativer til de samme udvikleropgaver.
Det fjerner ikke USA's styrke inden for lukkede topmodeller, og tokenvolumen måler hverken sikkerhed, driftssikkerhed, lønsomhed eller betydning i store virksomheder. Men det viser, at tyngdepunktet for ruteet inference med høj volumen kan flytte sig hurtigt, når kompetente modeller tilbydes på attraktive pris- og implementeringsvilkår.
MiMo-V2.5's placering i juli bør først og fremmest læses som en milepæl for distribution og økonomi. De rapporterede 10,5 billioner ugentlige tokens afspejlede et tilbud målrettet agent- og multimodale opgaver, med et kontekstvindue på 1 million tokens, hurtig offentlig adgang og senere en åben kommerciel licens. 2
8
16
Den kinesiske top fem er derfor bedst forstået som tegn på, at den faktiske anvendelse af sprogmodeller i stigende grad belønner systemer, der kan implementeres fleksibelt og drives omkostningsbevidst – ikke som et bevis på, at ét land har afgjort det bredere kapløb om AI-førerskab.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
I OpenRouters opgørelse for 20.–26. juli behandlede Xiaomi MiMo V2.5 ifølge rapporter omkring 10,5 billioner tokens på en uge og førte en top fem med kinesiske modeller.
I OpenRouters opgørelse for 20.–26. juli behandlede Xiaomi MiMo V2.5 ifølge rapporter omkring 10,5 billioner tokens på en uge og førte en top fem med kinesiske modeller. MiMo kombinerede et kontekstvindue på op til 1 million tokens samt indbygget forståelse af billeder og lyd med offentlig API adgang, tokenplaner og senere MIT licenserede åbne modelvægte.
Tokenvolumen påvirkes af pris, lange kontekster og agentforløb. Det er derfor ikke det samme som omsætning, antal brugere, sikkerhed eller førerskab i frontlinjeforskning.