De första testresultaten, publicerade den 17 juli 2026, omfattade 11 mobila enheter: nio smarttelefoner och två surfplattor. L3 är den högsta nivå som i dag har tydliga och testbara krav, men standarden beskriver även en framtida L4 nivå för samarbete mellan agenter, enheter och tjänster.
Research answer

Create a landscape editorial hero image for this Studio Global article: What is China’s MIIT national AI-terminal intelligence grading standard, what does the first July 2026 batch of 11 certified devices—includi. Article summary: China’s AI-terminal grading system is a voluntary capability benchmark, not a phone-approval regime. The July 2026 L3 results show that some specific devices can act as bounded, user-supervised agents—not that they are a. Topic tags: general, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clic
Kinas nya system för att gradera AI-terminaler bör ses som ett kapacitetstest av kompletta enheter – inte som en skala för självkörande telefoner. De första resultaten, som publicerades den 17 juli 2026, omfattade 11 mobila terminaler på L3: nio smarttelefoner och två surfplattor. Det visar att de aktuella modell- och mjukvarukonfigurationerna klarar att ge avancerad, men avgränsad och användarövervakad hjälp. Det visar däremot inte att telefonerna kan agera utan tillsyn i alla appar och tjänster. 2
5
Regelverket heter GB/Z 177—2026, Intelligence Grading of Artificial Intelligence Terminals. Beteckningen ”GB/Z” anger ett nationellt standardiseringsdokument med vägledande karaktär. Systemet ska alltså skapa en gemensam metod för att bedöma AI-förmåga – inte införa ett obligatoriskt krav för att få sälja en telefon. 1
5
6
Bedömningen gäller terminalen som helhet. Det innebär bland annat modellen, operativsystemet, app- och verktygsgränssnitten, minnet, behörigheterna samt samspelet mellan lokal och molnbaserad behandling. Det är alltså inte bara språkmodellens storlek eller kvalitet i en chatt som bedöms. 5
19
Standarden delar in förmågan i fem huvudområden:
De fem områdena delas i sin tur upp i 14 delkompetenser, bland annat användarförståelse, uppgiftsplanering, verktygsanrop, korttids- och långtidsminne samt situationsanpassning. 19
De fyra nivåerna beskriver en utveckling från att reagera på tydliga instruktioner till att samordna arbete över flera system. L1–L3 har definierade krav, medan L4 nämns i ramverket men ännu inte är fullt specificerad. 5
21
25
| Nivå | Vad det betyder i praktiken |
|---|---|
| L1 – respons | Förstår en tydlig instruktion och utför en enkel, oftast enstegsbaserad åtgärd – till exempel öppnar en funktion eller ställer in en påminnelse. |
| L2 – verktyg | Förstår en enklare avsikt, gör begränsade slutledningar och följer fördefinierade verktyg eller arbetsflöden för avgränsade uppgifter i flera steg. Nivån liknar en kapabel chattbot eller appassistent mer än en fristående agent. |
| L3 – assistans | Förstår ett bredare mål, frågar efter information som saknas, delar upp arbetet, väljer och samordnar verktyg, hanterar flera medieformat och använder korttids- och långtidsminne. |
| L4 – samverkan | Är tänkt att samordna agenter, enheter och tjänster, men detaljerade krav och testmetoder håller fortfarande på att utvecklas. |
Den viktiga skillnaden är alltså inte att en L3-telefon ”tänker som en människa”. Skillnaden är att den kan koppla ihop förståelse, planering, verktygsanvändning, minne och handling i ett mer komplett arbetsflöde. 5
19
Julitestet omfattade nio smarttelefoner från Huawei, Motorola, Honor, vivo, OPPO, Xiaomi och Stepfun samt två surfplattor. 2
3
5
Den försiktiga slutsatsen är att de inskickade enhetskonfigurationerna uppfyllde de aktuella kraven för L3. Resultatet betyder inte att:
Den första omgången byggde på produkter som tillverkarna själva skickade in, inte på ett slumpmässigt urval av marknaden. L3 är därför ett betyg för en specifik produkt och konfiguration – inte en generell intelligensranking av ett helt varumärke. 5
6
Att kalla resultatet för en ”nationell L3-certifiering” kan ge fel bild. Eftersom GB/Z 177—2026 är ett vägledande tekniskt dokument är ett L3-resultat inte ett myndighetstillstånd som krävs innan en telefon får säljas. Det fungerar i stället som ett gemensamt branschmått för förmåga och utvärdering. 1
6
Märkningen ska inte heller tolkas som ett bevis på obegränsad autonomi. L3 bedömer om en terminal kan ge avancerad hjälp under definierade förhållanden. Den ger inte telefonen fri tillgång till personuppgifter, konton, betalningar eller alla tredjepartsappar. Användaren är fortfarande en del av kontrollkedjan, särskilt när det handlar om känsliga eller oåterkalleliga åtgärder. 5
19
L3 är dessutom den högsta nivå som i dag har tydliga krav och praktiska testmetoder – inte den högsta tänkbara nivån. L4 finns redan som koncept i standarden, men de konkreta kraven ska utvecklas vidare. 5
7
En L2-assistent kan exempelvis svara på väderfrågan ”Hur blir vädret i Hangzhou?”, söka information eller skapa ett reseförslag genom ett förutbestämt arbetsflöde. Samtalet och uppgiften stannar vanligtvis inom en begränsad verktygskedja eller den aktuella sessionen. 5
19
En L3-telefon är i stället tänkt att förstå det övergripande målet bakom en begäran. Om användaren säger ”planera en helgresa” kan telefonen exempelvis:
Det sista steget är centralt. L3 innebär delegerad hjälp under uppsikt – inte obegränsad beslutanderätt. Agenten kan förbereda en betalning eller hotellbokning, men den slutliga kontrollen bör återgå till användaren när pengar, känsliga data eller bindande beslut berörs. 5
L4 handlar inte bara om en kraftfullare version av L3. Den stora utmaningen är samordning mellan självständiga agenter, enheter och tjänster. Ett fungerande L4-test skulle behöva tydliga regler för bland annat:
Här berörs flera aktörer samtidigt: telefontillverkaren, operativsystemet, appen, tjänsteleverantören, modellleverantören och användaren. Innan dessa relationer kan uttryckas som säkra och upprepningsbara testfall är det svårt att fastställa en detaljerad L4-metod. Nästa stora steg kan därför lika mycket handla om interoperabilitet, behörigheter och ansvar som om snabbare kretsar eller större modeller. 5
7
De gemensamma L1–L4-beteckningarna är lätta att misstolka. Inom bilindustrin handlar nivåerna om ansvar för den dynamiska körningen: vem övervakar bilen och när måste en människa ta över? AI-terminalstandarden bedömer i stället funktioner som perception, avsiktsförståelse, resonemang, verktygsanvändning, minne och lärande. 5
En L3-telefon är därför inte jämförbar med en villkorligt självkörande bil. Inte heller skulle en framtida L4-telefon automatiskt innebära en enhet som säkert kan fatta alla konsekvensfyllda beslut utan mänsklig bekräftelse. 5
Huawei Pura X Max och Motorolas Lenovo-kopplade modeller är exempel på produkter som förknippas med de första L3-resultaten. Men märkningen bör inte vara det enda köpkravet. 2
5
En telefons praktiska agentfunktioner kan bero på uppdateringar av operativsystemet, tillgång till assistent och modell, appintegrationer, behörigheter och molnanslutning. Därför kan användbara L3-liknande funktioner komma genom mjukvara – ett nytt hårdvaruköp är inte automatiskt nödvändigt. Nyare hårdvara kan däremot förbättra exempelvis hastighet, integritet och batteritid. 5
Innan du låter en L3-märkning avgöra köpet är det klokt att kontrollera:
Den tydligaste slutsatsen från julitestet är att AI-mobiler håller på att bli mätbara som system som utför uppgifter. Men L3 är ett benchmark för övervakad assistans i specifika konfigurationer – inte ett löfte om autonomt agerande, inte ett obligatoriskt godkännande för marknaden och inte slutpunkten för terminalernas intelligens. 1
5
7
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
De första testresultaten, publicerade den 17 juli 2026, omfattade 11 mobila enheter: nio smarttelefoner och två surfplattor.
De första testresultaten, publicerade den 17 juli 2026, omfattade 11 mobila enheter: nio smarttelefoner och två surfplattor. L3 är den högsta nivå som i dag har tydliga och testbara krav, men standarden beskriver även en framtida L4 nivå för samarbete mellan agenter, enheter och tjänster.