Een assistent die een vraag beantwoordt is iets anders dan een assistent die daarna ook apps bedient. Voor dat tweede doel presenteerde Alibaba op de Apsara-conferentie van 2026 Qwen Intelligence: een softwareplatform met voor smartphones aangepaste Qwen-modellen, een omgeving om AI-agents aan te sturen en agents voor concrete taken. Het is bedoeld voor telefoonfabrikanten, niet als aankondiging van een Alibaba-telefoon. Honor is de eerste aangekondigde fabrikant die het platform formeel gaat toepassen.
13
19
45
Drie agents, drie taken
- Mobile Planner Agent plant. Deze agent zet een verzoek met meerdere stappen om in deeltaken, kiest hulpmiddelen en past het plan zo nodig aan. Volgens Alibaba verzorgt het model het begrip en de beslissingen, terwijl een zogeheten harness de voortgang, het geheugen en de beschikbare vaardigheden bijhoudt. Daardoor kan een taak over meerdere handelingen heen worden gevolgd.
12
43
- Mobile-Use Agent voert uit. Deze agent is bedoeld om handelingen in apps te verrichten. Als er een geschikte programmeerinterface of directe applink beschikbaar is, gebruikt hij die bij voorkeur. Anders kan hij het scherm interpreteren en de grafische bediening gebruiken. Hij moet dus meer doen dan alleen uitleggen waar de gebruiker moet tikken.
12
45
- Mobile Creative Agent maakt en bewerkt beelden. Dit is een lichter model dat voor telefoons is geoptimaliseerd. Het heeft een andere rol dan de agents die een taak plannen of stappen tussen apps uitvoeren.
7
39
Wat doet de ‘harness’?
Een harness is de uitvoeringsomgeving rond een AI-agent: die bewaart de context en koppelt beslissingen van het model aan hulpmiddelen en handelingen. Berichten over Qwen Intelligence beschrijven zo’n onderdeel binnen Alibaba’s modulaire platform. Honor heeft daarnaast een eigen systeemlaag, de Agent Harness in MagicOS 11, die waarnemen, plannen, hulpmiddelen aanroepen en uitvoeren op elkaar afstemt. Die twee lagen horen bij de beoogde samenwerking, maar zijn niet hetzelfde product. Qwen vervangt MagicOS niet.
43
48
51
Wat kunnen fabrikanten aanpassen en testen?
Telefoonmakers hoeven niet één vaste Alibaba-ervaring over te nemen. Volgens de berichtgeving kunnen ze onder meer modellen afzonderlijk inzetten, de harness aanpassen, bepalen wat op het toestel en wat via de cloud gebeurt, en eigen hulpmiddelen en vaardigheden toevoegen. Ook platformbeheer en geautomatiseerde evaluatie behoren tot de beschreven opties. Zo kan een fabrikant de software afstemmen op zijn besturingssysteem en de beperkingen van zijn toestellen.
35
51
Zodra een agent zelf apps bedient, worden veiligheidsgrenzen belangrijker. Volgens berichten bevat Mobile-Use voorzieningen voor beveiliging en privacy; bij gevoelige handelingen, zoals betalen of iets verwijderen, gelden beperkingen en blijft de uiteindelijke beslissing bij de gebruiker. Het team achter Qwen Intelligence beschrijft ook vier reeksen evaluatietests: voor complexe planning, uitvoering tussen apps, taken op echte telefoons en veilig handelen in risicovolle situaties. Hoe die bescherming op elk toestel precies wordt ingesteld en in de praktijk werkt, blijkt niet uit de beschikbare berichtgeving.
35
39
45
Honor’s plannen en de betekenis van de cijfers
Honor wil Qwen Intelligence integreren in de Magic9-serie, waarvan de presentatie voor 28 september 2026 gepland staat. Ook de Honor Robot Phone moet ondersteuning krijgen. De bedrijven werken samen aan mobiele toepassingen van Qwen Intelligence en MagicOS: Alibaba levert de mogelijkheden van de basismodellen, Honor de systeemintegratie en gebruiksscenario’s op toestellen. Daarbij stemmen ze de rol van de modellen af op grenzen zoals stroomverbruik, geheugen en reactiesnelheid.
1
42
48
Rond de aankondiging worden vier cijfers genoemd: 91,8% nauwkeurigheid, 3,6 seconden voor een handeling via de grafische interface, ondersteuning voor taken van meer dan 100 stappen en ongeveer 90% voltooiing van taken van begin tot eind. Dit zijn gerapporteerde cijfers, geen onafhankelijk geverifieerde resultaten van uitgebrachte Magic9-telefoons. De aangehaalde berichten laten ook geen gezamenlijke testopzet voor alle vier de maten zien. Eén bericht omschrijft de 91,8% bovendien als een maat voor het begrijpen van de bedoeling van de gebruiker. De precieze definitie telt dus mee bij elke vergelijking.
9
35
46
Een afzonderlijk technisch rapport over Qwen-UI-Agent meldt 92,2% geslaagde taken op MobileWorld-Real, een test op echte toestellen. Dat is een resultaat voor de geteste agent op die benchmark — niet een gemeten slagingspercentage van Honor’s komende telefoons.
33