Chiedere al telefono di svolgere un’attività che richiede più app è diverso dal chiedergli una risposta. Qwen Intelligence, presentata da Alibaba alla conferenza Apsara 2026, è pensata per il primo caso: mette a disposizione dei produttori modelli Qwen ottimizzati per smartphone, una piattaforma per gli agenti AI e componenti capaci di pianificare ed eseguire operazioni in più passaggi. Alibaba fornisce il software, non sta lanciando un proprio telefono. Honor è il primo produttore ad averne annunciato formalmente l’adozione.
13
19
45
Tre agenti, tre compiti diversi
- Mobile Planner Agent interpreta la richiesta, la suddivide in passaggi, sceglie gli strumenti e può rivedere il piano mentre il lavoro procede. Nella descrizione di Alibaba, il modello prende le decisioni; un harness, cioè l’ambiente software che lo accompagna durante l’esecuzione, conserva lo stato dell’attività, la memoria e le funzioni disponibili.
12
43
- Mobile-Use Agent esegue le operazioni sul telefono, anche passando da un’app all’altra. Privilegia le interfacce di programmazione disponibili, o i collegamenti diretti a una funzione; se non bastano, ricorre alla comprensione visiva e all’interazione con la schermata. Non si limita quindi a suggerire all’utente quali pulsanti premere.
12
45
- Mobile Creative Agent è il componente leggero dedicato alla generazione e alla modifica di immagini sullo smartphone. Non è quello incaricato di coordinare le attività tra app.
7
39
Il ruolo dell’harness e le scelte dei produttori
L’harness collega le decisioni dell’agente agli strumenti e tiene traccia del contesto necessario per continuare un’attività. Le ricostruzioni descrivono un harness nella piattaforma modulare di Alibaba. Honor, separatamente, dichiara di aver realizzato un Agent Harness a livello di sistema in MagicOS 11, per coordinare percezione, pianificazione, chiamate agli strumenti ed esecuzione. Sono livelli collegati nell’integrazione prevista, non un unico componente da attribuire indistintamente alle due aziende: Qwen Intelligence non sostituisce MagicOS.
43
48
51
I produttori possono scegliere come distribuire i modelli, adattare l’harness, ripartire il lavoro tra dispositivo e cloud e aggiungere strumenti e funzioni propri. La piattaforma prevede anche gestione operativa e valutazioni automatizzate. Questa flessibilità serve ad adattare gli agenti al sistema operativo e ai vincoli del telefono.
35
51
Quando un agente passa dal rispondere all’agire nelle app, diventano decisive le autorizzazioni. Secondo le descrizioni disponibili, Mobile-Use prevede limiti di sicurezza e protezioni della privacy; per azioni sensibili, come pagamenti o cancellazioni, la decisione finale resta all’utente. Il team di Qwen Intelligence ha inoltre descritto quattro insiemi di test: pianificazione complessa, esecuzione tra app, attività su telefoni reali e comportamento sicuro in scenari rischiosi. Non è però documentato come tutte queste protezioni saranno configurate o si comporteranno su ciascun modello in vendita.
35
39
45
Perché Honor è il primo banco di prova
Honor prevede di integrare Qwen Intelligence nella serie Magic9, il cui lancio è fissato per il 28 settembre 2026, e di supportarla nell’Honor Robot Phone. Le aziende stanno sviluppando insieme funzioni specifiche per smartphone: Alibaba contribuisce con i modelli di base, Honor con l’integrazione in MagicOS e i casi d’uso sui dispositivi. La ripartizione del lavoro tiene conto anche di consumi, memoria e tempi di risposta.
1
42
48
I resoconti diffusi intorno all’annuncio riportano 91,8% di accuratezza complessiva delle attività, 3,6 secondi per un’operazione nell’interfaccia grafica, attività di oltre 100 passaggi e circa 90% di completamento dall’inizio alla fine per la soluzione congiunta. Sono dati riportati, non risultati verificati in modo indipendente sui Magic9 finiti; le fonti non indicano un protocollo di prova comune per tutte e quattro le misure. Una delle ricostruzioni definisce inoltre il 91,8% una misura di comprensione dell’intento: prima di confrontare le percentuali, occorre capire che cosa misurano.
9
35
46
Un rapporto tecnico distinto su Qwen-UI-Agent registra il 92,2% di successi nel benchmark su dispositivi reali MobileWorld-Real. È un risultato dell’agente sottoposto a quel test, non il tasso di successo misurato sui futuri telefoni Honor.
33