Если попросить телефон выполнить задачу в нескольких приложениях, одного ответа чат-бота недостаточно: нужно составить план, выбрать инструменты и последовательно выполнить действия. Для этого предназначена Qwen Intelligence, представленная Alibaba на конференции Apsara 2026. Это набор программных компонентов на базе моделей Qwen, который компания предлагает производителям смартфонов. Собственный телефон под этим названием Alibaba не выпускает. Первым официально объявленным производителем, который внедрит платформу, стала Honor.
13
19
45
Три агента — три разные задачи
Mobile Planner Agent разбивает запрос на шаги, подбирает инструменты и меняет план по мере выполнения. По описанию Alibaba, модель отвечает за понимание задачи и принятие решений, а вспомогательная программная среда — harness — хранит состояние задачи, память и доступные навыки. Это нужно, чтобы агент не терял контекст после первого действия.
12
43
Mobile-Use Agent выполняет операции на телефоне. Приоритет отдается программным интерфейсам приложений и прямым ссылкам на их функции. Если подходящего способа нет, агент может ориентироваться по изображению экрана и взаимодействовать с графическим интерфейсом. Таким образом, его роль — действовать в приложениях, а не только подсказывать пользователю, куда нажать.
12
45
Mobile Creative Agent предназначен для создания и редактирования изображений. В отличие от двух других агентов, его задача — работа с визуальным контентом, а не планирование или выполнение цепочки действий между приложениями. Он описывается как облегченная модель, оптимизированная для смартфонов.
7
39
Где заканчивается платформа Alibaba и начинается MagicOS
Harness — это программная среда, которая связывает решения модели с инструментами и следит за ходом задачи. Такая среда входит в описание модульной платформы Alibaba. При этом Honor отдельно сообщает о собственной системной архитектуре Agent Harness в MagicOS 11: она координирует восприятие, планирование, вызов инструментов и выполнение действий. Речь о связанных уровнях интеграции, а не об одном компоненте, полностью принадлежащем Alibaba; Qwen Intelligence не заменяет MagicOS.
43
48
51
Производитель может подбирать компоненты под устройство: отдельно развертывать модели, настраивать harness, распределять работу между телефоном и облаком, подключать собственные инструменты и использовать средства эксплуатации и автоматической оценки. Такая гибкость важна, поскольку ресурсы смартфона — в частности, память и энергопотребление — ограничены.
35
51
Безопасность: что заявлено, а что еще предстоит проверить
Когда агент получает возможность действовать в приложениях, особенно важен контроль над чувствительными операциями. Согласно сообщениям о Mobile-Use Agent, для таких действий, как платежи или удаление данных, предусмотрены ограничения, а окончательное решение остается за пользователем. Команда Qwen Intelligence также представила четыре набора испытаний: для сложного планирования, действий между приложениями, задач на реальном телефоне и безопасного поведения в рискованных ситуациях. Как именно эти меры будут настроены и работать на каждом серийном устройстве, опубликованные данные не показывают.
35
39
45
Что известно об Honor и результатах испытаний
Honor планирует встроить Qwen Intelligence в серию Magic9, презентация которой назначена на 28 сентября 2026 года, а также обеспечить поддержку платформы в Honor Robot Phone. Компании совместно адаптируют возможности Qwen к MagicOS: Alibaba предоставляет базовые модели, Honor отвечает за системную интеграцию и сценарии использования на устройстве. При распределении задач между моделями они учитывают энергопотребление, память и задержку ответа.
1
42
48
В публикациях, сопровождавших анонс, приводятся следующие показатели совместного решения: 91,8% точности выполнения задач, 3,6 секунды на операцию через графический интерфейс, задачи длиной свыше 100 шагов и около 90% сквозного завершения задач. Это заявленные результаты, не независимая проверка готовых Magic9; из приведенных материалов также не следует, что все четыре числа получены в одинаковых условиях. В одном из сообщений показатель 91,8% отнесен к пониманию намерения пользователя — еще одна причина уточнять определения метрик перед сравнением.
9
35
46
Отдельный технический отчет Qwen-UI-Agent сообщает об успешном выполнении 92,2% задач в испытании MobileWorld-Real на реальных устройствах. Это результат испытанного агента в конкретном тесте, а не измеренная эффективность будущих смартфонов Honor.
33