Нова Hexagon NPU отримала спеціалізований Element Accelerator для трансформерних моделей, на 50% більшу спільну пам’ять і підтримку контексту до 32 000 токенів. Qualcomm заявляє до 50% швидший етап prefill для моделей INT4.
ОпублікувавВідредаговано за допомогою GPT-5.6 TerraЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Qualcomm reveal on September 9, 2026 about the redesigned Hexagon NPU in its next-generation premium Snapdragon mobile platform—inc. Article summary: Qualcomm’s September 9 preview positioned its next premium Snapdragon platform as an on-device “agentic AI” design, not merely a faster phone chip. The redesigned Hexagon NPU adds dedicated transformer hardware and more . Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Qualcomm показала напрямок розвитку наступної преміальної платформи Snapdragon: смартфон має довше й ефективніше виконувати мультимодальні генеративні ШІ-завдання локально, без постійного звернення до хмари. Центральним елементом цього підходу стала перероблена нейропроцесорна система Hexagon NPU, орієнтована на генеративний ШІ та так званих ШІ-агентів — програми, здатні працювати з контекстом, інструментами й кількома діями в межах одного завдання. 1
Головне нововведення — Element Accelerator, спеціалізований блок для завдань трансформерних моделей. Саме трансформери лежать в основі багатьох мовних і мультимодальних генеративних систем. Новий прискорювач не замінює наявні скалярні, векторні та тензорні обчислювальні блоки, а працює поруч із ними. 1
11
Також Qualcomm повідомила про збільшення спільної пам’яті NPU на 50% порівняно з попередньою архітектурою. Ідея полягає в тому, щоб частіше використовувані дані моделі залишалися ближче до нейропроцесора, без постійного обміну із системною пам’яттю. Це потенційно важливо, коли ШІ-агент опрацьовує довший контекст, залучає інструменти або веде кілька процесів паралельно. Абсолютний обсяг цієї пам’яті компанія поки не назвала. 1
5
За даними Qualcomm, оновлена Hexagon підтримує контекст завдовжки до 32 000 токенів і має прискорення для KV-кешу. Простими словами, більший контекст дає моделі змогу утримувати більше змісту з діалогу, документа або історії виконання завдання під час локальної сесії на пристрої. 11
12
Компанія також заявляє про прискорення prefill до 50% для моделей INT4. Prefill — це початковий етап, коли модель читає та обробляє запит користувача, формуючи робочий контекст перед відповіддю. Тому цей показник не варто автоматично трактувати як обіцянку на 50% швидшої генерації кожного токена в усіх застосунках. Hexagon підтримує формати точності від INT2, INT4 і INT8 до FP8 та FP16. 1
6
Qualcomm наводить приклад підтримки моделей Mixture-of-Experts (MoE) із сумарно до 30 млрд параметрів. Водночас для одного токена в прикладі активується приблизно 3 млрд параметрів. 6
Це принципова різниця. У MoE-моделі механізм маршрутизації обирає лише частину «експертів» — компонентів моделі — для конкретного токена чи завдання. Тож йдеться не про одночасне виконання обчислень для всіх 30 млрд параметрів на кожному токені. Практична можливість запуску залежатиме від конкретної моделі, її реалізації та конфігурації пристрою. 1
13
Анонс Hexagon доповнює раніше розкриті деталі про процесор і графіку наступного Snapdragon. Восьмиядерний CPU Oryon має отримати два Prime-ядра з частотою до 5 ГГц і шість Performance-ядер. Архітектура FlexCache надає різнорідним ядрам доступ до спільного динамічно розподілюваного кешу. 21
22
У графічній частині Qualcomm анонсувала Adreno Matrix Cores та 18 МБ Adreno High Performance Memory. Технологія Neural Fusion об’єднує нейронні обчислення, ШІ-суперроздільність і генерацію кадрів у межах графічного конвеєра. Qualcomm заявляє, що у відповідних сценаріях рендерингу це може знизити енергоспоживання до 40%; це твердження виробника, а не результат незалежного тестування. 17
23
Загальна стратегія Qualcomm — розподіляти локальні ШІ-навантаження між кількома типами обчислювальних блоків:
Тобто Qualcomm не стверджує, що будь-яка ШІ-функція смартфона працюватиме виключно на NPU. CPU, GPU і NPU задумано як взаємодоповнювальні обчислювальні рушії, які виробники пристроїв зможуть комбінувати для різних сценаріїв локального ШІ.
Нинішні повідомлення — це попередній опис архітектури, а не повна специфікація платформи. Snapdragon Summit заплановано на 22–24 вересня на Мауї, Гаваї. 31
До цього заходу оприлюднені дані варто сприймати передусім як технічний курс Qualcomm. Компанія не назвала ані точного обсягу спільної пам’яті NPU, ані повної картини продуктивності та енергоефективності, підтвердженої незалежними тестами. 5 Саме наступні анонси покажуть, як ці можливості буде налаштовано в конкретних продуктах Snapdragon і що вони означатимуть для реальних смартфонів.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Нова Hexagon NPU отримала спеціалізований Element Accelerator для трансформерних моделей, на 50% більшу спільну пам’ять і підтримку контексту до 32 000 токенів.
Нова Hexagon NPU отримала спеціалізований Element Accelerator для трансформерних моделей, на 50% більшу спільну пам’ять і підтримку контексту до 32 000 токенів. Qualcomm заявляє до 50% швидший етап prefill для моделей INT4. Це прискорює обробку початкового запиту, а не обов’язково генерацію кожного наступного токена.
Заява про MoE моделі до 30 млрд параметрів стосується моделей, у яких на один токен активується приблизно 3 млрд параметрів, а не всі 30 млрд одночасно.