Hy3 — це модель на основі Mixture-of-Experts (MoE) зі 192 експертами та топ-8 маршрутизацією . Ключові характеристики з офіційної картки на Hugging Face та анонсу Tencent :
| Характеристика | Значення |
|---|---|
| Загальна кількість параметрів | 295 мільярдів |
| Активні параметри на токен | 21 мільярд |
| Параметри шару MTP | 3.8 мільярда |
| Кількість шарів | 80 трансформерних шарів + 1 шар Multi-Token Prediction |
| Голови уваги (Attention heads) | 64 |
| Контекстне вікно | 256K токенів (262,144) |
| Архітектура | Dense-attention, sparse-FFN MoE |
Модель підтримує налаштовувані режими міркування — прямий режим «без роздумів», а також режими з низьким і високим ланцюжком міркувань для складних завдань . Tencent називає її «гібридною моделлю швидкого та повільного мислення» .
За перший тиждень загальний обсяг викликів API Hy3Б зріс більш ніж у 68 разів порівняно з Hy2, моделлю попереднього покоління . Китайське видання Sina Finance зазначає, що траєкторія зростання Hy3 «продовжила висхідний тренд прев’ю-версії Hy3, але з більш крутим нахилом» .
Точних цифр загального обсягу токенів, окрім щотижневих підрахунків OpenRouter, в опрацьованих джерелах не опубліковано, але сплеск попиту був настільки драматичним, що перевантажив обчислювальну інфраструктуру Tencent. 8 липня (через два дні після запуску) споживання обчислювальних ресурсів для інференсу WorkBuddy досягло піку, а рівень черг після обіду перевищив 50% . Tencent довелося терміново виділити додаткові обчислювальні потужності, оголосивши про відновлення роботи сервісу вранці 9 липня .
Прев’ю-версія Hy3 Preview вже накопичила 7.7 трильйона токенів на OpenRouter у період з 23 квітня по 12 травня, згідно з матеріалами Tencent про прибутки за перший квартал 2026 року .
Hy3 випущено під ліцензією Apache 2.0 без жодних географічних обмежень . Повні ваги моделі доступні на Hugging Face за адресою tencent/Hy3 .
Hy3 впроваджено в кількох продуктах Tencent :
Стратегія Tencent з Hy3 явно полягає в тому, що агенти важливіші за розмір моделі. Як зазначив Forbes, висвітлюючи запуск, Tencent робить ставку на те, що ефективно активована MoE-модель (21B активних з 295B загальних) зі значно нижчою вартістю може конкурувати з набагато більшими щільними флагманськими моделями . Ключові показники бенчмарків:
| Бенчмарк | Оцінка Hy3 |
|---|---|
| SWE-bench Verified | 74.4% (Preview) |
| BrowseComp | 84.2 (найкращий показник пошукового агента з відкритою вагою) |
| DeepSearchQA | 91.0 |
| MCP-Atlas | 79.1 (найкраща оркестрація інструментів з відкритою вагою) |
| AA-LCR (довгий контекст) | 73.4 |
Прев’ю-версія Hy3 Preview запущена 23 квітня 2026 року як перша модель, побудована на повністю перебудованій інфраструктурі попереднього навчання Tencent . Її описували як «першу модель, навчену на перебудованій інфраструктурі Tencent», яка забезпечила значні покращення порівняно з Hy2 у складних міркуваннях, виконанні інструкцій, навчанні в контексті, генерації коду та агентних можливостях . Preview утримував перше місце за використанням на OpenRouter протягом трьох тижнів , а повноцінний реліз посилив цю динаміку — загальна кількість викликів зросла в 68 разів порівняно з Hy2, що перевищило вже високі темпи зростання Preview . Між Preview та загальною доступністю команда Tencent вдосконалювала модель на основі відгуків глобальних розробників та в рамках власної величезної продуктової екосистеми, що призвело до вимірних покращень: рівень галюцинацій знизився з 12.5% до 5.4%, а помилок здорового глузду — з 25.4% до 12.7% .
Ключовий висновок: За перші ~10 днів Hy3 досяг 68-кратного зростання кількості викликів порівняно з Hy2, став моделлю №1 за обсягом викликів на OpenRouter, перевантажив власну обчислювальну інфраструктуру Tencent через попит, залучив 60% користувачів WorkBuddy, які обирають модель самостійно, та продемонстрував покращення в корпоративних агентах (90% успішності завдань, на 34% швидше виконання). Це прямий розвиток динаміки Hy3 Preview, який домінував у рейтингах OpenRouter з кінця квітня.