Hy3 je model typu Mixture-of-Experts (MoE) se 192 experty a routingem Top-8 . Klíčové specifikace z oficiální karty modelu na Hugging Face a z oznámení Tencentu :
| Specifikace | Hodnota |
|---|---|
| Celkové parametry | 295 miliard |
| Aktivní parametry na token | 21 miliard |
| Parametry vrstvy MTP | 3,8 miliardy |
| Počet vrstev | 80 transformer vrstev + 1 vrstva Multi-Token Prediction |
| Pozornostní hlavy | 64 |
| Kontextové okno | 256K tokenů (262 144) |
| Architektura | Dense-attention, sparse-FFN MoE |
Model podporuje konfigurovatelné režimy uvažování – přímý režim "bez přemýšlení" a režimy s nízkým/vysokým řetězcem myšlenek pro komplexní úkoly . Tencent jej popisuje jako "hybridní model rychlého a pomalého myšlení" .
Během prvního týdne vzrostl celkový objem API volání Hy3 o více než 68 násobů oproti modelu Hy2 . Čínská zpráva z webu Sina Finance uvádí, že růstová trajektorie Hy3 "navázala na vzestupný trend verze Hy3 preview, ale s ještě strmějším sklonem" .
Přesné celkové objemy tokenů nad rámec týdenních statistik OpenRouteru nebyly v prostudovaných zdrojích zveřejněny, ale nárůst poptávky byl natolik dramatický, že přetížil výpočetní infrastrukturu Tencentu. 8. července (dva dny po spuštění) dosáhla spotřeba inferenčních výpočetních zdrojů WorkBuddy vrcholu, přičemž odpolední míra fronty přesáhla 50 % . Tencent musel urychleně alokovat další výpočetní kapacitu, přičemž obnovení služeb oznámil ráno 9. července .
Verze Hy3 Preview již nasbírala 7,7 bilionu tokenů na OpenRouteru mezi 23. dubnem a 12. květnem, podle materiálů Tencentu k výsledkům za 1. čtvrtletí 2026 .
Hy3 je vydán pod licencí Apache 2.0 bez jakýchkoli geografických omezení . Kompletní váhy modelu jsou k dispozici na Hugging Face pod tencent/Hy3 .
Hy3 byl nasazen do mnoha produktů Tencentu :
Strategie Tencentu s Hy3 je explicitně o agentech, nikoli o velikosti modelu. Jak uvedl Forbes při pokrytí uvedení, Tencent sází na to, že efektivně aktivovaný MoE model (21B aktivních z 295B celkových) za dramaticky nižší cenu může konkurovat mnohem větším hustým modelům . Klíčové benchmarky zahrnují:
| Benchmark | Skóre Hy3 |
|---|---|
| SWE-bench Verified | 74,4 % (Preview) |
| BrowseComp | 84,2 (nejlepší skóre open-weight vyhledávacího agenta) |
| DeepSearchQA | 91,0 |
| MCP-Atlas | 79,1 (nejlepší open-weight orchestrace nástrojů) |
| AA-LCR (dlouhý kontext) | 73,4 |
Verze Hy3 Preview byla spuštěna 23. dubna 2026 jako první model postavený na kompletně přestavěné pre-training infrastruktuře Tencentu . Byl popsán jako "první model natrénovaný na přestavěné infrastruktuře Tencentu" a přinesl výrazná zlepšení oproti Hy2 v komplexním uvažování, následování instrukcí, učení v kontextu, generování kódu a agentních schopnostech . Preview drželo nejvyšší pozici ve využití OpenRouteru po tři týdny a ostré vydání tuto dynamiku znásobilo – s celkovým počtem volání rostoucím 68× oproti Hy2, což překonalo i tak silné tempo růstu Preview . Mezi fází Preview a GA tým Tencentu model dále vylepšoval na základě zpětné vazby od globálních vývojářů a v rámci svého masivního produktového ekosystému, s měřitelnými zlepšeními: halucinace klesly z 12,5 % na 5,4 % a chyby v běžném uvažování poklesly z 25,4 % na 12,7 % .
Klíčové zjištění: Během prvních přibližně 10 dnů dosáhl Hy3 68násobného růstu objemu volání ve srovnání s Hy2, stal se modelem č. 1 v objemu volání na OpenRouteru, přetížil vlastní výpočetní infrastrukturu Tencentu kvůli poptávce, získal 60 % uživatelů WorkBuddy využívajících vlastní model a prokázal zlepšení v podnikových agentních úlohách (90% úspěšnost úkolů, 34% rychlejší provádění). To přímo navazuje na dynamiku verze Hy3 Preview, která dominovala žebříčkům OpenRouteru již od konce dubna.