Hy3 is een Mixture-of-Experts (MoE)-model met 192 experts en top-8 routering . De belangrijkste specificaties van de officiële Hugging Face-modelkaart en Tencent's aankondiging :
| Specificatie | Waarde |
|---|---|
| Totale parameters | 295 miljard |
| Actieve parameters per token | 21 miljard |
| MTP-laagparameters | 3,8 miljard |
| Aantal lagen | 80 transformatorlagen + 1 Multi-Token Prediction-laag |
| Aandachtskoppen | 64 |
| Contextvenster | 256K tokens (262.144) |
| Architectuur | Dense-attention, sparse-FFN MoE |
Het model ondersteunt configureerbare redeneermodi — een directe "niet-denk"-modus plus lage/hoge chain-of-thought-modi voor complexe taken . Tencent beschrijft het als een "hybride snel-en-langzaam-denkend model" .
Binnen de eerste week groeide het totale API-aanroepvolume van Hy3 met meer dan 68× in vergelijking met Hy2, het model van de vorige generatie . Een Chinaal rapport van Sina Finance merkt op dat de groeicurve van Hy3 "de opwaartse trend van de Hy3-previewversie voortzette, maar met een steilere helling" .
Exacte totale tokenvolumes buiten de wekelijkse OpenRouter-totalen zijn niet gepubliceerd in de beoordeelde bronnen, maar de vraagpiek was dramatisch genoeg om Tencent's rekeninfrastructuur te overbelasten. Op 8 juli (twee dagen na lancering) piekte het verbruik van inferentie-rekenbronnen van WorkBuddy, waarbij de wachtrijpercentages 's middags boven de 50% uitkwamen . Tencent moest dringend extra rekencapaciteit toewijzen en kondigde op de ochtend van 9 juli aan dat de diensten waren hersteld .
De Hy3 Preview had al 7,7 biljoen tokens op OpenRouter verzameld tussen 23 april en 12 mei, volgens Tencent's Q1 2026 earnings-materialen .
Hy3 is uitgebracht onder de Apache 2.0-licentie zonder geografische beperkingen . De volledige modelgewichten zijn beschikbaar op Hugging Face op tencent/Hy3 .
Hy3 is ingezet in meerdere Tencent-producten :
Tencent's strategie met Hy3 is expliciet gericht op agents boven modelgrootte. Zoals Forbes bij de lancering opmerkte, wedt Tencent dat een efficiënt geactiveerd MoE-model (21B actief van 295B totaal) tegen dramatisch lagere kosten kan concurreren met veel grotere dichte-modelflaggenschepen . Belangrijke benchmarks die worden aangehaald:
| Benchmark | Hy3-score |
|---|---|
| SWE-bench Verified | 74,4% (Preview) |
| BrowseComp | 84,2 (beste open-weight zoekagent-score) |
| DeepSearchQA | 91,0 |
| MCP-Atlas | 79,1 (beste open-weight tool-orkestratie) |
| AA-LCR (lange context retrieval) | 73,4 |
De Hy3 Preview werd gelanceerd op 23 april 2026 als het eerste model gebouwd op Tencent's volledig herbouwde pre-trainingsinfrastructuur . Het werd beschreven als het "eerste model getraind op Tencent's herbouwde infrastructuur" en leverde aanzienlijke verbeteringen op ten opzichte van Hy2 op het gebied van complex redeneren, instructie-opvolging, in-context learning, codegeneratie en agentmogelijkheden . De Preview hield drie weken lang de hoogste gebruiksplek op OpenRouter vast , en de volledige release versterkte dat momentum — met totale aanroepen die 68× groeiden ten opzichte van Hy2, vergeleken met een al sterke Preview-groei . Tussen Preview en GA verfijnde Tencent's team het model door middel van wereldwijde ontwikkelaarsfeedback en binnen het eigen enorme product-ecosysteem, met meetbare verbeteringen: hallucinaties daalden van 12,5% naar 5,4% en fouten in gezond verstand-redevoering daalden van 25,4% naar 12,7% .
Belangrijkste conclusie: In de eerste ~10 dagen behaalde Hy3 68× groei in aanroepvolume ten opzichte van Hy2, werd het #1 model qua aanroepvolume op OpenRouter, overbelastte het Tencent's eigen rekeninfrastructuur door de vraag, veroverde het 60% van de WorkBuddy-gebruikers met een eigen model, en toonde het verbeteringen in enterprise agentische taken (90% taaksuccespercentage, 34% snellere uitvoering). Dit bouwt direct voort op het momentum van de Hy3 Preview, die sinds eind april al de OpenRouter-ranglijsten domineerde.