Hy3 to model Mixture-of-Experts (MoE) z 192 ekspertami i routingiem top-8 . Kluczowe dane z oficjalnej karty modelu na Hugging Face i ogłoszenia Tencenta :
| Specyfikacja | Wartość |
|---|---|
| Całkowita liczba parametrów | 295 miliardów |
| Aktywne parametry na token | 21 miliardów |
| Parametry warstwy MTP | 3,8 miliarda |
| Liczba warstw | 80 warstw transformera + 1 warstwa Multi-Token Prediction |
| Główki atencji | 64 |
| Okno kontekstu | 256 tys. tokenów (262 144) |
| Architektura | Dense-attention, sparse-FFN MoE |
Model obsługuje konfigurowalne tryby wnioskowania — bezpośredni tryb „no-think” oraz niski i wysoki tryb łańcucha myśli (chain-of-thought) do złożonych zadań . Tencent opisuje go jako „hybrydowy model szybkiego i wolnego myślenia” .
W ciągu pierwszego tygodnia całkowita liczba wywołań API modelu Hy3 wzrosła ponad 68-krotnie w porównaniu do Hy2, poprzedniej generacji modelu . Chiński raport z Sina Finance zauważa, że trajektoria wzrostu Hy3 „kontynuowała trend wzrostowy wersji preview, ale z bardziej stromym nachyleniem” .
Dokładne dane o całkowitym wolumenie tokenów poza tygodniowymi zestawieniami OpenRouter nie zostały opublikowane w przeanalizowanych źródłach, ale skok zapotrzebowania był tak gwałtowny, że przeciążył infrastrukturę obliczeniową Tencenta. 8 lipca (dwa dni po premierze) zużycie zasobów obliczeniowych wnioskowania WorkBuddy osiągnęło szczyt, a popołudniowy wskaźnik kolejek przekraczał 50% . Tencent musiał pilnie przydzielić dodatkową moc obliczeniową, ogłaszając przywrócenie usług rankiem 9 lipca .
Wersja Hy3 Preview zgromadziła już 7,7 biliona tokenów na OpenRouter między 23 kwietnia a 12 maja, według materiałów dotyczących wyników Tencenta za pierwszy kwartał 2026 roku .
Hy3 został wydany na licencji Apache 2.0 bez ograniczeń geograficznych . Pełne wagi modelu są dostępne na Hugging Face pod adresem tencent/Hy3 .
Hy3 został wdrożony w wielu produktach Tencenta :
Strategia Tencenta z Hy3 wyraźnie stawia na agentów, a nie na rozmiar modelu. Jak zauważył Forbes przy okazji premiery, Tencent stawia na to, że efektywnie aktywowany model MoE (21B aktywnych z 295B) przy radykalnie niższym koszcie może rywalizować z dużo większymi, gęstymi modelami flagowymi . Kluczowe benchmarki:
| Benchmark | Wynik Hy3 |
|---|---|
| SWE-bench Verified | 74,4% (Preview) |
| BrowseComp | 84,2 (najlepszy wynik open-weight dla agenta wyszukiwania) |
| DeepSearchQA | 91,0 |
| MCP-Atlas | 79,1 (najlepsza open-weight orkiestracja narzędzi) |
| AA-LCR (wyszukiwanie długiego kontekstu) | 73,4 |
Wersja Hy3 Preview została uruchomiona 23 kwietnia 2026 roku jako pierwszy model zbudowany na całkowicie odnowionej infrastrukturze przedtreningowej Tencenta . Opisano ją jako „pierwszy model wytrenowany na odbudowanej infrastrukturze Tencenta”, który przyniósł znaczące ulepszenia w stosunku do Hy2 w zakresie złożonego rozumowania, podążania za instrukcjami, uczenia się w kontekście, generowania kodu i zdolności agencyjnych . Wersja Preview utrzymywała pierwsze miejsce w rankingu użycia OpenRouter przez trzy tygodnie , a pełna wersja spotęgowała to momentum — całkowita liczba wywołań wzrosła 68-krotnie w porównaniu do Hy2, przy już silnym tempie wzrostu Preview . Pomiędzy Preview a wersją oficjalną (GA) zespół Tencenta dopracował model dzięki globalnym informacjom zwrotnym od programistów i w ramach własnego, ogromnego ekosystemu produktów, osiągając wymierne ulepszenia: halucynacje spadły z 12,5% do 5,4%, a błędy wnioskowania potocznego z 25,4% do 12,7% .
Kluczowy wniosek: W ciągu pierwszych ~10 dni Hy3 osiągnął 68-krotny wzrost liczby wywołań w porównaniu z Hy2, został modelem nr 1 pod względem liczby wywołań na OpenRouter, przeciążył infrastrukturę obliczeniową Tencenta z powodu zapotrzebowania, przejął 60% użytkowników modeli niestandardowych w WorkBuddy i wykazał korporacyjne ulepszenia agencyjne (90% wskaźnik powodzenia zadań, 34% szybsze wykonanie). To bezpośrednio buduje na momencie wersji Hy3 Preview, która dominowała w rankingach OpenRouter od końca kwietnia.