O Hy3 é um modelo Mixture-of-Experts (MoE) com 192 especialistas e roteamento top-8 . As principais especificações, divulgadas na página oficial do modelo no Hugging Face e no anúncio da Tencent :
| Especificação | Valor |
|---|---|
| Parâmetros totais | 295 bilhões |
| Parâmetros ativos por token | 21 bilhões |
| Parâmetros da camada MTP | 3,8 bilhões |
| Número de camadas | 80 camadas transformer + 1 camada de Multi-Token Prediction |
| Cabeças de atenção | 64 |
| Janela de contexto | 256K tokens (262.144) |
| Arquitetura | MoE com atenção densa e FFN esparsa |
O modelo suporta modos de raciocínio configuráveis — um modo direto "sem pensar" (no-think), além de modos de cadeia de pensamento (chain-of-thought) baixo e alto para tarefas complexas . A Tencent o descreve como um "modelo de pensamento híbrido rápido-e-lento" .
Em sua primeira semana, o volume total de chamadas de API do Hy3 cresceu mais de 68 vezes comparado ao Hy2, a geração anterior do modelo . Um relato em chinês do portal Sina Finance observa que a trajetória de crescimento do Hy3 "continuou a tendência de alta da versão preview do Hy3, mas com uma inclinação mais acentuada" .
Números exatos de volume total de tokens além das contagens semanais do OpenRouter não foram publicados nas fontes revisadas, mas o aumento da demanda foi tão dramático que sobrecarregou a infraestrutura de computação da Tencent. Em 8 de julho (dois dias após o lançamento), o consumo de recursos de inferência do WorkBuddy atingiu o pico, com taxas de fila na parte da tarde superiores a 50% . A Tencent teve que alocar capacidade computacional adicional com urgência, anunciando a restauração do serviço na manhã de 9 de julho .
O Hy3 Preview já havia acumulado 7,7 trilhões de tokens no OpenRouter entre 23 de abril e 12 de maio, de acordo com os materiais de resultados do primeiro trimestre de 2026 da Tencent .
O Hy3 é lançado sob a licença Apache 2.0, sem restrições geográficas . Os pesos completos do modelo estão disponíveis no Hugging Face em tencent/Hy3 .
O Hy3 foi implantado em vários produtos da Tencent :
A estratégia da Tencent com o Hy3 é explicitamente focada em agentes, não no tamanho do modelo. Como a Forbes cobriu no lançamento, a Tencent aposta que um modelo MoE eficientemente ativado (21B ativos de 295B totais) a um custo dramaticamente menor pode rivalizar com modelos densos flagships muito maiores . Os principais benchmarks citados incluem:
| Benchmark | Pontuação do Hy3 |
|---|---|
| SWE-bench Verified | 74,4% (Preview) |
| BrowseComp | 84,2 (melhor pontuação entre modelos de peso aberto para busca) |
| DeepSearchQA | 91,0 |
| MCP-Atlas | 79,1 (melhor orquestração de ferramentas entre modelos de peso aberto) |
| AA-LCR (recuperação de contexto longo) | 73,4 |
O Hy3 Preview foi lançado em 23 de abril de 2026 como o primeiro modelo construído sobre a infraestrutura de pré-treinamento completamente reconstruída da Tencent . Foi descrito como o "primeiro modelo treinado na infraestrutura reconstruída da Tencent" e trouxe melhorias significativas em relação ao Hy2 em raciocínio complexo, seguimento de instruções, aprendizado em contexto, geração de código e capacidades de agente . O Preview manteve o primeiro lugar de uso no OpenRouter por três semanas consecutivas , e o lançamento completo amplificou esse impulso — com chamadas totais crescendo 68x em relação ao Hy2, superando a já forte taxa de crescimento do Preview . Entre o Preview e a versão GA, a equipe da Tencent refinou o modelo com feedback de desenvolvedores globais e em todo seu ecossistema massivo de produtos, com melhorias mensuráveis: as alucinações caíram de 12,5% para 5,4% e os erros de raciocínio de senso comum caíram de 25,4% para 12,7% .
Conclusão principal: Em seus primeiros ~10 dias, o Hy3 alcançou um crescimento de 68x no volume de chamadas em relação ao Hy2, tornou-se o modelo #1 em volume de chamadas no OpenRouter, sobrecarregou a própria infraestrutura de computação da Tencent devido à demanda, capturou 60% dos usuários de modelo personalizado do WorkBuddy e demonstrou melhorias empresariais agentivas (90% de taxa de sucesso em tarefas, 34% de execução mais rápida). Isso se baseia diretamente no impulso do Hy3 Preview, que já dominava os rankings do OpenRouter desde o final de abril.