Hy3 adalah model Mixture-of-Experts (MoE) dengan 192 pakar dan penghalaan top-8 . Spesifikasi utama dari kad model Hugging Face rasmi dan pengumuman Tencent :
| Spesifikasi | Nilai |
|---|---|
| Jumlah parameter | 295 bilion |
| Parameter aktif setiap token | 21 bilion |
| Parameter lapisan MTP | 3.8 bilion |
| Bilangan lapisan | 80 lapisan transformer + 1 lapisan Multi-Token Prediction |
| Kepala perhatian | 64 |
| Tetingkap konteks | 256K token (262,144) |
| Seni bina | Perhatian padat, FFN jarang MoE |
Model ini menyokong mod penaakulan yang boleh dikonfigurasikan — mod "tanpa berfikir" langsung serta mod rantaian pemikiran rendah/tinggi untuk tugasan kompleks . Tencent menyifatkannya sebagai "model pemikiran cepat-dan-lambat hibrid" .
Dalam minggu pertamanya, jumlah panggilan API Hy3 berkembang lebih 68× ganda berbanding Hy2, model generasi sebelumnya . Laporan berbahasa Cina dari Sina Finance menyatakan trajektori pertumbuhan Hy3 "meneruskan trend menaik versi pratonton Hy3 tetapi dengan cerun yang lebih curam" .
Jumlah token tepat di luar jumlah mingguan OpenRouter tidak diterbitkan dalam sumber yang disemak, tetapi lonjakan permintaan cukup dramatik sehingga membebankan infrastruktur komputasi Tencent. Pada 8 Julai (dua hari selepas pelancaran), penggunaan sumber komputasi inferens WorkBuddy memuncak, dengan kadar giliran petang melebihi 50% . Tencent terpaksa memperuntukkan kapasiti komputasi tambahan segera, mengumumkan pemulihan perkhidmatan pada pagi 9 Julai .
Hy3 Preview telah mengumpul 7.7 trilion token di OpenRouter antara 23 April dan 12 Mei, menurut bahan pendapatan Q1 2026 Tencent .
Hy3 dikeluarkan di bawah lesen Apache 2.0 dengan tiada sekatan geografi . Pemberat model penuh tersedia di Hugging Face di tencent/Hy3 .
Hy3 telah digunakan merentas pelbagai produk Tencent :
Strategi Tencent dengan Hy3 secara jelas adalah tentang ejen mengatasi saiz model. Seperti yang dinyatakan Forbes meliputi pelancaran, Tencent bertaruh bahawa model MoE yang diaktifkan secara cekap (21B aktif daripada 295B jumlah) pada kos yang jauh lebih rendah boleh menyaingi model utama padat yang lebih besar . Penanda aras utama yang disebut termasuk:
| Penanda Aras | Skor Hy3 |
|---|---|
| SWE-bench Verified | 74.4% (Pratonton) |
| BrowseComp | 84.2 (skor ejen carian pemberat terbuka terbaik) |
| DeepSearchQA | 91.0 |
| MCP-Atlas | 79.1 (orkestrasi alat pemberat terbuka terbaik) |
| AA-LCR (pengambilan konteks panjang) | 73.4 |
Hy3 Preview dilancarkan 23 April 2026 sebagai model pertama yang dibina di atas infrastruktur pra-latihan Tencent yang dibina semula sepenuhnya . Ia digambarkan sebagai "model pertama yang dilatih di atas infrastruktur yang dibina semula Tencent" dan memberikan peningkatan yang ketara berbanding Hy2 dalam penaakulan kompleks, pengikut arahan, pembelajaran dalam konteks, penjanaan kod, dan keupayaan ejen . Pratonton itu memegang slot penggunaan teratas OpenRouter selama tiga minggu berturut-turut , dan pelancaran penuh memperkuat momentum itu — dengan jumlah panggilan berkembang 68× berbanding Hy2 berbanding kadar pertumbuhan Pratonton yang sudah kukuh . Antara Pratonton dan GA, pasukan Tencent memperhalusi model melalui maklum balas pembangun global dan merentas ekosistem produk besarnya sendiri, dengan peningkatan yang boleh diukur: halusinasi menurun dari 12.5% kepada 5.4% dan kesilapan penaakulan akal sehat menurun dari 25.4% kepada 12.7% .
Kesimpulan utama: Dalam ~10 hari pertamanya, Hy3 mencapai pertumbuhan panggilan 68× berbanding Hy2, menjadi model #1 mengikut jumlah panggilan di OpenRouter, membebankan infrastruktur komputasi Tencent sendiri akibat permintaan, menangkap 60% pengguna model tersendiri WorkBuddy, dan menunjukkan pagian ejen perusahaan (kadar kejayaan tugas 90%, pelaksanaan 34% lebih pantas). Ini dibina secara langsung di atas momentum Hy3 Preview, yang telah mendominasi ranking OpenRouter sejak akhir April.