Hy3係一個MoE模型,有192個專家網絡同top-8路由機制 。根據官方Hugging Face模型卡同騰訊公佈嘅規格 :
| 規格 | 數值 |
|---|---|
| 總參數 | 2950億 |
| 每Token活躍參數 | 210億 |
| MTP層參數 | 38億 |
| 層數 | 80個Transformer層 + 1個Multi-Token Prediction層 |
| Attention頭 | 64個 |
| 上下文視窗 | 256K tokens(262,144) |
| 架構 | Dense-attention, sparse-FFN MoE |
模型支援可配置嘅推理模式——有直接「唔諗嘢」模式,以及低/高鏈式思維模式嚟處理複雜任務 。騰訊形容佢係「混合快慢思考模型」 。
推出後一星期內,Hy3嘅總API調用量比Hy2增長超過68倍 。新浪財經嘅中文報導指出,Hy3嘅增長「延續咗Hy3 preview版本嘅上升趨勢,但斜率更加陡峭」 。
確切嘅總Token量數字喺已審閱嘅資料中未有公佈,但需求激增嘅程度足以癱瘓騰訊嘅運算基建。7月8日(推出後兩日),WorkBuddy嘅推理運算資源達到頂峰,下午排隊率超過50% 。騰訊要緊急調配額外算力,到7月9日上午先宣佈服務恢復正常 。
而Hy3 Preview喺OpenRouter上,由4月23日至5月12日期間,已經累積咗7.7萬億Tokens嘅用量 。
Hy3以 Apache 2.0授權 釋出,冇任何地域限制 。完整模型權重已上載到Hugging Face嘅 tencent/Hy3 。
Hy3已經接入多個騰訊產品 :
騰訊對Hy3嘅策略好明確,係以智能代理(Agent)為重,唔係一味追求模型大小。Forbes報導指出,騰訊賭緊一個激活效率高嘅MoE模型(295B總參數中只激活21B),用遠低於對手嘅成本,去挑戰更大規模嘅密集模型旗艦 。相關基準測試成績:
| 基準測試 | Hy3分數 |
|---|---|
| SWE-bench Verified | 74.4%(Preview版本) |
| BrowseComp | 84.2(開放權重搜尋代理最佳成績) |
| DeepSearchQA | 91.0 |
| MCP-Atlas | 79.1(開放權重工具編排最佳成績) |
| AA-LCR(長上下文檢索) | 73.4 |
Hy3 Preview喺2026年4月23日推出,係第一個用騰訊重建嘅預訓練基礎設施訓練嘅模型 。佢被形容為「首個喺騰訊重建基建上訓練嘅模型」,喺複雜推理、指令跟從、上下文學習、編碼同代理能力方面,都比Hy2有顯著進步 。Preview版本連續三星期霸佔OpenRouter用量冠軍 ,而正式版就將呢股動力進一步放大——總調用量比Hy2增長68倍,比本身已經好強嘅Preview增長率仲要高 。由Preview到正式版期間,騰訊團隊透過全球開發者反饋同自身龐大產品生態系統進行微調,成果顯著:幻覺率由12.5%降到5.4%,常識推理錯誤由25.4%降到12.7% 。
關鍵總結:喺推出後大約10日入面,Hy3嘅API調用量比Hy2增長68倍、成為OpenRouter調用量冠軍、因為需求太勁而逼爆騰訊自己嘅運算基建、WorkBuddy自選模型用戶中有60%揀咗Hy3,並且喺企業代理工作流程中展現出驚人改善(任務成功率達90%、執行時間快34%)。呢啲成就係直接建基於Hy3 Preview由4月底以嚟主導OpenRouter排行榜嘅勢頭之上。