Hy4 preview 發布與規格

System with various wires managing access to centralized resource of server in data center

根據 AIBase 報導,Tencent 的 Hunyuan 團隊於 2026 年 8 月 28 日釋出開源旗艦大型模型 Hy4 preview,總參數達 7700 億,啟用參數為 490 億,支援 100 萬 tokens 的上下文長度,定位於真正的生產力工作負載,包括軟體工程、辦公任務及科學研究。Tencent 表示,這次發布為 Hy4 家族的早期版本,後續將透過敏捷迭代持續進行預訓練與後訓練的改進,並坦承目前已知存在包括在複雜任務上思考時間過長等問題。

通路與產品整合

Hy4 preview 同時於 Hugging Face、GitHub 和 ModelScope 開源,並上架至騰訊雲 TokenHub及 OpenRouter,消息來自 AIBase。使用者可直接在騰訊旗下的 WorkBuddy/CodeBuddy、元寶及 ima 等產品內使用該模型。騰訊 WorkBuddy 團隊於同日另外推出了與 Hy4 preview 的整合,提供國內與海外版本,皆享有兩週免費試用,並將前一代 Hy3 模型的免費使用延長至 9 月 30 日,此消息由 finance.biggo.com 報導。

能力基準與內部評測

根據 AIBase 報導,騰訊表示 Hy4 preview 是與內部軟體工程、遊戲、金融及安全專家共同開發的高品質資料所建構。在一項涵蓋 203 項工程任務、由 163 位專家評分的內部盲測中,該模型平均得分為 2.99 分(滿分 4.00),相比之下 GLM-5.3 為 2.92 分,Kimi K3 為 2.94 分。騰訊將提早釋出開源版本的策略,定位為產業從參數量競爭轉向生產力效益驗證的更廣泛趨勢之一。

目標應用場景

根據 AIBase 報導,此次發布聚焦四大生產力方向:提升長時程軟體工程任務的理解、規劃與除錯能力;在辦公情境中完成從資料分析到文件、表格與簡報的端到端交付;透過與 Unreal 5 和 Unity 的 MCP 整合支援遊戲開發,目標是透過純對話從零生成可遊玩的 demo;以及涵蓋分子動力學、凝態物理與基礎數學等科學研究領域。

與該模型相關的科學研究成果

根據 AIBase 報導,騰訊公佈了兩項與 Hy4 preview 相關的科學成果。結合 Hyra 模型,該模型將三維 Blaschke–Lebesgue 問題的體積下界從 0.380799 推進至 0.41104,距離 Meissner 四面體猜想最終證明僅剩約 2% 的差距。該組合架構同時在模擬 32,512 原子的磷脂雙層上達成 2.0 倍加速,達到每步 54.9 毫秒。

已知限制與後續規劃

根據 AIBase 報導,騰訊表示 Hy4 preview 是 Hy4 迭代的早期版本,預訓練與後訓練仍有改善空間,已知問題包括複雜任務的長思考。該公司計劃透過敏捷迭代吸收真實回饋,且報導中並未提供後續里程碑日期。

分享這篇文章

FacebookX

7 條來源

引用來源