騰訊開源混元 Hy4 preview:770B 參數、100 萬上下文
騰訊混元於 8 月 28 日發布並開源新一代大型語言模型 Hy4 preview,總參數 770B、每個 token 啟用 49B,上下文長度突破 100 萬 token,權重以 Apache 2.0 授權放上 Hugging Face。根據新華網報導,騰訊把它定位為「為生產力而生」的模型,鎖定軟體工程、辦公分析、遊戲開發與科學研究。這是繼智譜 GLM-5.3、DeepSeek V4 系列之後,中國大型科技公司在開源前沿模型上的又一次出手。
78 層混合專家,每個 token 從 256 個專家挑 8 個
依模型卡,Hy4 preview 採混合專家架構,共 78 層,第一層為稠密前饋網路,其餘 77 層為 MoE,每層有 256 個路由專家加 1 個共享專家,每個 token 啟用前 8 個路由專家。模型內建多 token 預測層以支援推測解碼,並提供 FP8 量化版本降低記憶體需求;部署範例使用 8 張 GPU 做張量平行。騰訊在模型卡註明這是 Hy4 的早期版本,推理效率仍有已知限制。
Terminal-Bench 2.1 得 85.4,內部盲測略勝 GLM 5.3 與 Kimi K3
模型卡列出的成績包括 GPQA Diamond 92.3、SWE-bench Multilingual 82.9、SWE-bench Pro 65.7、Terminal-Bench 2.1 85.4。新華網另引述騰訊內部評測:163 名內部專家對 203 個工程任務做盲測,Hy4 preview 平均 2.99 分(滿分 4 分),略高於 GLM 5.3 的 2.92 分與 Kimi K3 的 2.94 分。這些數字均為騰訊自行公布,第三方尚未完成獨立驗證。
報導也提到,Hy4 preview 參與了自身的優化,包括訓練方法、資料策略、評測體系與推理基礎設施,其中推理端到端吞吐量提升 31.8%。鏈新聞先前報導,智譜 8 月底推出可在國產晶片上運行的 GLM-5.3-Flash,DeepSeek 9 月 10 日開源 V4.1-Flash,三家在兩週內接連更新。
輸入每百萬 token 6 元人民幣,已上騰訊雲與 OpenRouter
新華網報導的 API 定價為輸入每百萬 token 6 元人民幣、輸出 18 元、命中快取 0.3 元。模型已在騰訊雲 Tokenhub 與 OpenRouter 提供,並整合進騰訊自家的 WorkBuddy 與 CodeBuddy。以 9 月 11 日的匯率換算,輸入約 0.83 美元、輸出約 2.5 美元,介於 DeepSeek V4.1-Flash 的離峰價與美系閉源模型之間。
風險提示
加密貨幣投資具有高度風險,其價格可能波動劇烈,您可能損失全部本金。請謹慎評估風險。




