騰訊混元 Hy4 preview 發佈並開源 於真實生產力任務展現卓越能力
騰訊混元今(28)日正式發佈並開源新一代大型語言模型 Hy4 preview,總參數 770B、激活參數49B,上下文長度突破1M,於代碼、辦公、科學等真實生產力任務上展現出卓越能力。
Hy4 preview 在模型尺寸、上下文長度及數據規模上均作出顯著擴展,預訓練與後訓練的協同進步,使智能水平再次大幅提升,穩佔開源模型第一梯隊。

混元持續與 CodeBuddy / WorkBuddy 等產品深度協同,持續優化生產力場景的真實用戶體驗。騰訊內部早前以 163 名內部專家、203 個工程任務進行盲測,結果顯示 Hy4 preview(均分 2.99 /4)表現略優於 GLM 5.3(均分 2.92 /4.00)及 Kimi K3(均分 2.94 /4.00)。
Hy4 preview 定位為「為生產力而生」的模型,透過與軟件工程、遊戲、金融、安全等領域的頂尖騰訊專家共建高質量數據,並結合與 WorkBuddy 等產品的深度協同(Co-Design),模型於各類真實生產力任務上取得顯著進展。
具體而言,在軟件工程場景上,模型加強了長程開發任務的理解、規劃、調試與驗證能力,並進一步提升前端開發的視覺美感與交互質素。
在辦公分析場景上,模型顯著加強對複雜辦公環境的理解與金融分析能力,重點優化數據分析及跨文檔協作,完成從資訊處理到文件、表格與簡報交付的完整流程。
在遊戲開發場景上,模型加強了憑一句需求直接生成可玩原型之能力,並可熟練使用遊戲引擎,開發者可透過多輪互動持續完善複雜的遊戲項目。
在科學研究場景上,模型顯著加強對複雜科研問題的理解、推理與求解能力,於 AI 研發、分子動力學模擬、凝聚態物理、基礎數學等各類場景中皆有長足進展。
值得一提的是,Hy4 preview 於自身研發的全過程中發揮積極價值,首次參與訓練方法、數據策略、評估體系及底層算子的自動優化。模型提出方案、執行實驗,並根據結果持續迭代,實驗所產生的代碼、日誌及反饋將進入下一輪探索,從而形成初步的遞歸自我改進閉環。
Hy4 preview 亦自主分析推理系統瓶頸,並圍繞算子融合及通訊優化等方向進行多輪優化,端到端吞吐量較基線提升31.8%,於不同上下文長度及併發度下均取得穩定收益,初步展現自主進行推理基礎設施優化的能力。
Hy4 preview 同步開源,並於 WorkBuddy / CodeBuddy 國內版及國際版、元寶、ima 等騰訊產品同步首發,用戶可直接透過產品體驗,亦可經騰訊雲 TokenHub 及 OpenRouter 接入 API 使用。定價方面,Hy4 preview 繼續走普惠的高性價比路線,每百萬 tokens 輸入0.834 美元、輸出2.501 美元,快取輸入0.042 美元。
為進一步收集用戶對模型的反饋以持續提升模型表現,WorkBuddy / CodeBuddy 將面向用戶推出為期2周的限時免費活動。
自2月重建基礎設施以來,混元大模型平均每兩個月進行一次大版本迭代。透過 preview 先行、正式版接續推出的方式,混元將真實世界的反饋持續引入研發過程,讓模型在解決實際問題中持續進步。按此節奏,Hy4 下一版本模型亦將於近期陸續推出。
