騰訊混元 Hy4 preview發佈,穩居開源模型第一梯隊

2026年8月28日 06:18
站內 AI 整理稿

騰訊混元 Hy4 preview 發佈並開源,在真實生產力任務上展現卓越能力8 月 28 日,騰訊混元發佈並開源新一代大語言模型 Hy4 preview ,總參數 770B、激活參數 49B,上下文長度突破 1M,在代碼、辦公、科學等真實生產力任務上展現出卓越能力。Hy4 preview 在模型尺寸、上下文長度、數據規模上都進行了顯著的擴展,預訓練和後訓練的共同進步帶來了智能水平的又一次巨大提升,穩居開源模型第一梯隊。混元持續與 CodeBuddy / WorkBuddy 等產品深度協同,優化生產力場景的真實用戶體驗。

在騰訊內部組織的 163 名內部專家、203 個工程任務的盲測中, Hy4 preview(均分2.99/4)略優於 GLM 5.3(均分2.92/4.00) 和 Kimi K3(均分2.94/4.00)。Hy4 preview 定位“為生產力而生”的模型,通過與軟件工程、遊戲、金融、安全等頂尖騰訊專家的高質量數據共建,以及與 WorkBuddy 等產品的深度協同(Co-Design),模型在各類真實生產力任務上取得顯著進步。具體來看,在軟件工程場景下,模型增強了長程開發任務的理解、規劃、調試與驗證能力,進一步提升前端開發的視覺審美和交互質量。

在辦公分析場景下,顯著提升了複雜辦公環境理解和金融分析能力,著重優化數據分析、跨文件協作,完成從信息處理到文檔、表格與演示文稿交付的完整流程。在遊戲開發場景中,增強了一句需求直接生成可玩原型能力,並能熟練使用遊戲引擎,開發者可以通過多輪交互持續完善複雜遊戲項目。在科學研究場景下,顯著提升複雜科研問題的理解、推理與求解能力,模型在 AI 研發、分子動力學模擬、凝聚態物理、基礎數學等各類場景中均有長足進步。值得一提的是,Hy4 preview 在自身研發的全鏈路過程中發揮了積極價值,首次參與訓練方法、數據策略、評估體系和底層算子的自動優化。

模型提出方案、運行實驗並根據結果繼續迭代,實驗產生的代碼、日誌和反饋進入下一輪探索,形成初步的遞歸自我改進閉環。Hy4 preview 還通過自主分析推理系統瓶頸,並圍繞算子融合、通信優化等方向開展多輪優化,端到端吞吐相較基線提升 31.8%,在不同上下文長度和併發度下均取得穩定收益,初步展現了自主開展推理基礎設施優化的能力。Hy4 preview 已經開源,並在 WorkBuddy/CodeBuddy 國內版及國際版、元寶、ima 等騰訊產品同步首發,用戶可直接通過產品體驗,還可以通過騰訊雲 Tokenhub 和 OpenRouter 接入 API 使用。

定價方面,Hy4 preview 繼續走普惠的高性價比路線,輸入 6元/百萬 tokens,輸出 18 元/百萬 tokens,緩存命中 0.3 元 / 百萬 tokens。為進一步收集用戶對模型的反饋以進一步提升模型性能,WorkBuddy/CodeBuddy 將面向用戶開展為期2周的限時免費活動。自 2 月重建基礎設施以來,混元大模型平均每兩個月迭代一次大版本。通過 preview 先行、正式版跟進的方式,混元把真實世界的反饋持續引入研發過程,讓模型在解決實際問題中進步。按照這一節奏,Hy4 的下一版模型也將在近期陸續上線。

Related

相關文章

IT之家生成式AI

真香:《我的世界》創始人佩爾松承認自己早期拒絕 AI 編程“可能錯了”

作者:清源 責編:清源 評論: 8 月 28 日消息,據《商業內幕》今天(28 日)報道,《我的世界》創作者、億萬富翁馬庫斯 · 佩爾松對 AI 的態度發生了徹底轉變。以“Notch”之名廣為人知的佩爾松,過去曾堅決反對用 AI 編程。今年 1 月,他甚至寫道:“(AI 編程)仍然是個糟糕透頂的主意,任何鼓吹這種做法的人,不是無能就是邪惡。

剛剛

OpenAI 之後又是 Anthropic,Claude 將攻擊延伸至公共互聯網

44分鐘前谷歌突然發佈“最強聽寫模型”:Agent時代的落伍產品,還是關鍵拼圖?昨天智譜認領“牛來”模型,實測:“牛馬”友好昨天閱讀更多內容,狠戳這裡選靠譜AI,看真實評測查看AI測評官方交流社區加入諮詢項目審核和入駐聯繫項目推薦訂閱號關注下一篇跨境電商的“照騙”,AI承包了?

剛剛
鈦媒體生成式AI

ChatGPT報警後:誰有權審判你的對話框?

腦極體2026.08.28 16:07 · 來自天津全文3780字00:00 / 11:54發現罪犯的AI,該不該報警?文 | 腦極體你敢相信,向AI吐露的私密想法,有一天會被直接遞交給執法部門嗎?在美國就發生了這樣一樁顛覆認知的事件。一名前高盛分析師在對話中向ChatGPT完整描述謀害前女友的犯罪計劃,OpenAI安全系統識別高危內容後,主動向FBI提交線索,當事人最終認罪獲刑。從結果來看,一場明確的預謀惡性案件被提前阻斷,但在行業規則、法律邊界、隱私權益層面,ChatGPT主動報警留下的爭議遠大於成果。

剛剛
IT之家生成式AI

Pro 和 Flash 系列“冰火兩重天”,曝谷歌內部開始測試 Gemini 3.8 Flash 模型

作者:清源 責編:清源 評論: 8 月 28 日消息,谷歌本月才剛發佈新模型,下一款就已經進入員工測試階段,部分谷歌員工開始試用 Gemini 3.8 Flash 預覽版。據《商業內幕》今天(28 日)報道,為了追趕 OpenAI 和 Anthropic,谷歌正在以數週為間隔快速更新模型,AI 競賽的節奏也由此可見一斑。

剛剛