大模型沒有獨門秘笈:騰訊混元4如何靠開源生態與頂尖人才實現逆襲?

2026年9月1日 02:305300 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文大模型沒有獨門秘笈:騰訊混元4如何靠開源生態與頂尖人才實現逆襲?發布於AI新閒資訊時間 :Sep 1, 2026閱讀 :1分鐘大模型真的存在不可告人的技術壁壘嗎?前不久從OpenAI空降騰訊的姚順雨曾直言“做大模型其實並沒有什麼秘密”。起初外界以為這只是一句玩笑,但在騰訊混元4(Hy4preview)近期交出答卷後,這句話的含金量徹底顯現。面對智譜、月之暗面、DeepSeek以及千問等強敵環伺的競爭格局,騰訊在短短四個月內完成了混元大語言與多模態部門的重組,並推出了770B參數規模、支持百萬上下文的混元4。

細究其技術配置會發現,大模型所謂的獨家秘笈,早已在開源機制與頂尖人才的高速流動下被徹底解構。從底層骨架來看,混元4在700B這一中大規模檔位上,直接對齊了國內此前由智譜GLM-5(744B)跑通並立住口碑的工程最優解。其主幹網絡的隱藏維度為6144、78層、64個注意力頭,這些參數決定了Transformer網絡在深度、寬度和注意力並行結構上的統一選擇。對於急需突圍的騰訊而言,站在前人驗證過的共識底座上,避免了重複踩坑。在核心技術沿路遷移上,混元4的注意力模塊巧妙融合了多方開源成果。其主幹借鑑了DeepSeek在V3.

2中開源的稀疏注意力機制(DSA),通過輕量級索引器在超長上下文中篩選Top-K Token,從而避免遍歷全部歷史。隨後,它又吸收了智譜團隊在IndexCache中驗證的跨層索引複用機制,允許相鄰Transformer層直接複用已有索引結果,最高可砍掉75%的索引器計算量,實現端到端性能提速。此外,在殘差側優化上,混元4放棄了複雜的mHC,轉而採用了源自微軟研究員謝天在社交平臺上公開討論的恆等超連接(iHC)方案。技術接力的背後,是頂尖人才的深度流動。清華姚班畢業、曾擔任智譜GLM-5新模型架構及DSA負責人白雨石,已於數月前正式加入騰訊混元團隊,並出現在混元長上下文稀疏注意力論文的作者欄中。

正是在這些天才研究員的推動下,隱性工程經驗完成了從一家企業到另一家企業的物理遷徙。如今,任何能夠通過論文、代碼和實驗數據表達出來的技術優勢,其獨佔期都在急劇縮短。從頂會論文到開源代碼,再到社區熱議的討論帖,前沿架構的傳播路徑已徹底扁平化,大模型的行業護城河正被開源生態與人才流動迅速填平。相關推薦智譜下一代AI錨定大基座路線,力求發佈首日即迎滿載調用智譜在2026半年度業績會上披露下一代大模型進展:堅定大基座路線,核心目標是發佈首日即可支持滿規模業務調用,以解決模型規模虛大卻難以實際應用的痛點。具體技術參數暫未披露,後續將圍繞底層基座推進。Sep 1, 2026114.

1k蘋果訴OpenAI迎來重磅證據:前員工MacBook被查出非法竊取與AI代理訓練內幕蘋果訴OpenAI商業秘密案取得關鍵進展:法院對前蘋果工程師劉暢離職後使用的MacBook初步取證,發現四項指向性極強的證據。該電腦由劉暢律師近期交還,顯示其離職前存在多項違規操作,或涉及洩密。蘋果正申請加速調查。Sep 1, 202695.5k一臺MacBook引發的訴訟拉鋸:蘋果追加指控OpenAI硬件業務竊密蘋果提交新證據,指控OpenAI利用前蘋果工程師劉暢竊取的涉密技術發展硬件業務並試圖銷燬證據。

調查顯示,劉暢離職後下載數十份含電路原理圖的機密文件,入職OpenAI後用公司MacBook運行電路仿真程序。Sep 1, 202681.4kOpenAI十萬億參數新模型Bel預訓練完成OpenAI被曝完成代號“Bel”的10萬億參數超大規模預訓練模型,作為繼“Doug”後的下一代基座,架構與參數規模大幅躍升,目標直指通用人工智能(AGI)。其在編碼、推理及長時程智能體任務等維度性能表現突出。Aug 31, 2026214.

5k騰訊混元發佈開源旗艦模型Hy4preview,總參數770B、上下文1M騰訊混元8月28日發佈開源旗艦大模型Hy4preview,總參數770B、激活參數49B,上下文1M,定位真實生產力。模型已開源至HuggingFace、GitHub、ModelScope等,並上線騰訊雲TokenHub、OpenRouter,可在WorkBuddy/CodeBuddy、元寶、ima體驗。其依託軟工、遊戲、金融、安全等領域專家數據共建,在四大方向取得進展。Aug 28, 2026355.0k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

3秒出片比播放還快,MiniMax打開了AI視頻的實時商業化路徑

MiniMax推出新一代影片生成模型H3 Max,生成5秒768p影片僅需不到3秒,速度已超越播放速度,並帶動AI即時直播與AI版短影片App等創新應用。該模型基於開源的H3進行後訓練與推理優化,吞吐量約為原版35倍,同時在圖生影片評比中拿下第一。市場上已出現多個由開發者打造的即時生成直播頻道,顯示此技術開啟新的商業化路徑,而MiniMax股價也在近期大漲。

剛剛

奧特曼播客曝猛料:Astra操作電腦已達人類水平

OpenAI 執行長奧特曼(Sam Altman)近日在一場播客訪談中投下震撼彈,直言旗下 AI 代理系統 Astra 在操作電腦方面的能力,已經達到與人類相當的水準。這番談話迅速在科技圈發酵,外界普遍將其視為 AI 從「回答問題」邁向「實際動手執行任務」的關鍵分水嶺。 奧特曼在節目中並未停留在技術層面的描述,而是進一步闡述 AI 能力躍升後對社會結構的深遠影響。他特別點名高等教育體系,認為傳統四年制大學的養成模式已經跟不上時代,主張兩年就足以完成必要的學術訓練。

剛剛

奧特曼直言:四年太久,大學兩年就夠

OpenAI 執行長山姆·奧特曼(Sam Altman)近日再度拋出震撼教育界的觀點。他向外界直言,傳統大學四年學制早已不合時宜,在人工智慧迅速改變知識取得與技能養成的當下,兩年時間便足以讓年輕人具備進入社會所需的核心能力。這番言論迅速在矽谷與科技圈引發熱烈討論,也讓外界重新審視高等教育的效率與未來走向。 奧特曼長期以來便對现行教育體系抱持批判態度。他認為,現行的大學課程設計源自工業時代的標準化思維,過度依賴課堂授課與學分累積,卻忽略了學生真正需要的是解決問題的能力與實作經驗。

剛剛

月之暗面與微軟、谷歌、亞馬遜談判, 爭取最高30%服務分成

中國月之暗面就Kimi K3與美雲企談30%收入分成,具標誌性意義。 近日,財聯社報道,據消息人士透露,月之暗面正就Kimi K3 AI模型與微軟、亞馬遜、谷歌進行收入分成談判。月之暗面在初期談判中,正尋求從K3相關服務產生的收入中抽取最高30%的分成。 如果談成,這將是中國AI公司和美國雲巨頭之間,第一個大型模型收入分成協議。 不過談判仍處於早期階段,分成核算口徑、合作落地週期、服務邊界等核心細節尚未最終敲定。目前,涉及的三家雲廠商和月之暗面都拒絕對談判公開發表評論。

剛剛
智東西生成式AI

混元Hy4 preview輕量版來了!權重壓縮86%,性能幾乎不減

(公眾號:zhidxcom) 作者 | 程茜 編輯 | 心緣 9月1日報道,今日中午,騰訊發佈了其最新一代旗艦模型預覽版本Hy4 preview的輕量版模型,將模型權重從1.5TB壓縮到214GB。 騰訊混元的測試結果顯示,壓縮後的模型與Hy4 preview原始模型相比,長文理解、多輪長上下文檢索和原版基本在同一水平,數學有小幅回落。壓縮後模型能覆蓋日常編程輔助、工具調用、長文檔處理和常規問答。

剛剛

2026年的一切,都只是Robocity的序幕

35分鐘前“最強大腦”與“最強小腦”相互需要2026-08-11百度AI的驗牌時刻到了2026-07-27閱讀更多內容,狠戳這裡查看AI測評DeepSeek選靠譜AI,看真實評測查看AI測評官方交流社區加入諮詢項目審核和入駐聯繫項目推薦訂閱號關注下一篇馬斯克狂贊,硅谷大佬驚呼:Grok Bot是下一個ChatGPT時刻硅谷投資人稱Grok Bot是新ChatGPT時刻,為AI生產革命。

剛剛