騰訊大模型迎來人事大地震:姚順雨掌舵基礎模型
AI資訊AI新閒資訊正文騰訊大模型迎來人事大地震:姚順雨掌舵基礎模型發布於AI新閒資訊時間 :Aug 19, 2026閱讀 :1分鐘近日,騰訊混元多模態團隊經歷了一場深度的人事重組與戰略調整。原xAI多模態理解負責人藺旭東已正式加入騰訊混元,擔任多模態內容生成算法負責人。此次變動不僅伴隨著原多模態理解負責人胡瀚離職創業、前OpenAI研究員田永龍加入等一系列密集調整,更標誌著騰訊在多模態大模型研發路線上正發生深層次的路線重構。回顧騰訊混元過去的多模態發展史,其技術版圖主要圍繞幾大核心產品展開。
其中,文生視頻模型HunyuanVideo在2024年底首發即成為全球最大開源視頻生成模型,隨後在2025年密集擴展了圖生視頻、定製化生成以及數字人驅動等能力。圖像生成方面,從早期的HunyuanImage到支持原生2K分辨率的2.1版本及800億參數的3.0版本,不斷向工業級演進。此外,專注於單體3D模型的Hy3D也在電商建模和產品設計中廣泛應用。在空間智能領域,騰訊還推出了全球首個開源、支持仿真的沉浸式3D世界生成模型Hy World1.0及其後續版本,深度契合了空間智能的研究方向。
然而,隨著騰訊將大語言模型部和多模態模型部合併成立“基礎模型部”並由姚順雨全面接管,騰訊的多模態研發思路正面臨深刻轉變。在當前的技術路線上,業界對於多模態與智能主線的關係存在不同看法。李飛飛旗下的World Labs等觀點認為世界模型作為空間智能的一部分是AGI的重要主線,而DeepSeek等則主張將視覺模態作為服務於語言模型的工具,弱化獨立的3D或世界模型路線。從姚順雨近期的戰略佈局與旗艦產品Hy3的落地來看,其更傾向於後者的技術路線。姚順雨在公開場合多次強調,AI下半場的競爭壁壘在於上下文與推理能力,而非單純的模型參數量。
通過將多模態理解能力深度融合至基礎模型主線,優化工具調用穩定性與長上下文承接,騰訊正致力於提升模型在真實辦公、GUI Agent等產品落地中的理解與執行效率。藺旭東的加入,正是為了通過提升多模態理解能力,進一步解決生成模型中前後不一致、缺乏空間穩定性等痛點。這場重組不僅折射出騰訊內部技術路線的交替,也展現了其在AGI下半場競爭中堅定靠攏主線、聚焦生產力落地的戰略決心。相關推薦三年估值 30 億美元!大模型“中間商”演語科技如何靠搶跑衝刺港股IPO?演語科技不研發底層大模型,憑多款AI創作應用三年崛起,現啟動香港IPO,估值高達30億美元,引發AI應用層“中間商”商業價值與競爭壁壘探討。
Aug 18, 2026193.9k騰訊大模型人事調整:混元后訓練負責人徐燦轉崗微信WeLM騰訊大模型佈局調整:原混元資深研究員徐燦轉崗微信事業群,加入WeLM團隊,專注後訓練與Agent研發。徐燦曾創建WizardLM並提出Evol-Instruct,在合成數據、強化學習等領域積澱深厚。此舉正值微信AI加速落地期。Aug 14, 2026229.6k騰訊混元 Hy ASR3.0 預覽版發佈:從"聽清"到"聽懂",方言詞錯率壓到 3%騰訊混元發佈語音識別模型Hy ASR3.0 Preview,基於大語言模型Hy3,融合高精度識別與深度語義理解,實現從“逐字轉寫”到“理解語境”的質變。
模型覆蓋十大方言片區,長音頻場景優勢突出,不依賴標準普通話,讓AI不僅能聽清字,更能真正聽懂話。Aug 5, 2026235.2k騰訊混元發佈 Hy ASR 3.0 preview:語音識別不再逐字硬轉,而是真的聽懂了語境騰訊混元發佈語音識別模型Hy ASR3.0preview,基於大語言模型Hy3的語言理解能力,融合高精度識別與深度語義理解。它在通用識別、上下文感知、多場景魯棒性及方言覆蓋等方面全面提升,能結合語境給出更準確連貫的轉寫,實現從逐字轉寫到理解語義的進化。Aug 5, 20261,217.4k騰訊混元發佈Hy ASR3.
0preview:語音識別邁入“懂語境”新階段騰訊混元發佈語音識別模型Hy ASR3.0preview,首次將大語言模型Hy3的語義理解融入識別,實現從逐字轉寫向“理解語境、一鍵直出”跨越。在開源評測集上,中文普通話、英語、粵語詞錯誤率分別為3.34%、2.62%、3.12%,整體約3%,多維度表現亮眼。Aug 4, 2026260.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
