騰訊大模型迎來人事大地震:姚順雨掌舵基礎模型

2026年8月19日 08:016900 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文騰訊大模型迎來人事大地震:姚順雨掌舵基礎模型發布於AI新閒資訊時間 :Aug 19, 2026閱讀 :1分鐘近日,騰訊混元多模態團隊經歷了一場深度的人事重組與戰略調整。原xAI多模態理解負責人藺旭東已正式加入騰訊混元,擔任多模態內容生成算法負責人。此次變動不僅伴隨著原多模態理解負責人胡瀚離職創業、前OpenAI研究員田永龍加入等一系列密集調整,更標誌著騰訊在多模態大模型研發路線上正發生深層次的路線重構。回顧騰訊混元過去的多模態發展史,其技術版圖主要圍繞幾大核心產品展開。

其中,文生視頻模型HunyuanVideo在2024年底首發即成為全球最大開源視頻生成模型,隨後在2025年密集擴展了圖生視頻、定製化生成以及數字人驅動等能力。圖像生成方面,從早期的HunyuanImage到支持原生2K分辨率的2.1版本及800億參數的3.0版本,不斷向工業級演進。此外,專注於單體3D模型的Hy3D也在電商建模和產品設計中廣泛應用。在空間智能領域,騰訊還推出了全球首個開源、支持仿真的沉浸式3D世界生成模型Hy World1.0及其後續版本,深度契合了空間智能的研究方向。

然而,隨著騰訊將大語言模型部和多模態模型部合併成立“基礎模型部”並由姚順雨全面接管,騰訊的多模態研發思路正面臨深刻轉變。在當前的技術路線上,業界對於多模態與智能主線的關係存在不同看法。李飛飛旗下的World Labs等觀點認為世界模型作為空間智能的一部分是AGI的重要主線,而DeepSeek等則主張將視覺模態作為服務於語言模型的工具,弱化獨立的3D或世界模型路線。從姚順雨近期的戰略佈局與旗艦產品Hy3的落地來看,其更傾向於後者的技術路線。姚順雨在公開場合多次強調,AI下半場的競爭壁壘在於上下文與推理能力,而非單純的模型參數量。

通過將多模態理解能力深度融合至基礎模型主線,優化工具調用穩定性與長上下文承接,騰訊正致力於提升模型在真實辦公、GUI Agent等產品落地中的理解與執行效率。藺旭東的加入,正是為了通過提升多模態理解能力,進一步解決生成模型中前後不一致、缺乏空間穩定性等痛點。這場重組不僅折射出騰訊內部技術路線的交替,也展現了其在AGI下半場競爭中堅定靠攏主線、聚焦生產力落地的戰略決心。相關推薦三年估值 30 億美元!大模型“中間商”演語科技如何靠搶跑衝刺港股IPO?演語科技不研發底層大模型,憑多款AI創作應用三年崛起,現啟動香港IPO,估值高達30億美元,引發AI應用層“中間商”商業價值與競爭壁壘探討。

Aug 18, 2026193.9k騰訊大模型人事調整:混元后訓練負責人徐燦轉崗微信WeLM騰訊大模型佈局調整:原混元資深研究員徐燦轉崗微信事業群,加入WeLM團隊,專注後訓練與Agent研發。徐燦曾創建WizardLM並提出Evol-Instruct,在合成數據、強化學習等領域積澱深厚。此舉正值微信AI加速落地期。Aug 14, 2026229.6k騰訊混元 Hy ASR3.0 預覽版發佈:從"聽清"到"聽懂",方言詞錯率壓到 3%騰訊混元發佈語音識別模型Hy ASR3.0 Preview,基於大語言模型Hy3,融合高精度識別與深度語義理解,實現從“逐字轉寫”到“理解語境”的質變。

模型覆蓋十大方言片區,長音頻場景優勢突出,不依賴標準普通話,讓AI不僅能聽清字,更能真正聽懂話。Aug 5, 2026235.2k騰訊混元發佈 Hy ASR 3.0 preview:語音識別不再逐字硬轉,而是真的聽懂了語境騰訊混元發佈語音識別模型Hy ASR3.0preview,基於大語言模型Hy3的語言理解能力,融合高精度識別與深度語義理解。它在通用識別、上下文感知、多場景魯棒性及方言覆蓋等方面全面提升,能結合語境給出更準確連貫的轉寫,實現從逐字轉寫到理解語義的進化。Aug 5, 20261,217.4k騰訊混元發佈Hy ASR3.

0preview:語音識別邁入“懂語境”新階段騰訊混元發佈語音識別模型Hy ASR3.0preview,首次將大語言模型Hy3的語義理解融入識別,實現從逐字轉寫向“理解語境、一鍵直出”跨越。在開源評測集上,中文普通話、英語、粵語詞錯誤率分別為3.34%、2.62%、3.12%,整體約3%,多維度表現亮眼。Aug 4, 2026260.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛
全天候科技生成式AI

企業AI最後一公里:三路人馬在此交鋒

鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。

剛剛