姚順雨的OpenAI前同事,也加入騰訊了
重點摘要
OpenAI前研究員田永龍加入騰訊大語言模型部,將參與視覺語言模型研發。他曾在OpenAI參與GPT-5開發,並於Google Research及DeepMind長期研究視覺表徵與對比學習。這是騰訊近期持續引進頂尖AI人才、強化混元多模態模型實力的最新動作。
前 OpenAI 研究員田永龍(Yonglong Tian)近日正式加入騰訊大語言模型部門,後續將投入視覺語言模型(VLM)相關研發工作。這項消息由業界人士證實,也讓騰訊在頂尖 AI 研究人才的延攬上再添一員大將。田永龍在 OpenAI 期間曾參與 GPT-5 的開發,這段經歷讓他在大規模語言模型的實戰經驗上具備極高價值。而在加入 OpenAI 之前,他長期服務於 Google Research 與 DeepMind,主要鑽研視覺表徵學習與對比學習等方向,這些研究成果對後續視覺模型以及多模態表徵學習的發展帶來深遠影響。
學術成就方面,田永龍是經典論文《Supervised Contrastive Learning》的作者之一。該論文提出監督對比損失(SupCon Loss),將原本用於自監督學習的批次對比方法成功拓展到全監督場景。採用此策略的 ResNet-200 卷積神經網路,在 ImageNet 資料集上達到 81.4% 的 Top-1 準確率,展現出極佳的效能。此外,田永龍還是《Contrastive multiview coding》論文的第一作者。
這篇論文提出對比多視圖編碼(CMC),核心概念是透過對比學習,讓同一場景的不同視圖(例如顏色通道、深度資訊、光流)在特徵空間中彼此靠近,同時讓不同場景的視圖互相遠離,藉此最大化視圖間共享的互信息,並丟棄視圖特有的噪聲。實驗結果顯示,該方法在圖像與影片的無監督學習任務上達到當時最先進水準,且視圖數量越多,表徵效果越好。這項工作深刻影響了後續的 SimCLR、MoCo 等主流自監督學習方法。根據 Google Scholar 統計,截至今日,田永龍的論文已被引用達 29,330 次,學術影響力相當可觀。
在學歷背景上,田永龍本科畢業於清華大學,隨後前往香港中文大學攻讀碩士學位,師從已故的中國電腦視覺領域先驅湯曉鷗,以及其得意門生王曉剛。湯曉鷗與王曉剛均為商湯科技聯合創始人,王曉剛目前擔任商湯首席科學家。之後田永龍赴麻省理工學院攻讀博士,指導教授是知名電腦視覺學者 Phillip Isola。博士畢業後,田永龍先加入 Google Research 擔任資深研究科學家,隨後轉至 DeepMind 擔任相同職務。2024 年 10 月,他正式加入 OpenAI 成為研究團隊成員,直至近期轉投騰訊。業界分析認為,田永龍的加盟很可能是騰訊在多模態大模型與視覺語言行動模型(VLA)領域的針對性人才補強。
他的專長涵蓋視覺編碼與跨模態對齊等關鍵技術,有望為騰訊下一代混元多模態模型提供直接支撐。就在本週一,騰訊正式推出 Hy3(混元 3)模型。據官方說明,Hy3 在複雜推理、指令遵循、程式撰寫與智能體能力等方面,較前一代 Hy2 有顯著提升。這款新模型的問世,也凸顯出騰訊在大模型技術路線上的加速推進。事實上,田永龍並非近期唯一加入騰訊的頂尖 AI 研究員。去年,前 OpenAI 研究員、智能體領域知名學者姚順雨已加入騰訊,出任「CEO/總裁辦公室」首席 AI 科學家。
今年年初,騰訊宣布前新加坡 Sea AI Lab(SAIL)研究員龐天宇加盟混元多模態部 Exploration Center,擔任混元多模態強化學習首席研究員及技術負責人,主攻強化學習前沿演算法探索。此外,在多模態生成方面,騰訊在 2025 年還陸續延攬了原阿里巴巴通義實驗室應用視覺團隊負責人薄列峰、以及微軟亞洲研究院原首席研究員胡瀚等重量級人物。這些人才的加入,讓騰訊混元團隊的研發實力持續壯大。隨著原生多模態能力已成為基礎模型的標配,騰訊持續引進頂尖 AI 研究人才、擴充混元研發團隊,下一步在原生多模態模型、VLA 模型等領域會有哪些新進展,值得業界持續關注。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。