獨家|姚順雨前同事田永龍加盟騰訊
重點摘要
獨家|姚順雨前同事田永龍加盟騰訊 本文作者: 成妍菁 2026-07-17 17:27 導語:鵝廠AI版圖再添一員猛將 雷峰網獨家獲悉, OpenAI 前研究員 Yonglong Tian(田永龍)已於近期加入騰訊,知情人士透露,其後續或將參與參與 VLM(視覺語言模型)相關研發。一位與其相熟的人士向雷峰網(公眾號:雷峰網)表示,田永龍在圈內口碑不錯,“人挺好,與姚順雨關係也不錯”。
OpenAI 前研究員田永龍(Yonglong Tian)已於近期正式加入騰訊,這項消息由雷峰網獨家證實。據知情人士透露,田永龍後續可能參與騰訊在視覺語言模型(VLM)領域的研發工作。一位與田永龍相熟的人士向雷峰網表示,他在業界口碑良好,為人親和,與 OpenAI 時期共事過的姚順雨也保持著不錯的關係。田永龍此前在 OpenAI 擔任技術人員(Member of Technical Staff),主要研究方向涵蓋計算機視覺、視覺表徵學習(Representation Learning)以及生成式模型。在加入 OpenAI 之前,他在「谷歌系」累積了多年經驗。
2022 年底,他加入位於劍橋的 Google Research 擔任高級研究科學家,並於 2024 年 5 月轉入 Google DeepMind,持續深耕視覺相關領域。從學經歷來看,田永龍屬於典型的「視覺系」研究員。他本科畢業於清華大學,隨後在香港中文大學取得研究碩士學位,之後赴美國麻省理工學院(MIT)攻讀博士。博士期間,他的研究重點集中在對比學習、視覺表徵學習等方向,並曾參與 SupContrast 等開源專案,在學術社群中具有一定知名度。值得注意的是,田永龍與騰訊混元核心成員姚順雨有過在 OpenAI 階段的共事經歷。
姚順雨同樣是 AI 領域的知名研究員,此前從 OpenAI 回國加入騰訊,負責混元大模型的相關研發工作。兩人在 OpenAI 時期建立的良好合作關係,被視為田永龍選擇加盟騰訊的重要因素之一。結合田永龍的研究背景來看,他的專業方向與騰訊當前重點投入的多模態能力相當契合。騰訊近年來持續強化 AI 版圖,尤其在視覺語言模型、多模態理解等領域積極布局,先後延攬多位頂尖研究人才。田永龍的加入,將進一步充實騰訊在視覺表徵學習與生成式模型方面的研發實力,有助於加速混元大模型在圖像、影片等多模態場景的應用落地。
業界分析指出,田永龍在對比學習和視覺表徵學習上的深厚功底,對於提升模型對視覺資訊的理解與生成能力至關重要。隨著大模型競賽從純文字走向多模態,具備視覺系背景的研究員成為各大廠商爭相延攬的對象。騰訊此舉,顯然是為了在下一階段的 AI 競賽中站穩腳跟。目前,騰訊混元大模型已具備多模態理解與生成能力,並在騰訊雲、微信、QQ 等產品中逐步落地。田永龍的加入,預計將為相關技術的迭代提供關鍵助力。騰訊官方尚未對此事發表評論,但業內普遍看好這項人事布局。雷峰網也持續關注互聯網大廠的 AI 業務與人員動態。
田永龍的職業路徑,從清華、港中文、MIT 到 Google Research、OpenAI,再到如今加入騰訊,展現了頂尖 AI 研究員的典型發展軌跡。隨著更多海外人才回流或加入中國企業,國內 AI 產業的研發實力有望進一步提升。未來,田永龍在騰訊的具體角色與研究方向,仍有待官方進一步公布。但可以預見的是,他在視覺語言模型領域的經驗,將為騰訊的多模態大模型帶來新的突破契機,也為整個 AI 行業注入更多想像空間。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。