百度基礎模型換將,這一次把牌交給年輕人
重點摘要
百度近日調整基礎模型業務人事,將研發主導權交給年輕管理團隊,旨在加速模型迭代與應用落地。此舉呼應創辦人李彥宏的年輕化方針,外界預期將影響文心一言等大模型產品的後續發展。
百度近日在人工智慧基礎模型業務上啟動一波人事調整,將帶領核心研發團隊的責任交給了更年輕的管理者。這項變動揭示,百度正準備在下一代大模型技術競賽中,讓新世代人才承擔更關鍵的策略與研發角色。基礎模型長期以來是百度AI戰略的核心支柱,過去大多由資深研究人員主導架構設計與技術路線,如今換上年輕面孔,外界普遍解讀為百度希望藉此注入創新動能,加速模型迭代頻率與應用落地速度。消息指出,這波換將並非單一部門的例行性輪調,而是整體技術路線持續年輕化的一部分。百度內部認為,基礎模型領域變化極快,從訓練框架到數據策略、從模型壓縮到多模態融合,幾乎每個季度都會出現新的突破口。
年輕團隊在理解新趨勢、快速試錯與執行力上具有明顯優勢,能夠更靈活地因應市場變化,減少決策層級帶來的時間損耗。這項調整也呼應了百度創辦人李彥宏多次公開強調的「讓年輕人挑大樑」原則。李彥宏過去在內部會議與外部論壇中曾指出,人工智慧產業的迭代速度遠超過傳統軟體,組織必須讓具備前沿視野與高度學習力的年輕人才站上第一線。尤其在生成式AI競爭日益激烈的當下,誰能更快掌握技術脈動、誰能更早推出具競爭力的產品,誰就能在市場中取得先機。決策效率與技術敏銳度,已經成為勝出的關鍵要素。目前百度尚未對外公布具體的人事細節,包括接任者的姓名、過去經歷以及新團隊的組織架構。
不過業界普遍關注這項調整對百度旗下大模型產品文心一言的後續影響。文心一言是百度在生成式AI領域的主力產品,從對話系統到多模態生成,都依賴底層基礎模型的支援。一旦研發指揮權交到年輕一代手中,外界預期百度在模型架構設計、訓練方法改進以及應用場景拓展上,將出現更靈活的策略布局。從百度整體AI戰略來看,基礎模型的年輕化並非孤立事件。過去幾年,百度內部已經在自動駕駛、智慧雲端等業務中陸續推動管理層年輕化,讓一批八○後、九○後主管接棒。如今將這股年輕化浪潮延伸至最核心的基礎模型團隊,顯示百度對於下一代技術路線的判斷,認為需要更多來自一線實戰、對新技術敏銳度更高的聲音參與決策。
值得注意的是,基礎模型的研發週期長、投入成本高,且一旦方向錯誤,可能導致數百億甚至上千億資源的浪費。因此,將指揮權交給年輕人,同時也意味著百度內部對於年輕團隊的風險控管與技術判斷力具有一定程度的信心。業內分析認為,百度可能已經在過去一段時間內,讓這些年輕研究人員參與了關鍵專案的實戰訓練,累積了足夠的經驗,才能在這個時間點正式交棒。另一方面,生成式AI賽道的競爭格局正在快速變化。除了百度文心一言,包括OpenAI的GPT系列、Google的Gemini,以及中國市場內其他大廠與新創公司推出的模型,都在持續推升技術門檻。
在這種環境下,誰能更早實現模型能力的突破、誰能更快速地將模型部署到實際業務場景,誰就能占據主動。年輕化的人事布局,從某種角度而言,正是百度為了提升反應速度所做出的組織調整。從人才梯隊的角度觀察,百度這一步也帶有長期布局的意味。人工智慧領域的頂尖人才,尤其是具備基礎模型研發能力的研究員與工程師,近年來在全球都極為搶手。讓年輕人在公司內部有機會主導核心項目,不僅能留住關鍵人才,也能激發團隊的創新鬥志。相較於維持既有資深主管的穩定路線,百度選擇了一條更冒險但也可能帶來更大回報的路徑。當然,管理年輕化並非沒有挑戰。
基礎模型的研發需要深厚的理論基礎與系統性思考,年輕管理者雖然反應快、學習能力強,但在面對大規模系統設計、長期研究規劃以及跨部門協調時,可能仍需要一定的經驗補足。百度是否會在團隊中同時保留資深顧問或技術導師的角色,目前不得而知,但外界普遍認為,百度應該會有相應的配套機制來降低轉型過程中的風險。整體而言,百度此次在基礎模型業務上的人事調整,既是對內部人才梯隊的一次升級,也是對外部競爭環境的一次策略回應。隨著年輕一代開始主導最核心的AI技術研發,百度在文心一言等大模型產品上的更新速度與創新方向,勢必會出現新的變化。
業界將持續關注後續的人選公布,以及未來幾個月內百度在大模型領域的具體動作,來驗證這波年輕化是否真能為公司帶來預期中的競爭優勢。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。