百度袁佛玉:從模型進化、數據迴流到應用接管,具身智能進入場景落地關鍵階段

2026年8月19日 08:49
站內 AI 整理稿

具身智能產業關注的重點正從“能力湧現”進入“生產力兌現”階段,拼的不只是單一模型能力。8 月 19 日下午,在北京舉行的 2026 世界機器人大會上,百度集團副總裁袁佛玉表示,機器人從“會展示”到“能上崗,需要模型、數據與應用協同形成的系統能力。百度集團副總裁 袁佛玉 模型從理解語言,走向理解和預測物理世界 機器人真正進入物理世界,僅理解語言並不夠,還要理解物體關係、動作後果及環境變化。隨著 VLA、世界模型和運動控制加速演進,計算工程系統也面臨更高要求。

袁佛玉指出,依託百度百舸 AI 計算平臺,百度智能雲持續完善面向具身智能的 AI Infra,支持企業完成從數據處理、模型訓練、仿真評測到真機推理部署的研發全流程,推動模型從研究原型走向工程系統;在部分合作中,單步推理延遲已進入百毫秒以內區間。數據從訓練材料,變成具身智能最核心的生產要素 具身數據採集成本高、標準不一,且與具體本體、任務和環境高度相關。袁佛玉認為,未來的重要競爭要素,在於企業積累了多少有效任務小時、捕獲了多少高價值失敗樣本,以及形成了多少能夠迴流訓練的數據。相比重複完成同一動作,失敗、糾正、人工接管和邊界案例數據,更可能暴露模型真正缺失的能力。

百度智能雲圍繞數據採集、處理、評測與部署迴流建設數據 Infra,推動數據、模型和場景形成產業飛輪。應用從展示能力,走向接管高價值任務 袁佛玉表示,具身智能商業化不會從替代完整崗位開始,而會從工業上下料、物料搬運、質量檢測、園區巡檢等邊界清晰、結果可度量的任務切入。場景能否成立,關鍵在於任務成功率、人工接管率和單位任務成本能否持續改善。為支持規模化部署,百度智能雲圍繞多模態人機交互及雲、管、端安全提供支持。但要讓具身任務從一個場景複製到更多場景,還需要標準化與場景持續開放。

未來,百度智能雲將持續以 AI Infra、數據 Infra 及應用與安全基礎設施,協同具身企業與場景方,探索從試點走向規模化落地的關鍵路徑。

Related

相關文章

鈦媒體生成式AI

王興興“錯配”梁文鋒?

王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛