宇樹智元共用一個大腦!神秘模型Demo炸場,10分鐘一鏡到底

2026年8月26日 13:55
宇樹智元共用一個大腦!神秘模型Demo炸場,10分鐘一鏡到底
站內 AI 整理稿

一段長達10分鐘、一鏡到底的機器人實測影片,近日在具身智慧與機器人產業圈內引發熱烈討論。畫面中,宇樹科技與智元機器人兩款硬體架構截然不同的機器人,竟然共享同一個「大腦」,並且在完全自主的狀態下彼此協作,接連完成擦窗、搬運箱子墊高、任務中斷後自主恢復等一系列長程操作。整段影片全程無剪輯、無遙控、也無任何人工指令介入,等於是在最嚴苛的條件下,讓兩台本體設計邏輯各異的機器人聯手跑完複雜流程,被部分觀察者視為全球罕見的跨本體通用大腦樣本。所謂「跨本體」,指的是不同廠商、不同機械結構、不同感測器配置的機器人,不再各自訓練專屬模型,而是直接共用同一套決策與感知系統。

過去具身智慧領域普遍認為,機器人的硬體差異會嚴重限制模型遷移,因此多數廠商傾向針對自家機型打造專用大腦。這次曝光的影片之所以受到矚目,正是因為它直接挑戰了這項預設——兩款機器人面對動態環境時,不僅能各自判斷下一步動作,還能協調分工,甚至在任務被打斷後自行修正路線、繼續完成目標。從影片內容來看,兩台機器人並非只是各自執行預先寫死的動作序列。在擦窗任務中,機器人需要先定位窗戶位置、判斷清潔範圍,再以適當力度與角度進行擦拭;在搬運箱子墊高的環節,兩台機器人則展現出明確的分工邏輯,一台負責搬運,另一台則在適當位置接手堆疊,過程中還必須應對箱子重量、重心變化與地面環境等變數。

最令業界驚豔的是任務中斷後的自主恢復能力——當流程被人為打斷時,機器人並沒有停擺或陷入錯誤迴圈,而是重新評估現場狀態、調整計畫,並自行回到任務軌道上,這在過去的機器人實測中相當少見。這項成果若屬實,可能對具身智慧產業的技術判斷與Scaling Law認知帶來深遠影響。過去業界常以「某個本體蒐集多少數據」來衡量模型潛力,但跨本體通用大腦的出現,意味著數據與能力的累積不再被單一硬體綁死,不同機器人之間的經驗可以互通,訓練效率與泛化能力可望大幅提升。

換句話說,未來機器人產業的競爭焦點,可能從「誰的硬體強」轉向「誰的大腦更通用」,而這也讓外界更加好奇,宇樹與智元背後究竟使用了什麼樣的神祕模型,才能讓兩台架構迥異的機器人展現出如此流暢的協作表現。值得注意的是,宇樹科技與智元機器人分別在機器人領域擁有不同的技術路線。宇樹以四足機器人與人形機器人的運動控制見長,產品強調靈活性與動態穩定性;智元機器人則更側重於具身智慧與通用操作的結合,試圖讓機器人在真實世界中具備更強的任務理解能力。兩家公司在硬體設計、感測器配置與運動控制邏輯上都有明顯差異,過去若要讓這兩種機器人協同作業,通常需要針對各自平台分別開發控制系統,再透過外部通訊協定進行協調。

然而這次影片顯示,兩台機器人似乎共享同一套高層決策系統,硬體差異被大幅淡化,這在技術上具有指標性意義。從產業角度來看,跨本體通用大腦若真的成熟,將直接改寫具身智慧領域的數據競爭邏輯。目前許多機器人公司投入大量資源,針對自家硬體蒐集操作數據,並以此訓練專屬模型。這種模式雖然有效,但數據蒐集成本高昂,且不同平台之間的數據無法互通,導致整個產業的技術進步呈現碎片化狀態。如果一套通用大腦可以同時驅動不同廠商的機器人,那麼數據的價值將不再受限於單一硬體平台,整個產業的數據累積效率與模型泛化能力都有機會出現跳躍式成長。當然,也有業界人士持保留態度。

跨本體通用大腦的訓練難度遠高於單一本體模型,因為不同機器人的關節配置、自由度、感測器類型與執行器響應特性都存在差異,模型必須在抽象層級上理解「任務目標」,而不是依賴特定硬體的低階控制指令。此外,影片中的任務雖然涵蓋多個環節,但相較於真實世界無限多變的場景,仍屬於相對受控的環境。要在更複雜、更動態的場域中實現同樣水準的跨本體協作,恐怕還需要更多驗證。不過,無論最終技術細節如何,這段影片已經成功在產業內投下震撼彈。它讓外界看到一種可能性:機器人的智慧不必被禁錮在特定的機械身軀中,同一套認知系統可以像人類的大腦一樣,指揮不同形態的身體完成任務。

這種「身心分離」的架構,正是許多人對通用人工智慧與機器人結合的終極想像之一。對於宇樹科技與智元機器人來說,這次合作曝光也釋放出明確的訊號——在具身智慧競賽中,單打獨鬥的時代可能正在過去,跨平台、跨本體的合作將成為新的競爭維度。兩家公司在各自領域都有深厚積累,如今聯手展示通用大腦的潛力,無疑會讓其他競爭對手重新思考自身的技術布局。外界目前最關心的,莫過於這個神秘模型究竟從何而來。是宇樹或智元內部自行研發的成果,還是雙方共同投資的第三方團隊所打造?模型採用了什麼樣的訓練架構?數據來源是否涵蓋兩家公司的機器人平台?

這些問題目前都沒有明確答案,但可以預見的是,隨著這段影片持續發酵,相關技術細節與合作內幕,可望在近期內逐步浮上檯面。無論如何,這段10分鐘的一鏡到底影片,已經為具身智慧產業打開了一扇新的窗。它不僅展示了兩台機器人協作完成複雜任務的能力,更暗示了一條不同於以往的技術路徑:當機器人的「大腦」不再受限於「身體」,整個產業的遊戲規則,或許即將迎來一次深刻的重新定義。

Related

相關文章

IT之家模型更新

Cloudflare 稱 AI 智能體已佔 60% 互聯網流量,同比激增 1700%

首頁 > 智能時代>人工智能 Cloudflare 稱 AI 智能體已佔 60% 互聯網流量,同比激增 1700% 2026/8/26 15:41:18 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 26 日消息,韓媒 chosun 昨日(8 月 25 日)發佈博文,報道稱 Cloudflare 亞太區執行副總裁兼董事總經理 Goran Risticsevich 表示,由 AI 智能體產生的流量在過去 1 年中激增逾 1,700%,目前約佔總流量的 60%。Risticsevich 出席本週二在韓國首爾舉辦的媒體發佈會,IT之家翻譯其演講內容如下:AI 智能體產生的流量比去年同期(原文並未明確具體月份 / 季度)增長了 1,700% 以上,網絡上約 60% 的流量來自 AI 智能體。在構建智能體型互聯網基礎的同時,我們也需要以與創新同步的速度應用 AI 安全技術。互聯網最初是為人而建的,但現在流量是由以機器速度運行的 AI 智能體產生的。一個人可能要瀏覽四五個網站來研究或計劃一次旅行,而 AI 智能體可以同時連接到成千上萬個網站和服務器來執行同樣的任務。隨著 AI 智能體代表用戶同時訪問多項服務,攻擊面正在不斷擴大。Cloudflare 將“影子 AI”列為日益嚴峻的隱患,員工在工作中使用未經批准的 AI 工具,可能導致敏感內部數據暴露給外部模型。該公司還警告稱,模型上下文協議(MCP)的快速普及催生了“影子 MCP”風險:該協議負責將 AI 應用連接至外部工具和內部系統,而未經授權的協議連接可能繞過企業管控措施。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Cloudflare,AICloudflare 復現遠程“幽靈”攻擊:99% 準確率、每秒 12 bits 提取數據Cloudflare:中國是 2026 上半年受 D

剛剛
鈦媒體模型更新

實測豆包工作:WorkBuddy迎來最強對手?

實測豆包工作:WorkBuddy迎來最強對手?AIX財經2026.08.26 10:00 · 來自福建全文4573字00:00 / 14:08一週補全能力,豆包工作好用嗎?文 | AIX財經,作者 | 雷晶,編輯 | 金璵璠8月25日,字節跳動正式發佈AI辦公Agent產品豆包工作。豆包工作的模型提供自動、豆包2.1 Pro和豆包2.1 Turbo三種選擇,用戶可以根據任務複雜度選擇不同能力。使用入口也比較多,既可以下載獨立App,也可以直接在豆包APP的工作任務區使用,還能從飛書內調用。相比市面上的同類Agent應用,豆包工作最大的特點在於與飛書深度打通,可以在權限範圍內調用企業協作場景中的文檔、聊天記錄、會議紀要等信息,讓Agent參與到日常辦公任務中。在正式發佈之前,豆包用一週時間連續更新了多項辦公Agent能力。8月17日,手機遠程控制電腦上線,用戶可以通過手機訪問電腦文件,直接調取和處理分散在不同設備中的資料。8月18日,Windows虛擬桌面上線,AI可以在獨立環境中執行任務,避免影響用戶自己的電腦環境。8月20日,側邊工作臺上線,將本地文件、飛書文檔、網頁和代碼等內容集中到同一個工作空間。8月21日,技能商店、連接器和工作夥伴功能推出,讓用戶可以將常用流程沉澱下來,後續重複調用。這一系列更新補充了Agent進入辦公場景所需要的幾個環節,既能操作電腦和調用資料,也能在獨立環境中執行任務,還開始嘗試把一次性的操作沉澱為可複用流程。此外,字節也在調整AI辦公業務佈局。8月24日,有媒體爆出TRAE、釦子(Coze)團隊併入豆包體系,其中TRAE Work、釦子將與豆包在工作場景的產品能力進行整合,TRAE IDE及CLI則作為豆包品牌下的編程產品線繼續發展。在這一背景下,作為字節面向AI辦公場景推出的Agent產品,豆包工作實際效果體驗如何呢?我們來一起看看。01.

剛剛
MarkTechPost AI模型更新

IBM 推出 Granite 4.2:為開放企業模型帶來原生推理與代理式強化學習

IBM 推出 Granite 4.2,這是一系列開放推理語言模型,提供 3B、8B 與 30B 參數規模。有別於先前以指令遵循助理為主的 Granite 版本,Granite 4.2 以明確推理能力為核心;每個模型都能在回答前輸出思維鏈(chain of thought),並具備思考/非思考切換,以及低努力模式,能對簡單問題只消耗較短的推理預算。這些模型是 decoder-only 密集 Transformer,從零開始以約 15 兆個 token 預訓練,再透過多階段強化學習鏈進行後訓練。其中 8B 與 30B 的強化學習鏈包含代理式 RL 區塊,讓模型在真實沙箱環境中學習編輯程式碼、操作終端機與執行網頁搜尋。三款模型皆以 Apache 2.0 授權釋出。

2 小時前
雷峰網模型更新

大廠AI To B大戰,這回戰場為什麼是辦公?

大廠AI To B商業化的戰火,已經燒到AI辦公。內部賽馬、業務整合、資源重配,過去一個多月,騰訊、阿里、字節三家大廠幾乎同時將AI資源砸向辦公場景。“AI作為生產力工具,最終還是得企業來買單。”一場圍繞AI辦公的To B大戰,正在升溫。前兩週,兩家大廠披露的財報,也已經透出了些許硝煙:從騰訊Q2財報及業績會看,WorkBuddy用戶快速增長的同時,付費意願也在增強,付費用戶毛利率已經與騰訊雲整體毛利率相當。剛推出不久的千問辦公,已被阿里寫入2027 Q1財報(對應自然年Q2)。

4 小時前