宇樹科技發佈UnifoLM-OminiA-0.3,實現人形機器人多任務自主執行
重點摘要
AI資訊AI新閒資訊正文宇樹科技發佈UnifoLM-OminiA-0.3,實現人形機器人多任務自主執行發布於AI新閒資訊時間 :Jul 21, 2026閱讀 :1分鐘宇樹科技近日發佈人形機器人通用智能模型UnifoLM-OminiA-0.3,該模型支持全模態交互理解,可統籌家居、康養等多場景任務,實現機器人從環境感知、任務理解到自主執行的完整閉環。
宇樹科技近日正式發表人形機器人專用通用智能模型 UnifoLM-OminiA-0.3,這款模型以全模態交互理解為核心架構,能夠整合視覺、語言與動作控制,讓機器人從環境感知、任務理解到自主執行形成完整閉環。根據官方公布的資訊,該模型已在宇樹科技旗下人形機器人 G1 平台上完成部署,並透過實際演示影片展現出多種日常生活場景中的自主作業能力,引起業界高度關注。 在演示影片中,搭載 UnifoLM-OminiA-0.3 的 G1 機器人展現出相當靈活的任務執行力。例如,它能準確辨識地面上的抱枕,並以流暢的動作將其搬運至沙發上;也能根據視覺資訊判斷物品的顏色與數量,在面對三盒不同顏色的藥品時,機器人可依照使用者口頭指令,從中精準抓取指定位置的藥盒。這些操作不僅考驗機器人的視覺辨識能力,更依賴於模型對複雜指令的語意理解與動作規劃。 除了物品辨識與搬運,影片還展示了機器人在家務整理方面的表現。G1 能夠將散落的衣物逐一摺疊並歸位,也能將餐盤平穩放入洗碗機,甚至可依照指令調整病床的高度,顯示出該模型在居家照護與康養場景中的應用潛力。這些任務涵蓋了從簡單抓取到需要多步驟協調的複雜動作,展現了 UnifoLM-OminiA-0.3 在真實環境中的適應能力。 在人機互動層面,該模型支援視覺辨識與自然語言理解,使用者可以透過口語指令直接指揮機器人。例如,當機器人正在執行某項操作時,用戶只要說出「停」,機器人便會立即中止動作,避免誤操作或危險情況。這種即時響應機制不僅提升了安全性,也讓非專業使用者更容易上手操控。 UnifoLM-OminiA-0.3 的完整閉環流程涵蓋了三個關鍵環節:首先是環境感知,透過攝影機與感測器擷取周圍資訊;其次是任務理解,利用大語言模型與視覺模型解讀使用者意圖;最後是自主執行,將規劃結果轉化為機器人的精確動作。這種從感知到行動的無縫串接,使人形機器人不再只是預設程式的執行工具,而是具備一定自主決策能力的智慧體。 宇樹科技表示,這款模型是該公司在通用人工智能(AGI)與物理人工智慧(Physical AI)兩大領域融合的重要成果。過去人形機器人往往只能執行單一或經過高度訓練的特定任務,而 UnifoLM-OminiA-0.3 的出現,讓機器人能夠在未經大量場景專屬訓練的情況下,直接理解並完成多種不同類型的家務與照護工作。 從技術架構來看,UnifoLM-OminiA-0.3 採用全模態交互設計,能同時處理視覺、語音、觸覺等多種資訊來源,並在內部建立統一的表徵空間。這使得機器人可以在同一場景中同時關注多個目標,例如一邊整理衣物一邊留意用戶的語音指令,而不會因任務切換而中斷整體流程。 目前該模型主要應用於宇樹科技的 G1 人形機器人平台,但官方並未排除未來將其擴展至其他硬體載體的可能性。G1 本身具備高度的運動靈活性與關節控制精度,與 UnifoLM-OminiA-0.3 的結合,讓機器人能在狹小空間內完成如放入洗碗機、調節病床高度等需要精細動作的任務。 在居家場景中,這項技術的潛在應用相當廣泛。例如,機器人可以協助長者或行動不便者拿取藥品、整理環境、調整家具,甚至能在緊急情況下依指令立即停止動作,降低意外風險。在康養機構中,機器人也可分擔護理人員的重複性勞動,提升照護效率與品質。 業界分析認為,宇樹科技此次發布的模型,標誌著人形機器人從實驗室展示走向實際應用的重要一步。過去人形機器人雖然在運動控制上取得不少進展,但在理解複雜任務並自主執行方面仍存在瓶頸。UnifoLM-OminiA-0.3 透過大模型與物理控制的結合,為解決這項難題提供了可行的技術路徑。 隨著模型參數與訓練資料的不斷累積,未來 UnifoLM 系列可望支援更複雜的任務,例如多機器人協作、動態環境中的即時規劃等。宇樹科技也將持續最佳化模型在邊緣運算裝置上的執行效率,讓機器人能在不依賴雲端伺服器的情況下完成即時決策。 從整個產業發展來看,人形機器人通用智能模型的出現,可能加速機器人在家庭、醫院、商場等非結構化環境中的普及。當機器人不再需要針對每個場景反覆編寫程式,而能透過自然語言與視覺理解使用者需求時,其應用門檻將大幅降低。 宇樹科技並未透露 UnifoLM-OminiA-0.3 的具體參數規模或訓練方法,但從展示成果來看,該模型已具備初步的通用性與實用性。未來隨著更多測試與迭代,人形機器人可望在更多真實場景中扮演輔助角色,而這款模型的推出無疑為這條道路鋪設了關鍵的技術基石。
Related
相關文章

機器人走錯路了?與蘇度韓錚聊聊具身智能的3D數據、路徑分野與硅谷競賽
這篇消息聚焦「機器人走錯路了?與蘇度韓錚聊聊具身智能的3D數據、路徑分野與硅谷競賽」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

5.83倍加速,PolicyTrim:讓VLA機器人少走彎路、更快完成任務
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

2026WAIC收官,看見物理AI的落地與未來
2026 年世界人工智能大會(WAIC)正式落幕,本屆大會的主軸明確聚焦於「物理 AI」的落地與未來發展。從展場上的各項技術展示可以看出,AI 不再只是停留在虛擬世界的演算法與模型,而是開始大規模進入工廠、街道、家庭等真實物理空間,與機器人、自動駕駛、智慧製造等硬體深度結合,展現出具身智能的實際應用潛力。

WAIC裡不只有AI丨WAIC2026
WAIC裡不只有AI丨WAIC2026Leo張ToB雜談2026.07.21 12:47 · 來自北京全文6302字00:00 / 11:22AI不是孤立的浪潮,而是一場需要全產業鏈協同的系統性演進。這是我們連續第三年參加WAIC這場全球AI盛會。今年最深的一個印象就是,AI已經真正走到生活、生產之中,並改變了絕大部分產業。

機器人能表演幹活了,但行業還需要更多刁鑽的“壞人”
機器人技術的進步讓它們能流暢表演各類工作,從工廠組裝到服務接待皆可勝任,但行業內卻浮現一個關鍵困境:缺乏足夠「刁鑽的壞人」。這些「壞人」並非破壞者,而是對機器人要求極端嚴苛的測試者或客戶;他們擅長設計突發狀況、極端指令或複雜障礙,迫使機器人暴露隱藏短板。目前許多示範看似完美,卻常在真實場景中因小細節失靈,正說明這種挑剔角色的重要性。

機器人進廠打工?先讓人工智障們找著“門”
機器人進廠打工的敘事在2026年達到新的高峰,然而從WAIC 2026現場的展品與討論來看,具身智能產業正浮現明顯的「涼熱交織」局面。展場上到處是準備取代產線工人的雙足機器人,但真正能穩定通過工廠大門、完成連續工序的實例依舊屈指可數。資本端與媒體端對「進廠」故事的熱情,並未消除技術端在真實物理世界中的巨大落差,行業正處在從展示性Demo過渡到工業級可靠性的尷尬爬坡期。