宇樹科技發佈UnifoLM-OminiA-0.3,實現人形機器人多任務自主執行

2026年7月21日 10:025000 次瀏覽

重點摘要

AI資訊AI新閒資訊正文宇樹科技發佈UnifoLM-OminiA-0.3,實現人形機器人多任務自主執行發布於AI新閒資訊時間 :Jul 21, 2026閱讀 :1分鐘宇樹科技近日發佈人形機器人通用智能模型UnifoLM-OminiA-0.3,該模型支持全模態交互理解,可統籌家居、康養等多場景任務,實現機器人從環境感知、任務理解到自主執行的完整閉環。

站內 AI 整理稿

宇樹科技近日正式發表人形機器人專用通用智能模型 UnifoLM-OminiA-0.3,這款模型以全模態交互理解為核心架構,能夠整合視覺、語言與動作控制,讓機器人從環境感知、任務理解到自主執行形成完整閉環。根據官方公布的資訊,該模型已在宇樹科技旗下人形機器人 G1 平台上完成部署,並透過實際演示影片展現出多種日常生活場景中的自主作業能力,引起業界高度關注。在演示影片中,搭載 UnifoLM-OminiA-0.3 的 G1 機器人展現出相當靈活的任務執行力。

例如,它能準確辨識地面上的抱枕,並以流暢的動作將其搬運至沙發上;也能根據視覺資訊判斷物品的顏色與數量,在面對三盒不同顏色的藥品時,機器人可依照使用者口頭指令,從中精準抓取指定位置的藥盒。這些操作不僅考驗機器人的視覺辨識能力,更依賴於模型對複雜指令的語意理解與動作規劃。除了物品辨識與搬運,影片還展示了機器人在家務整理方面的表現。G1 能夠將散落的衣物逐一摺疊並歸位,也能將餐盤平穩放入洗碗機,甚至可依照指令調整病床的高度,顯示出該模型在居家照護與康養場景中的應用潛力。這些任務涵蓋了從簡單抓取到需要多步驟協調的複雜動作,展現了 UnifoLM-OminiA-0.3 在真實環境中的適應能力。

在人機互動層面,該模型支援視覺辨識與自然語言理解,使用者可以透過口語指令直接指揮機器人。例如,當機器人正在執行某項操作時,用戶只要說出「停」,機器人便會立即中止動作,避免誤操作或危險情況。這種即時響應機制不僅提升了安全性,也讓非專業使用者更容易上手操控。UnifoLM-OminiA-0.3 的完整閉環流程涵蓋了三個關鍵環節:首先是環境感知,透過攝影機與感測器擷取周圍資訊;其次是任務理解,利用大語言模型與視覺模型解讀使用者意圖;最後是自主執行,將規劃結果轉化為機器人的精確動作。這種從感知到行動的無縫串接,使人形機器人不再只是預設程式的執行工具,而是具備一定自主決策能力的智慧體。

宇樹科技表示,這款模型是該公司在通用人工智能(AGI)與物理人工智慧(Physical AI)兩大領域融合的重要成果。過去人形機器人往往只能執行單一或經過高度訓練的特定任務,而 UnifoLM-OminiA-0.3 的出現,讓機器人能夠在未經大量場景專屬訓練的情況下,直接理解並完成多種不同類型的家務與照護工作。從技術架構來看,UnifoLM-OminiA-0.3 採用全模態交互設計,能同時處理視覺、語音、觸覺等多種資訊來源,並在內部建立統一的表徵空間。這使得機器人可以在同一場景中同時關注多個目標,例如一邊整理衣物一邊留意用戶的語音指令,而不會因任務切換而中斷整體流程。

目前該模型主要應用於宇樹科技的 G1 人形機器人平台,但官方並未排除未來將其擴展至其他硬體載體的可能性。G1 本身具備高度的運動靈活性與關節控制精度,與 UnifoLM-OminiA-0.3 的結合,讓機器人能在狹小空間內完成如放入洗碗機、調節病床高度等需要精細動作的任務。在居家場景中,這項技術的潛在應用相當廣泛。例如,機器人可以協助長者或行動不便者拿取藥品、整理環境、調整家具,甚至能在緊急情況下依指令立即停止動作,降低意外風險。在康養機構中,機器人也可分擔護理人員的重複性勞動,提升照護效率與品質。業界分析認為,宇樹科技此次發布的模型,標誌著人形機器人從實驗室展示走向實際應用的重要一步。

過去人形機器人雖然在運動控制上取得不少進展,但在理解複雜任務並自主執行方面仍存在瓶頸。UnifoLM-OminiA-0.3 透過大模型與物理控制的結合,為解決這項難題提供了可行的技術路徑。隨著模型參數與訓練資料的不斷累積,未來 UnifoLM 系列可望支援更複雜的任務,例如多機器人協作、動態環境中的即時規劃等。宇樹科技也將持續最佳化模型在邊緣運算裝置上的執行效率,讓機器人能在不依賴雲端伺服器的情況下完成即時決策。從整個產業發展來看,人形機器人通用智能模型的出現,可能加速機器人在家庭、醫院、商場等非結構化環境中的普及。

當機器人不再需要針對每個場景反覆編寫程式,而能透過自然語言與視覺理解使用者需求時,其應用門檻將大幅降低。宇樹科技並未透露 UnifoLM-OminiA-0.3 的具體參數規模或訓練方法,但從展示成果來看,該模型已具備初步的通用性與實用性。未來隨著更多測試與迭代,人形機器人可望在更多真實場景中扮演輔助角色,而這款模型的推出無疑為這條道路鋪設了關鍵的技術基石。

Related

相關文章

100微米與10微米之間,眼科手術機器人的“極限運動”

眼科手術機器人旨在協助醫生在100微米至10微米的極細微尺度上進行精準操作,克服人類手部顫抖與反應延遲的生理極限。目前主要發展遠端操控與共操控兩條技術路線,在視網膜下注射、白內障手術等領域展現優勢,但面臨體積大、成本高、學習曲線陡峭等挑戰。隨著人工智慧導入,機器人正從被動輔助邁向主動決策支援,有望成為未來常規眼科手術的關鍵工具。

53 分鐘前

A股人形機器人第一股來了,宇樹IPO倒計時,誰將成最大贏家?

宇樹科技正式啟動科創板IPO初步詢價,預計8月10日開放申購,計劃募資42.02億元,發行估值約420億元,將成為A股首檔純正人形機器人概念股。這家成立於2016年的公司,從四足機器人跨足人形機器人領域,此次上市不僅為早期投資者帶來可觀回報,也象徵人形機器人賽道在資本市場獲得正式認可。市場關注其上市後能否維持技術優勢並實現商業化量產,股價表現將為整個行業提供重要參考。

3 小時前

王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態

首頁 > 智能時代>具身智能 王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態 2026/8/7 14:56:22 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 7 日消息,據澎湃新聞消息,宇樹科技董事長、總經理兼首席技術官王興興今天在網上路演時表示,本次登陸資本市場,是宇樹科技全新的起點。

5 小時前

衝刺全球首個100萬小時具身數據!三家國產公司,聯手了

三家國產機器人公司宣布聯手,目標累積全球首個一百萬小時的具身數據,以強化機器人從感知到執行的全鏈路訓練基礎。此次合作整合本體製造、感測器與數據平台等優勢,試圖打通數據獲取到模型訓練的完整閉環,並建立共享數據標準與交換機制。若目標達成,不僅將刷新全球具身數據規模紀錄,也可能為中國在AI競爭中搶下機器人學習基礎設施的定義權。

11 小時前

宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品

AI資訊AI新閒資訊正文宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品發布於AI新閒資訊時間 :Aug 7, 2026閱讀 :1分鐘8月7日,宇樹科技創始人兼CEO王興興在網上路演中表示,公司登陸資本市場是新的起點,未來將持續深耕通用具身智能機器人核心技術研發與產業應用,推動智能機器人更早進入社會服務場景。

12 小時前6300

IJCAI 2026 專訪:機器人想學會人類動作,還差一座橋 | GAIR Paper 118

進群傳送門: 掃碼進群或添加微信Qvv0909777,備註:IJCAI + 單位/學校+姓名+方向。搞科研/搞技術,信息差很重要。來,一起快人一步!上車,帶你看遍全球 AI 頂會精華可獨家暢覽:專家演講PPT大會報告全文熱門論文解讀學術新星訪談掃描上方二維碼或點擊「閱讀原文」關注專區。

14 小時前