宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解

2026年7月20日 15:22
宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解

重點摘要

首頁 > 智能時代>人工智能 宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解 2026/7/20 15:22:09 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 HH_KK、江山已舊 的線索投遞! IT之家 7 月 20 日消息,今日宇樹科技發佈宇樹 UnifoLM-OminiA-0.3,單模型統籌家居康養多任務,支持全模態交互理解,全程自主,穩定執行抗干擾。

站內 AI 整理稿

宇樹科技於今日(7月20日)正式發表新一代人工智慧模型「UnifoLM-OminiA-0.3」,這款模型主打全模態交互理解能力,能夠以單一模型統籌執行多種居家康養場景中的複雜任務,從物品辨識、搬運到精細操控與設備控制,全程自主運作並具備抗干擾能力。根據官方公布的演示影片,該模型已在宇樹的人形機器人G1上完成實際應用測試,展現出從感知到行動的完整閉環。此次發表的UnifoLM-OminiA-0.3模型,核心特色在於其「全模態」互動理解能力。

不同於過去需要分別訓練視覺、語言、動作等不同模組的作法,宇樹科技宣稱此模型能將多種感知輸入(如影像、語音、觸覺等)與行動輸出整合在同一個神經網路架構中,讓機器人面對複雜家居環境時,不需要外部指令拆分或人工介入,就能直接理解使用者意圖並做出適當反應。在實際任務演示中,機器人G1首先展示了物品搬運功能:它能辨識地上的一個抱枕,並自主將其拾起放到沙發上。過程中,機器人還能同時回答使用者提出的問題,例如當被問及抱枕的顏色時,它立即回應「白色」。更進一步,機器人還能辨識桌上的藥盒,準確說出藥盒的數量(三個)以及各自的顏色(紅、藍、黃)。

這些視覺辨識與語言回答幾乎同步進行,顯示模型在跨模態訊息處理上的即時性。除了基礎的辨識與搬運,UnifoLM-OminiA-0.3還支援精細操作。演示中,機器人能夠將原本放在第三層的藍色藥盒取出,並放到最上層;同時也能將散落的衣服放進髒衣簍,或將盤子平穩地放入洗碗機中。這些動作需要機器人協調手臂、手指的力度與角度,並根據物體形狀與位置即時調整,顯示模型在運動控制上的精準度。另一個值得關注的亮點是設備控制能力。在演示中,機器人成功操作了醫療病床的升降功能,並在使用者喊出「停」的瞬間立即停止運動,展現出對語音指令的即時反應與安全中斷機制。

這對於居家康養場景中常見的長者照護或復健輔助,具有實際應用價值。宇樹科技表示,UnifoLM-OminiA-0.3是該公司在人形機器人G1上整合通用人工智慧(AGI)與物理人工智慧(Physical AI)技術的重要里程碑。透過這個模型,機器人不再只是被動執行預設程式的工具,而是能主動理解環境、與人自然互動,並根據即時狀況調整行動策略。這項技術的突破,也讓宇樹在機器人從感知到行動的完整閉環中,跨出了關鍵一步。從技術架構來看,UnifoLM-OminiA-0.3採用的是單一模型統一處理多種任務的設計哲學。

傳統上,機器人需要分別搭載物體辨識模型、語音辨識模型、路徑規劃模型、動作控制模型等,彼此之間需要複雜的介面與協調機制。而宇樹的新模型則試圖以一個端到端的架構,直接將視覺、聽覺、語言理解與運動控制整合在同一網路中,減少延遲與溝通誤差,提升整體執行效率與穩定性。這項技術的發表,也反映出宇樹科技在機器人領域的長期布局。過去該公司以四足機器人聞名,近年則積極投入雙足人形機器人G1的研發,並強調其人工智慧能力的持續升級。UnifoLM-OminiA-0.3的推出,不僅強化了G1在居家環境中的實用性,也為未來機器人進入家庭照護、康復輔助、家務管理等應用場景,奠定了更穩固的技術基礎。

市場觀察人士指出,全模態交互理解是當前機器人與人工智慧領域的熱門研究方向,但能將理論落地到實際硬體並展示穩定成果的案例並不多。宇樹此次透過具體的任務演示,證明了其模型在真實環境中的可行性,尤其是在抗干擾與即時反應方面的表現,對於未來商業化應用具有指標性意義。目前宇樹尚未公布UnifoLM-OminiA-0.3模型的具體參數規模、訓練資料來源或對外開放時程,但從演示內容來看,該模型已具備在典型家居場景中處理多種常見任務的能力。隨著後續版本迭代與硬體整合優化,宇樹有望在居家康養機器人市場中佔據更重要的位置。

Related

相關文章

100微米與10微米之間,眼科手術機器人的“極限運動”

眼科手術機器人旨在協助醫生在100微米至10微米的極細微尺度上進行精準操作,克服人類手部顫抖與反應延遲的生理極限。目前主要發展遠端操控與共操控兩條技術路線,在視網膜下注射、白內障手術等領域展現優勢,但面臨體積大、成本高、學習曲線陡峭等挑戰。隨著人工智慧導入,機器人正從被動輔助邁向主動決策支援,有望成為未來常規眼科手術的關鍵工具。

1 小時前

A股人形機器人第一股來了,宇樹IPO倒計時,誰將成最大贏家?

宇樹科技正式啟動科創板IPO初步詢價,預計8月10日開放申購,計劃募資42.02億元,發行估值約420億元,將成為A股首檔純正人形機器人概念股。這家成立於2016年的公司,從四足機器人跨足人形機器人領域,此次上市不僅為早期投資者帶來可觀回報,也象徵人形機器人賽道在資本市場獲得正式認可。市場關注其上市後能否維持技術優勢並實現商業化量產,股價表現將為整個行業提供重要參考。

4 小時前

王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態

首頁 > 智能時代>具身智能 王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態 2026/8/7 14:56:22 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 7 日消息,據澎湃新聞消息,宇樹科技董事長、總經理兼首席技術官王興興今天在網上路演時表示,本次登陸資本市場,是宇樹科技全新的起點。

6 小時前

衝刺全球首個100萬小時具身數據!三家國產公司,聯手了

三家國產機器人公司宣布聯手,目標累積全球首個一百萬小時的具身數據,以強化機器人從感知到執行的全鏈路訓練基礎。此次合作整合本體製造、感測器與數據平台等優勢,試圖打通數據獲取到模型訓練的完整閉環,並建立共享數據標準與交換機制。若目標達成,不僅將刷新全球具身數據規模紀錄,也可能為中國在AI競爭中搶下機器人學習基礎設施的定義權。

11 小時前

宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品

AI資訊AI新閒資訊正文宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品發布於AI新閒資訊時間 :Aug 7, 2026閱讀 :1分鐘8月7日,宇樹科技創始人兼CEO王興興在網上路演中表示,公司登陸資本市場是新的起點,未來將持續深耕通用具身智能機器人核心技術研發與產業應用,推動智能機器人更早進入社會服務場景。

12 小時前6300

IJCAI 2026 專訪:機器人想學會人類動作,還差一座橋 | GAIR Paper 118

進群傳送門: 掃碼進群或添加微信Qvv0909777,備註:IJCAI + 單位/學校+姓名+方向。搞科研/搞技術,信息差很重要。來,一起快人一步!上車,帶你看遍全球 AI 頂會精華可獨家暢覽:專家演講PPT大會報告全文熱門論文解讀學術新星訪談掃描上方二維碼或點擊「閱讀原文」關注專區。

14 小時前