宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解

2026年7月20日 15:22
宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解

重點摘要

首頁 > 智能時代>人工智能 宇樹發佈 UnifoLM-OminiA-0.3 模型,支持全模態交互理解 2026/7/20 15:22:09 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 HH_KK、江山已舊 的線索投遞! IT之家 7 月 20 日消息,今日宇樹科技發佈宇樹 UnifoLM-OminiA-0.3,單模型統籌家居康養多任務,支持全模態交互理解,全程自主,穩定執行抗干擾。

站內 AI 整理稿

宇樹科技於今日(7月20日)正式發表新一代人工智慧模型「UnifoLM-OminiA-0.3」,這款模型主打全模態交互理解能力,能夠以單一模型統籌執行多種居家康養場景中的複雜任務,從物品辨識、搬運到精細操控與設備控制,全程自主運作並具備抗干擾能力。根據官方公布的演示影片,該模型已在宇樹的人形機器人G1上完成實際應用測試,展現出從感知到行動的完整閉環。 此次發表的UnifoLM-OminiA-0.3模型,核心特色在於其「全模態」互動理解能力。不同於過去需要分別訓練視覺、語言、動作等不同模組的作法,宇樹科技宣稱此模型能將多種感知輸入(如影像、語音、觸覺等)與行動輸出整合在同一個神經網路架構中,讓機器人面對複雜家居環境時,不需要外部指令拆分或人工介入,就能直接理解使用者意圖並做出適當反應。 在實際任務演示中,機器人G1首先展示了物品搬運功能:它能辨識地上的一個抱枕,並自主將其拾起放到沙發上。過程中,機器人還能同時回答使用者提出的問題,例如當被問及抱枕的顏色時,它立即回應「白色」。更進一步,機器人還能辨識桌上的藥盒,準確說出藥盒的數量(三個)以及各自的顏色(紅、藍、黃)。這些視覺辨識與語言回答幾乎同步進行,顯示模型在跨模態訊息處理上的即時性。 除了基礎的辨識與搬運,UnifoLM-OminiA-0.3還支援精細操作。演示中,機器人能夠將原本放在第三層的藍色藥盒取出,並放到最上層;同時也能將散落的衣服放進髒衣簍,或將盤子平穩地放入洗碗機中。這些動作需要機器人協調手臂、手指的力度與角度,並根據物體形狀與位置即時調整,顯示模型在運動控制上的精準度。 另一個值得關注的亮點是設備控制能力。在演示中,機器人成功操作了醫療病床的升降功能,並在使用者喊出「停」的瞬間立即停止運動,展現出對語音指令的即時反應與安全中斷機制。這對於居家康養場景中常見的長者照護或復健輔助,具有實際應用價值。 宇樹科技表示,UnifoLM-OminiA-0.3是該公司在人形機器人G1上整合通用人工智慧(AGI)與物理人工智慧(Physical AI)技術的重要里程碑。透過這個模型,機器人不再只是被動執行預設程式的工具,而是能主動理解環境、與人自然互動,並根據即時狀況調整行動策略。這項技術的突破,也讓宇樹在機器人從感知到行動的完整閉環中,跨出了關鍵一步。 從技術架構來看,UnifoLM-OminiA-0.3採用的是單一模型統一處理多種任務的設計哲學。傳統上,機器人需要分別搭載物體辨識模型、語音辨識模型、路徑規劃模型、動作控制模型等,彼此之間需要複雜的介面與協調機制。而宇樹的新模型則試圖以一個端到端的架構,直接將視覺、聽覺、語言理解與運動控制整合在同一網路中,減少延遲與溝通誤差,提升整體執行效率與穩定性。 這項技術的發表,也反映出宇樹科技在機器人領域的長期布局。過去該公司以四足機器人聞名,近年則積極投入雙足人形機器人G1的研發,並強調其人工智慧能力的持續升級。UnifoLM-OminiA-0.3的推出,不僅強化了G1在居家環境中的實用性,也為未來機器人進入家庭照護、康復輔助、家務管理等應用場景,奠定了更穩固的技術基礎。 市場觀察人士指出,全模態交互理解是當前機器人與人工智慧領域的熱門研究方向,但能將理論落地到實際硬體並展示穩定成果的案例並不多。宇樹此次透過具體的任務演示,證明了其模型在真實環境中的可行性,尤其是在抗干擾與即時反應方面的表現,對於未來商業化應用具有指標性意義。 目前宇樹尚未公布UnifoLM-OminiA-0.3模型的具體參數規模、訓練資料來源或對外開放時程,但從演示內容來看,該模型已具備在典型家居場景中處理多種常見任務的能力。隨著後續版本迭代與硬體整合優化,宇樹有望在居家康養機器人市場中佔據更重要的位置。

Related

相關文章

機器人能表演幹活了,但行業還需要更多刁鑽的“壞人”

機器人技術的進步讓它們能流暢表演各類工作,從工廠組裝到服務接待皆可勝任,但行業內卻浮現一個關鍵困境:缺乏足夠「刁鑽的壞人」。這些「壞人」並非破壞者,而是對機器人要求極端嚴苛的測試者或客戶;他們擅長設計突發狀況、極端指令或複雜障礙,迫使機器人暴露隱藏短板。目前許多示範看似完美,卻常在真實場景中因小細節失靈,正說明這種挑剔角色的重要性。

剛剛

機器人進廠打工?先讓人工智障們找著“門”

機器人進廠打工的敘事在2026年達到新的高峰,然而從WAIC 2026現場的展品與討論來看,具身智能產業正浮現明顯的「涼熱交織」局面。展場上到處是準備取代產線工人的雙足機器人,但真正能穩定通過工廠大門、完成連續工序的實例依舊屈指可數。資本端與媒體端對「進廠」故事的熱情,並未消除技術端在真實物理世界中的巨大落差,行業正處在從展示性Demo過渡到工業級可靠性的尷尬爬坡期。

剛剛

宇樹、智元開進商場,人形機器人開始拼門店?

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業。

7 小時前

2026在WAIC打工的機器人

2026年世界人工智能大會(WAIC)預計將有機器人投入展場,負責接待、導覽、清潔等工作,成為大會亮點。此舉不僅展現AI技術成熟度,也為服務機器人商業化提供重要觀察,但具體型號與合作廠商細節尚未完全揭露。

7 小時前
全天候科技機器人技術

從執行任務到權衡價值,雲跡給機器人補上“決策層”

在2026年世界人工智能大會(WAIC)上,雲跡正式發布「人機共生世界價值模型」,並同步展出搭載具身智能的單臂機器人。這項技術突破的核心,是讓機器人從過去單純執行指令的「任務層」,進化到能夠自主權衡不同情境下的價值排序,補上過去被視為難以跨過的「決策層」。 雲跡此次提出的價值模型,並非單純強化機器人的運算或感知能力,而是賦予其一套價值判斷框架。

8 小時前

泛化湧現!原力靈機三級火箭助推具身智能落地

殺入 2026 下半年,燙得發紅的具身賽道,距離第一次交卷正在越來越近。而要實現具身智能的泛化落地,中國的具身公司,缺的不是硬件、不是場景、甚至不是數據採集能力——行業各家公司的不同硬件、算法、場景各自為戰,數據的碎片化才是真正的問題。少了把硬件、場景、數據連接在一起的標準,採集到的數據無法跨任務、跨機型的複用,那麼數據的收集效率就要事倍功半,從 10 萬小時到 100 萬小時的“鯉魚躍龍門”,也就更是難上加難。

12 小時前