螞蟻旗下具身智能模型開源
重點摘要
螞蟻旗下具身智能模型開源。 該視覺系列包含十億級參數模型。項目採用最寬鬆的開源協議發佈。部分深度估算指標已經超越競品. 點擊體驗螞蟻集團機器人模型獲取成果。它能為多種機器人提供視覺大腦。
螞蟻集團近日正式宣布,旗下具身智能模型已全面開源。這款模型屬於視覺系列,具備十億級參數規模,並且採用當前最寬鬆的開源協議釋出,開發者與研究單位得以更自由地進行應用、修改與再發布。根據公開資訊,該模型在部分深度估算指標上已超越市場同級產品,展現優異的視覺感知能力,能為多種機器人提供「視覺大腦」,協助機器人更精確地判斷環境與物體位置。目前該模型已開放體驗,相關成果可供業界進一步探索與整合。所謂具身智能,指的是能夠感知環境並透過實體載具(如機械手臂、輪式機器人、人形機器人等)執行動作的智能系統。
視覺感知是其中關鍵的一環,機器人必須正確判斷物體的三維位置、幾何形狀與空間關係,才能完成取物、避障、導航等任務。螞蟻此次開源的視覺模型取名雖未特別強調型號,但其技術規格瞄準的就是這類高精度空間理解需求。十億級參數在當前的視覺模型中屬於中大型規模,既能提供足夠的表徵能力,又不會過度加重邊緣裝置的運算負擔。更引人注意的是開源協議的選擇。螞蟻採用的是目前業界公認限制最少的許可證之一,代表任何人皆可用於商業用途、進行修改或再授權,不必擔心後續的法律風險。這項策略與許多大型科技公司「部分開源、部分保留」的做法形成對比,有望吸引更多初創團隊與學術單位加入生態。在技術細節上,該模型特別強調深度估算的準確度。
深度估算是指從二維影像推算出物體與相機之間的實際距離,這是機器人避開障礙、抓取物體的重要基礎。據官方透露,在公開的深度估算基準測試中,該模型的多項指標已經領先市面上其他類似規模的視覺模型。換句話說,機器人裝上這套「視覺大腦」,能夠更快、更穩定地理解周圍環境,即使光線變化或物體部分遮蔽,也能維持一定的辨識能力。從應用面來看,這項開源成果直接受惠的對象包括服務型機器人、工業協作機器人以及物流自動化設備。開發者可以直接下載模型,整合到自家的硬體平台上,不必從零開始訓練影像辨識系統,大幅縮短產品開發時程。
同時,因為開源協議寬鬆,研究人員也能針對特定場景進行微調,例如倉儲夜晚低光照環境、醫療手術的高精度定位等,進一步拓展模型的適用範圍。螞蟻集團近年來持續投入人工智慧基礎研究,尤其在自然語言處理與電腦視覺領域累積了多項開源專案。此次將具身智能模型公開,顯示其在機器人技術的布局正逐漸從幕後走向前線。業界普遍認為,開源能加快技術迭代速度,尤其對硬體規格尚未統一的機器人產業來說,一套通用且高性能的視覺模型有助於降低進入門檻,讓更多小型團隊有機會參與創新。值得注意的是,雖然「開源」常被視為企業對社群的回饋,但背後也有商業策略的考量。
一旦開發者社群廣泛採用該模型,相關工具鏈與最佳實踐就會圍繞它建立,後續若要推出更進階的付費版本或雲端服務,自然容易取得市場。螞蟻集團是否會循此模式,後續可能推出搭配專用硬體或調校服務的商業方案,尚待觀察,但目前開源版本已足夠完整,可直接投入真實專案。目前該模型已開放體驗,感興趣的開發者可透過指定平台下載原始碼與預訓練權重。官方同時提供了文件與範例程式,幫助使用者快速入門。由於具身智能牽涉到硬體整合,螞蟻也鼓勵開發者分享實作經驗與測試結果,形成一個正向循環的社群。未來版本預計會加入更多感測器支援,例如深度攝影機與光達的融合,進一步提升複雜環境中的表現。
從更宏觀的角度來看,這項開源動作也呼應了全球機器人領域對「基礎模型」的追求。類似大型語言模型之於文字生成,視覺基礎模型試圖為機器人提供通用感知能力,讓同一套模型在不同機型、不同場景中都能發揮作用。螞蟻此次釋出的視覺系列模型,正朝著這個方向邁出關鍵一步。對於台灣的產業界而言,這項開源消息同樣值得關注。國內機器人與自動化業者眾多,從半導體晶圓搬運、電子組裝到餐飲送餐,不同應用場景常需要客製化視覺演算法,資源有限的中小企業往往難以負擔高昂的研發成本。有了這樣一款高精度且合法商用化的開源模型,開發團隊可以直接取用並針對自身需求調整,有機會加速產品上市並提升競爭力。當然,開源模型並非萬能。
實際部署時仍需考慮硬體相容性、即時性要求以及模型的泛化極限。螞蟻在技術文件中建議使用者先在自己的測試環境中驗證模型表現,確保充足的資料涵蓋率。同時,開放社群也將累積更多使用情境的反饋,幫助原開發團隊持續修正弱項。總體而言,螞蟻集團將具身智能視覺模型以最寬鬆協議開源,不僅提供了高品質的技術工具,也為整個機器人生態注入了活水。從深度估算指標的領先表現到開放體驗的即時可用性,這一系列做法展現了集團在人工智慧領域深耕的決心,以及擁抱開放合作的態度。未來隨著更多開發者投入,該模型有望成為機器人感知層的重要基石,推動智慧機械從工廠走向更廣泛的日常生活。
Related
相關文章

100微米與10微米之間,眼科手術機器人的“極限運動”
眼科手術機器人旨在協助醫生在100微米至10微米的極細微尺度上進行精準操作,克服人類手部顫抖與反應延遲的生理極限。目前主要發展遠端操控與共操控兩條技術路線,在視網膜下注射、白內障手術等領域展現優勢,但面臨體積大、成本高、學習曲線陡峭等挑戰。隨著人工智慧導入,機器人正從被動輔助邁向主動決策支援,有望成為未來常規眼科手術的關鍵工具。

A股人形機器人第一股來了,宇樹IPO倒計時,誰將成最大贏家?
宇樹科技正式啟動科創板IPO初步詢價,預計8月10日開放申購,計劃募資42.02億元,發行估值約420億元,將成為A股首檔純正人形機器人概念股。這家成立於2016年的公司,從四足機器人跨足人形機器人領域,此次上市不僅為早期投資者帶來可觀回報,也象徵人形機器人賽道在資本市場獲得正式認可。市場關注其上市後能否維持技術優勢並實現商業化量產,股價表現將為整個行業提供重要參考。

王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態
首頁 > 智能時代>具身智能 王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態 2026/8/7 14:56:22 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 7 日消息,據澎湃新聞消息,宇樹科技董事長、總經理兼首席技術官王興興今天在網上路演時表示,本次登陸資本市場,是宇樹科技全新的起點。

衝刺全球首個100萬小時具身數據!三家國產公司,聯手了
三家國產機器人公司宣布聯手,目標累積全球首個一百萬小時的具身數據,以強化機器人從感知到執行的全鏈路訓練基礎。此次合作整合本體製造、感測器與數據平台等優勢,試圖打通數據獲取到模型訓練的完整閉環,並建立共享數據標準與交換機制。若目標達成,不僅將刷新全球具身數據規模紀錄,也可能為中國在AI競爭中搶下機器人學習基礎設施的定義權。
宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品
AI資訊AI新閒資訊正文宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品發布於AI新閒資訊時間 :Aug 7, 2026閱讀 :1分鐘8月7日,宇樹科技創始人兼CEO王興興在網上路演中表示,公司登陸資本市場是新的起點,未來將持續深耕通用具身智能機器人核心技術研發與產業應用,推動智能機器人更早進入社會服務場景。
IJCAI 2026 專訪:機器人想學會人類動作,還差一座橋 | GAIR Paper 118
進群傳送門: 掃碼進群或添加微信Qvv0909777,備註:IJCAI + 單位/學校+姓名+方向。搞科研/搞技術,信息差很重要。來,一起快人一步!上車,帶你看遍全球 AI 頂會精華可獨家暢覽:專家演講PPT大會報告全文熱門論文解讀學術新星訪談掃描上方二維碼或點擊「閱讀原文」關注專區。