機器人為啥困在Demo?訊飛新公司爻方智能給出答案:缺一味「本體認知」

2026年7月23日 16:31
機器人為啥困在Demo?訊飛新公司爻方智能給出答案:缺一味「本體認知」

重點摘要

機器人產業長期面臨展示強但落地難的問題,科大訊飛旗下新成立的爻方智能認為,關鍵在於機器人缺乏「本體認知」能力。該公司指出,當前主流方案如VLA模型仍無法讓機器人動態適應環境,唯有透過對自身狀態與環境的即時感知,才能突破從Demo到實用的瓶頸。

站內 AI 整理稿

機器人產業長期以來面臨一個尷尬的現實:展示時驚豔全場,實際應用卻處處碰壁。從工廠流水線到家庭服務場景,許多機器人產品在Demo影片中表現得靈活精準,一旦脫離實驗室環境,就變得笨拙遲鈍,難以完成簡單任務。這個「Demo強、落地難」的困境,幾乎成了業界公開的秘密,也讓外界對機器人技術的期待與實際體驗之間始終存在巨大落差。科大訊飛旗下新成立的子公司「爻方智能」近日對此現象提出一個關鍵觀察:問題的根源不在於硬體不夠精密,也不在於演算法不夠先進,而在於機器人普遍缺少一種被稱為「本體認知」的核心能力。

爻方智能認為,正是這項能力的缺失,導致機器人只能按照預先編寫的指令機械式運作,卻無法真正理解自己的身體狀態與環境變化,因此始終無法跨出從展示到實用的那一步。這家新公司由科大訊飛孵化,專注於機器人智慧技術的深度研發,其成立也標誌著訊飛在機器人領域的布局從應用層面進一步向上游核心技術延伸。爻方智能團隊指出,目前業界主流解決方案多採用VLA(Vision-Language-Action)模型,這類模型能讓機器人理解視覺影像與自然語言指令,並據此生成對應的動作序列。在Demo環境中,VLA模型確實表現出色,機器人可以依照指令拿起杯子、打開抽屜或避開障礙物,流暢度令人驚嘆。

然而,VLA模型有一個根本性的侷限:它缺乏對機器人自身本體狀態的感知與理解。機器人無法即時知道自己的關節角度、重心位置、受力狀況,也無法感知自身結構在運動過程中的變化。當指令與現實環境出現細微衝突時,例如桌面高度略有不同、物品重量超出預期、地面出現輕微傾斜,機器人就會因為無法調整自身狀態而失敗。換句話說,VLA模型的本質仍是「被動執行指令」,而不是「主動理解互動」。爻方智能將這種缺失比喻為「缺少本體感」。人類在執行動作時,不需要刻意思考就能知道自己的手臂伸到哪裡、身體是否平衡、用力是否恰當,這就是本體認知的作用。

機器人若缺乏同等能力,就只能盲目執行預設動作,無法適應動態環境,也無法應對突發狀況。這也是為什麼許多機器人產品在實驗室中一切順利,一旦進入真實世界——有雜亂的桌面、變化的光線、不確定的物體——就立刻失靈。真正的突破,爻方智能認為,必須從「本體認知」這個技術環節著手。所謂本體認知,指的是機器人對自身結構、運動能力、物理限制以及與環境互動狀態的即時感知與理解能力。這不是簡單的姿態感測或關節回授,而是需要融合多種感測器數據、建立自我模型,並能在運動過程中持續更新對自身狀態的認知。具備本體認知的機器人,才能根據實際情況調適動作,而非死板執行指令。

舉例來說,一個具備本體認知的機器人,在搬運重物時會感知到重心偏移,自動調整步態或姿勢以保持平衡;在路面不平時,會根據腳底壓力回饋即時修改行走模式;在與人互動時,能感知到施加的力道是否過大,進而調整夾持力度。這些能力在人類看來理所當然,卻是目前機器人最欠缺的環節。爻方智能的技術路線,正是圍繞本體認知展開。團隊強調,這並非單純的感測器升級或演算法優化,而是一種全新的系統級設計思維。機器人需要從被動反應走向主動感知,從「按照指令做事」進化到「理解自己並與環境協作」。這項技術一旦成熟,將從根本上改變機器人的應用邊界,讓它們真正走出實驗室,進入家庭、醫療、教育、服務等真實場景。

科大訊飛選擇在此時成立爻方智能,布局本體認知技術,也反映了對機器人產業發展趨勢的判斷。過去幾年,機器人領域的熱點集中在移動能力、抓取能力、視覺辨識與語言理解,這些技術已經取得長足進步。但正如爻方智能所指出的,這些能力就像人類的「感覺」與「運動」系統,卻缺少了最重要的「本體感覺」——也就是大腦對身體狀態的即時感知。沒有這個基礎,機器人永遠只是聰明的傀儡,而非真正的自主體。在全球範圍內,本體認知已成為機器人研究的熱門方向。多家頂尖實驗室與科技公司都在探索如何讓機器人建立自我模型,並在運動中不斷更新。爻方智能的成立,代表中國團隊在這一領域的正式發力。

訊飛在語音、自然語言處理、人工智慧等領域的深厚積累,也將為爻方智能提供跨領域的技術支撐。從產業應用的角度來看,本體認知的突破將直接影響機器人的可靠度與適應性。一旦機器人能夠像人類一樣感知自己的身體狀態,許多現有應用場景的痛點就能迎刃而解。例如,家庭服務機器人不再需要精確標定環境,就能在雜亂的客廳中順利移動;醫療復健機器人可以根據患者當下的肌肉狀態調整輔助力道;工業協作機器人能在人機共融的環境中安全互動,無需隔離圍欄。當然,本體認知技術仍處於早期階段,距離大規模商用還有相當距離。但爻方智能的觀點清楚指出:如果不解決這個根本問題,機器人產業將永遠困在「Demo做得很好,但賣不出去」的循環中。

唯有讓機器人真正理解「我是誰」「我在哪裡」「我該怎麼動」,才能讓這場科技革命從展示台走進每個人的生活。科大訊飛此次布局,無疑是看準了這個技術拐點。爻方智能的成立,不僅是訊飛內部技術團隊的獨立運作,更代表著對機器人產業下一步發展方向的明確表態。當業界還在為VLA模型的效果爭論不休時,這家新創公司已經將目光投向更基礎的層面——讓機器人先認識自己,才能認識世界。

Related

相關文章

100微米與10微米之間,眼科手術機器人的“極限運動”

眼科手術機器人旨在協助醫生在100微米至10微米的極細微尺度上進行精準操作,克服人類手部顫抖與反應延遲的生理極限。目前主要發展遠端操控與共操控兩條技術路線,在視網膜下注射、白內障手術等領域展現優勢,但面臨體積大、成本高、學習曲線陡峭等挑戰。隨著人工智慧導入,機器人正從被動輔助邁向主動決策支援,有望成為未來常規眼科手術的關鍵工具。

59 分鐘前

A股人形機器人第一股來了,宇樹IPO倒計時,誰將成最大贏家?

宇樹科技正式啟動科創板IPO初步詢價,預計8月10日開放申購,計劃募資42.02億元,發行估值約420億元,將成為A股首檔純正人形機器人概念股。這家成立於2016年的公司,從四足機器人跨足人形機器人領域,此次上市不僅為早期投資者帶來可觀回報,也象徵人形機器人賽道在資本市場獲得正式認可。市場關注其上市後能否維持技術優勢並實現商業化量產,股價表現將為整個行業提供重要參考。

3 小時前

王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態

首頁 > 智能時代>具身智能 王興興:宇樹科技將積極探索人形機器人、機甲等更多產品形態 2026/8/7 14:56:22 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 8 月 7 日消息,據澎湃新聞消息,宇樹科技董事長、總經理兼首席技術官王興興今天在網上路演時表示,本次登陸資本市場,是宇樹科技全新的起點。

5 小時前

衝刺全球首個100萬小時具身數據!三家國產公司,聯手了

三家國產機器人公司宣布聯手,目標累積全球首個一百萬小時的具身數據,以強化機器人從感知到執行的全鏈路訓練基礎。此次合作整合本體製造、感測器與數據平台等優勢,試圖打通數據獲取到模型訓練的完整閉環,並建立共享數據標準與交換機制。若目標達成,不僅將刷新全球具身數據規模紀錄,也可能為中國在AI競爭中搶下機器人學習基礎設施的定義權。

11 小時前

宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品

AI資訊AI新閒資訊正文宇樹科技王興興:將持續攻堅具身智能技術,探索人形機器人等新產品發布於AI新閒資訊時間 :Aug 7, 2026閱讀 :1分鐘8月7日,宇樹科技創始人兼CEO王興興在網上路演中表示,公司登陸資本市場是新的起點,未來將持續深耕通用具身智能機器人核心技術研發與產業應用,推動智能機器人更早進入社會服務場景。

12 小時前6300

IJCAI 2026 專訪:機器人想學會人類動作,還差一座橋 | GAIR Paper 118

進群傳送門: 掃碼進群或添加微信Qvv0909777,備註:IJCAI + 單位/學校+姓名+方向。搞科研/搞技術,信息差很重要。來,一起快人一步!上車,帶你看遍全球 AI 頂會精華可獨家暢覽:專家演講PPT大會報告全文熱門論文解讀學術新星訪談掃描上方二維碼或點擊「閱讀原文」關注專區。

14 小時前