WAIC一間很“主動”的AI小屋,藏著京東通往整個物理世界的野心

重點摘要
智東西(公眾號:zhidxcom) 作者 | 畢偉豪 編輯|漠影 智東西7月18日報道,走到WAIC一號館展區最裡面,有一間“房子”圍滿了人。如果不是周圍站著機器人、擺著芯片、掛著各種AI模型介紹,我差點以為自己穿越到了未來之家。
在上海世界人工智能大會(WAIC)的一號館展區深處,一間特別的「房子」吸引了大批參觀者駐足。屋內擺設與一般家庭無異,但每一件設備都彷彿擁有生命:當你走進家門說一句「我回來啦」,茶吧機會自動倒上一杯溫水;機器狗主動跑過來,詢問你今天過得如何;躺在床上,智能床墊會問你是否需要按摩;當你說無聊,電視就會推送熱門劇集。整個過程沒有遙控器,沒有App,一切都自然發生。這不是預先設定好的演示,而是京東在現場搭建的一套基於附身智能JoyInside的「AI Home」實景樣板間,客廳、廚房、書房、臥室一應俱全,每一件設備都像長了一個大腦,能夠理解人的意圖,並主動參與到整個家庭活動的協同中。
這間屋子背後,藏著京東對AI進入物理世界的完整回答。京東探索研究院相關負責人在現場表示,整個京東集團將用AI賦能未來發展,目標是讓京東成為全球最大的物理世界運營中心。而AI走進物理世界的第一站,就是家庭。京東將這套技術方案命名為JoyInside,其產品負責人給出了一個很有意思的定義:他把這種能夠理解人、理解場景、能夠主動協同工作的家庭AI形態稱為「AI空間」。過去一年多,JoyInside的核心變化不是接入了更多品類,而是將散落的單品捏合成一件事,從「被動控制」轉向「主動滿足」。傳統智能家居的邏輯,是用手機App控制設備的溫度、模式、時長,人把它當工具,一步步按原始設定走。
但JoyInside想做的卻是用戶只需要說一句「我想吃烤紅薯,拳頭那麼大的」,剩下的由設備自己搞定。這種模式的真正挑戰不在於指令遵循,而在於容錯率的急劇下降。產品負責人指出,當AI從數字世界進入物理世界,人們可以容忍聊天機器人犯錯,卻不能接受紅薯被烤糊。不同產地的紅薯、不同人的口味,都無法用標準模式覆蓋,這正是廠商必須解決的問題。
京東的解法是採用類似Vibe Coding的思路:對品牌方,不依賴出廠前寫死的固定程序,而是讓最懂食材和烤箱特性的人類透過自然語言描述來定義產品行為;對用戶端,則稱為「Vibe Control」,用戶不需學習如何使用設備,只要表達意圖,設備中的AI就會理解需求並主動協同服務。在WAIC現場的「AI Home」樣板間裡,這套去中心化的邏輯被拆進不同生活場景。
學習場景中,京造AI投影檯燈將作業批改投射在桌面上,輔導孩子日常學習;陪伴場景裡,佛山照明的AI小夜燈不僅能智能調節亮度與色溫,還能對話、哄睡、提供情緒價值;展區中一隻凱米斯AI智能機器狗能流暢與人對話,用戶還可透過編程為其設定新動作;健康監測方面,智能睡眠床墊24小時追蹤呼吸和體動,一躺下就會詢問是否開啟按摩、調節高度,並自動生成健康報告;元蘿蔔AI下棋機器人支援圍棋、五子棋、象棋等多種玩法,不僅能當陪練,還能與孩子語音交互。這些設備沒有等待中央控制器逐一發號施令,而是各自理解用戶需求,再主動完成協同。要讓不同廠商、不同算力、不同協議的硬件協同工作,比讓單臺設備變智能難得多。
京東首先解決交互問題:家庭中電視聲、老人談話、掃地機器人運轉的噪音環境下,AI必須同時判斷誰在說話、是不是在跟自己說、說的是什麼。JoyInside沒有採用傳統聲紋方案,而是多模態策略,不僅看語音特徵,還看對話內容的上下文連續性,把不相關的對話自動過濾。在電視噪音場景下,ASR識別率接近90%,疊加大模型理解後,對話有效性進一步提升。此外,針對長週期場景任務,例如一段時間內陪伴老人、照顧孩子,JoyInside採用快慢腦架構:快腦響應用戶交互,慢腦規劃長週期任務,實現全流程主動服務。跨設備協同方面,JoyInside的做法是先幫助每個品牌做好單品能力,然後透過角色之間的主動協同構建AI空間。
目前已有近200家品牌接入JoyInside,覆蓋家電家居、機器人、AI玩具、醫療器械等品類,對話輪次平均提升超過120%,預計2026年接入超過千萬台終端設備。雖然學習教育類和玩具的使用活躍度最高,家電家居類相對較低,但JoyInside與傳統智能家居本質不同:傳統方案是一個App控制所有設備,仍需手動操作;JoyInside則是讓每個設備擁有千人千面服務的AI能力,設備之間根據用戶意圖自主協同。產品負責人認為,當AI驅動的主動服務體驗在更多品類上跑通後,家電家居類的使用頻次將超過玩具類。
這套去中心化策略正在為京東AI走進物理世界鋪路:不去打造一個全知全能的大腦,而是讓每一台設備都擁有自己的AI能力。每接入一台新設備,不是增加系統負擔,而是增加一個新的AI入口,設備越多,場景越豐富,數據迴流越厚,每個入口的AI能力反而越強。為了加速品類覆蓋,京東對品牌方免費開放了從ASR、TTS到大模型的整套能力,降低試錯成本。支撐這間「AI Home」背後的是京東過去幾年持續搭建的AI技術體系。京東探索研究院相關負責人將整體戰略分為三步:數字智能、附身智能、具身智能。「AI Home」展現的附身智能正建立在底層模型不斷完善的基礎上。
圍繞這條路線,京東JoyAI已佈局圖像理解、多模態實時交互、世界模型等能力,包括JoyAI-Image-Edit負責圖像空間理解與編輯、JoyAI-VL-Interaction讓模型實時感知環境並與用戶交互、JoyAI-Echo瞄準下一代世界模型。論壇上又展示了兩個即將發布的新模型:JoyAI-Talker聚焦即時語音交互,能感知情緒與態度;JoyAI-Video-Edit面向串流影片編輯,可實現30fps串流媒體影片即時編輯,服務影片生成與具身智能仿真數據合成。具身智能方面,京東推出JoyAI-Sim仿真架構及JoyAI-RA具身模型,下半年將陸續發布系列具身相關新工作。
數據是這條路線上的關鍵變量。京東開源的EgoLive數據集已擁有2000小時人類第一視角雙目影片,為行業最大。京東基礎雲業務負責人透露,未來將依託京東近1萬家門店、3600餘個倉儲、20餘萬個藥店等場景啟動數據採集,目標今年底達到百萬小時量級,兩年內衝擊千萬小時。目前整個數據處理成本已下降8倍以上。展臺區域也讓觀眾體驗頭戴JoyEgoCam數採設備,第一視角感受機器人從數據採集、學習到最終落地作業的全流程。在WAIC的圓桌論壇上,嘉賓們也探討了AI進入家庭後的邊界問題,包括如何使用AI進行家庭教育、風險以及如何避免過度依賴等。
JoyInside產品負責人表示,當AI成為陪伴者,它不只是一項硬件功能,而是一個持續在線、持續學習、持續交互的互聯網產品,因此京東從模型層面對陪伴能力進行管理與約束,希望讓AI在長期交互中保持安全、可靠和穩定。從數字智能、附身智能到具身智能,這三層能力共享同一套模型、數據和交互能力。「AI Home」只是消費者最容易感知的一層,而其背後的技術體系最終指向AI進入更廣闊的物理世界。當每個設備都擁有自己的AI能力,並能圍繞人的意圖主動理解、主動協同,AI便不再只是聊天助手,而是開始成為現實世界的一部分。
這間小屋,既是京東打造AI驅動的全球最大物理世界運營中心的終端基礎,也是物理世界最大的AI去中心化入口的開端——讓AI從理解世界,走向參與世界。
Related
相關文章

秋招信息戰打不動?我們測了千問的新功能,讓Agent全程陪跑
阿里巴巴旗下大模型「千問」近日推出全新功能,針對秋季招聘季中求職者面臨的海量資訊與繁複流程,打造「Agent 全程陪跑」服務。根據官方測試,這項功能能協助使用者自動篩選職缺、整理企業資訊,甚至模擬面試問答,大幅減輕求職者自行蒐集與比對資訊的負擔。 在實際體驗中,用戶只需輸入自身學經歷與目標產業,Agent 便會自動爬取最新的秋招公告,並按職位匹配度、截止日期等條件排序,同時附上企業背景與筆面試經驗摘要。

Caviar 推出 24K 鍍金版 Meta 雷朋智能眼鏡 Odyssey,售價 6130 美元限量 24 副
Caviar 推出限量 24 副的 Odyssey 智能眼鏡,以 Meta Ray-Ban 為基礎,提供 24K 金與 925 銀裝飾版本,售價分別為 6130 美元與 6840 美元。該產品保留原版功能,並附帶鱷魚皮充電盒,展現奢華工藝。

Suno 平臺將為 AI 生成音樂添加隱水印,防止濫用現象發生
Suno 平台將為其AI生成的音樂加入隱藏式音頻水印與指紋識別技術,以便在其他平台上被上傳時可辨識來源。此舉是因應索尼、環球等音樂巨頭組成的聯盟,要求防止AI音樂濫用並禁止其進入全球排行榜。

AI寫的PR堆成山,Rust已忍無可忍
Rust 語言社群近期強烈反彈大量由 AI 生成的公關稿與行銷文淹沒官方討論區,這些內容缺乏深度且帶有商業目的,讓資深貢獻者不堪其擾。社群管理團隊正研擬加強審查機制與提高發文門檻,但同時也擔心誤傷真正的新手使用者。這場爭議凸顯開源專案在 AI 時代面臨資訊過濾成本攀升的困境。

內置 10TOPS INT8 算力:韓 Mobilint 推出 USB AI 加速器 MLD-R1
韓國NPU企業Mobilint推出USB外接AI加速器MLD-R1,內建REGULUS AI SoC,提供10TOPS INT8算力與4核Arm處理器。該裝置支援多種AI框架與作業系統,功耗僅3W,具備IP65防塵防水,適合邊緣運算場景。

AI 藝人“方桃子”帶貨美瞳廣告遭下架,聲稱“戴了一天都很舒服”
AI 虛擬藝人「方桃子」因推廣美瞳廣告,聲稱「戴了一天都很舒服」引發爭議,網友質疑其無真實眼睛無法體驗產品效果。該廣告目前已從抖音下架,可能涉及違反《中華人民共和國廣告法》中關於虛假或誤導性內容的規定。