內置“任意門”,高德發佈通用世界模型工坊 ABot-WorldStudio

2026年7月14日 15:46
內置“任意門”,高德發佈通用世界模型工坊 ABot-WorldStudio

重點摘要

高德近日發佈通用世界模型工坊 ABot-WorldStudio,首次將交互式視頻生成與 3DGS 場景生成整合於同一產品。用戶輸入文字或圖片,即可即時生成可實時交互的 AI 世界,無需複雜操作。 該工坊內置“任意門”機制,能將孤立的 3D 場景串聯成無界探索網絡,讓用戶在不同虛擬空間中自由跳轉,實現連續的沉浸式體驗。

站內 AI 整理稿

高德近日宣布推出通用世界模型工坊 ABot-WorldStudio,這款工具被定位為業界第一款同時整合互動式影片生成與 3DGS 場景生成能力的產品。不同於以往需要繁複設定或專業技術門檻的創作流程,使用者只需輸入一段文字或一張圖片,系統就能即時建構出一個可以即時互動的 AI 世界,大幅降低虛擬場景生成的難度。這套工坊內建了名為「任意門」的獨特機制,能將原本各自獨立的 3D 場景串聯起來,形成一個無邊界的探索網絡。使用者可以在不同的虛擬空間中自由跳轉,藉此獲得連續且具有高度沉浸感的體驗。

透過這項設計,ABot-WorldStudio 不僅簡化了生成流程,更讓場景間的過渡變得更加自然,進一步拓展了互動式虛擬世界的可能性。業界普遍認為,傳統虛擬場景的建置通常需要專業的 3D 建模軟體、大量的美術資源以及長時間的渲染與調整,對創作者來說門檻相當高。ABot-WorldStudio 的出現試圖打破這種限制,讓沒有程式或美術背景的使用者也能夠憑藉簡單的文字描述或參考圖片,在短時間內生成具備互動性的三維環境。這項突破不僅意味著創作權力的下放,也可能帶動更多實驗性的互動內容誕生。除了基礎的場景生成,ABot-WorldStudio 內建的互動式影片生成功能更是亮點所在。

傳統的影片生成往往只能輸出預先設定好的畫面,使用者無法與其中的場景進行互動;但在這套工坊中,生成的影片本身就是一個可操作的 3D 世界,觀看者可以自由探索視角、改變位置,甚至在場景中移動,體驗遠比單純觀看影片更加豐富。這種將影片與即時 3D 渲染結合的做法,在當前的 AI 創作工具中仍屬罕見。而 3DGS(3D Gaussian Splatting)場景生成能力的加入,則讓 ABot-WorldStudio 在重建與生成三維世界時擁有更快的速度與更高的還原度。3DGS 是一種新興的場景表示技術,能夠從多張圖片或一段影片中快速地還原出高品質的 3D 場景,並且支援即時渲染。

將其與互動式影片生成整合在同一個平台上,意味著使用者可以從零開始生成全新的世界,也可以基於真實世界的照片或影片來改造、擴展現有空間,創造出虛實混合的體驗。「任意門」機制的設計靈感來自於打破單一場景的界線。在過去,即便能生成高品質的 3D 場景,每一個場景通常還是獨立存在的;使用者若要切換到另一個場景,往往需要載入新檔案或透過選單切換,中斷了沉浸感。ABot-WorldStudio 的「任意門」則讓場景之間可以直接串連,使用者只要觸發門的機制,就能瞬間移動到另一個世界,彷彿在一個巨大的虛擬宇宙中旅行。這種設計不僅讓探索過程更加流暢,也為創作者提供了串聯多個故事或體驗的可能性。

例如,創作者可以建造一個包含森林、城堡、海底遺跡與太空站的多重世界,並透過「任意門」將這些場景連接起來,讓使用者以步行或觸發的方式自然過渡。每個場景內還可以嵌入新的影片或互動事件,形成一個環環相扣的敘事網絡。這種形式對於遊戲開發、虛擬展覽、教育訓練、房地產導覽等領域來說,都具有相當大的應用潛力。從技術層面來看,ABot-WorldStudio 的推出反映了當下 AI 生成內容從靜態走向動態、從被動觀看走向主動互動的趨勢。過去幾年,文字生成圖片、文字生成影片的技術已經有長足進展,但要讓生成的內容具備可互動的三維結構,仍然充滿挑戰。

高德這次將多種生成能力整合在同一套工坊中,並且強調用戶不需要學習複雜的介面或程式邏輯,只需透過自然語言或簡單的圖片輸入,就能啟動整個創作流程,顯示其在 AI 模型與使用者體驗設計上的整合能力。以實際操作為例,使用者可以在 ABot-WorldStudio 中輸入「一座飄浮在雲端的古城,周圍有瀑布與飛船」,系統便會即時生成相對應的 3D 場景,並且在這個場景中內建動態元素,例如瀑布流動、飛船移動,以及可供使用者移動的區域。如果使用者想要擴展這個世界,只需再加入「場景出口連結到一片水晶洞穴」,就可以透過任意門機制將兩個世界串連,過程不需要手動調整任何程式碼。

同樣地,上傳一張真實照片,例如某個城市街景的圖片,系統也能將這張圖片轉換成可探索的 3D 場景,並允許使用者加入新的虛擬物件或改變時間光影,進一步創造個人化的互動世界。這種從真實影像到互動世界的轉換能力,對於虛擬旅遊、文化遺產保存、線上購物等應用場景來說,提供了全新的展示方式。高德方面表示,ABot-WorldStudio 的目標是讓每個人都能成為虛擬世界的創造者,而不只是消費者。透過這套工坊,無論是專業創作者還是一般使用者,都能將腦海中的想像快速視覺化,並與他人分享這些可互動的數位空間。目前該產品已經開始對外開放測試,預計將吸引大量對 AI 創作有興趣的使用者搶先體驗。

在產業影響方面,ABot-WorldStudio 的出現可能加速虛擬內容生產的民主化過程。過去需要多人團隊耗時數月才能完成的互動場景,現在可能只需要一個人在數小時內就能雛型完成,讓創意門檻大幅降低。這對於獨立遊戲開發者、教育內容製作者、小型工作室來說,無疑是一大利多。同時,品牌與行銷人員也能利用這項工具快速打造互動式的產品展示或虛擬體驗活動,提升消費者的參與感。當然,任何新技術在初期都會面臨許多挑戰,例如生成內容的品質穩定性、大規模場景的資源消耗、以及如何確保使用者生成的世界之間能夠順利串聯而不發生錯誤。

ABot-WorldStudio 能否在實際使用中維持順暢的互動體驗,還有待更多測試者的反饋來驗證。不過從目前公開的資訊來看,這款工坊在整合互動式影片生成與 3DGS 場景生成方面的確走出了新的一步,而且「任意門」的概念讓虛擬世界的擴展與探索有了更具想像力的實現方式。未來,隨著更多創作者投入嘗試,我們或許很快就能看到一系列由 AI 驅動、充滿個人風格的互動世界陸續誕生。整體而言,ABot-WorldStudio 的推出標誌著 AI 內容創作工具正在從單純的影像生成邁向全方位的世界建構。無論是技術架構還是使用流程,它都試圖打破傳統專業軟體的高牆,讓更多人能夠參與到虛擬內容的創作中來。

對於關注 AI、互動娛樂與三維生成技術的人來說,這套工坊無疑是近期最值得關注的產品之一。

Related

相關文章

何夕2077研究與前沿

多語種翻譯框架發佈

多語種翻譯框架發佈。 研究者提出MSRT語音翻譯框架。它成功破解了多語種詛咒難題。少量數據即可實現 🎙️ 高質量對齊。多語種語音翻譯學術論文公佈在網絡。新模型翻譯質量顯著超越傳統方法。

19 小時前
何夕2077研究與前沿

智能體參與城規

智能體參與城規。 官方宣佈首個城市規劃實驗。智能體將深度 ��� 參與真實建設規則。創意策劃見城市規劃實驗微信推文獲取方案.模型將不再侷限於在屏幕內部寫代碼。新的城市科學協同範式已經正式起步。

19 小時前

天才,對AI發展到底有多重要?

加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

21 小時前

Jeff Dean們,趕在貝葉斯AI到來之前跳船

Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

1 天前