​生數科技正式發佈 Vidu S2,支持實時編輯、動態參考圖與頭顯適配

2026年9月16日 15:30
​生數科技正式發佈 Vidu S2,支持實時編輯、動態參考圖與頭顯適配
站內 AI 整理稿

生數科技今日正式對外發布新一代視頻生成模型 Vidu S2,這款模型不再只是單純的影片生成工具,而是將重點轉向即時互動與編輯能力。Vidu S2 內含兩大核心模型,分別是面向持續交互數字角色的 Vidu S2-Avatar,以及針對輸入視頻流進行即時編輯的 Vidu S2-Editing,兩者共同構建出一套從角色製作到影片後製的完整即時工作流程。其中,Vidu S2-Avatar 專注於生成具備一致身份特徵的動態數字角色。與一般影片生成模型只能輸出一次性內容不同,這套模型能夠在連續互動中維持角色的臉部特徵、服裝細節與身形比例,不會出現角色外觀飄忽不定的問題。

使用者可以透過即時互動的方式驅動角色,例如讓角色根據語音或指令做出對應的表情與動作,甚至能將真實人物的表情即時映射到虛擬角色上。這項能力在虛擬主播、數位代言人、線上客服等場景中具有很高的應用潛力,也為內容創作者提供了一種低成本、高效率的動態角色生產方案。另一方面,Vidu S2-Editing 則為影片編輯領域帶來了全新可能性。傳統的影片修改通常需要將整段素材重新渲染,或依賴後製軟體逐格調整,過程耗時且計算資源需求龐大。Vidu S2-Editing 打破了這項限制,允許使用者對既有影片串流進行逐幀級別的即時修改,不需重新渲染整個片段。

舉例來說,創作者可以即時替換畫面中的物體,把一輛車換成另一種型號;也可以調整整段影片的視覺風格,從寫實轉為動畫;甚至能夠改變特定區域的運動軌跡,例如讓原本靜止的背景元素開始移動。這些編輯操作都能在影片播放的過程中直接完成,大幅縮短了後製時程,也讓即時互動式影片創作成為可能。在兩大模型的基礎上,生數科技更進一步探索了 Vidu S2 與 VR 頭戴式顯示裝置的適配能力。團隊將即時生成與編輯技術延伸至空間影片場景,讓使用者能夠在沉浸式環境中直接對虛擬物件進行操作。

具體來說,透過頭顯設備,創作者可以為虛擬角色綁定動態參考圖,使角色的外觀與動作持續對應到指定的參考影像;同時也能對空間中的影片元素進行即時編輯,例如調整物件位置、變更材質或觸發動態效果。這種所見即所得的操作體驗,讓 Vidu S2 不再僅限於平面螢幕的應用,而是跨入了空間計算的領域。目前這項 VR 頭顯適配功能仍處於早期展示階段,但生數科技表示,該方案已經能夠流暢運行於市場上的主流頭顯裝置上。儘管離大規模商用還有一段距離,這項技術已經為後續的空間計算內容創作提供了新的技術路徑。

尤其隨著 Apple Vision Pro 等頭顯設備逐漸普及,能夠在虛擬環境中即時生成與編輯影片的能力,將成為空間內容生產鏈中不可或缺的一環。Vidu S2 的發布,標誌著 AI 影片生成技術從「輸出成品」的階段,邁向「即時互動與編輯」的新紀元。過去,AI 影片模型多半只負責一次性生成,使用者若要修正細節,往往得重新調整參數並等待數分鐘甚至數小時的運算。Vidu S2 的即時編輯能力從根本上改變了這條生產關係,讓創作者可以在觀看影片的同時進行修改,並且立即看到效果。這對於需要快速迭代的廣告創意、遊戲過場動畫、社交媒體短影音等應用場景來說,無疑是一次效率革命。

若深入探討技術層面,Vidu S2 之所以能夠實現即時編輯,關鍵在於其模型架構從設計之初就考慮到低延遲與高頻率更新。傳統影片生成模型通常以「生成整段」為目標,而 Vidu S2 則專注於「串流式處理」,能夠對於輸入的每一幀畫面進行獨立分析與修改,同時保持前後幀的一致性和連貫性。這種架構也使得模型能夠與外部感測器或互動設備(如頭顯的追蹤系統)進行即時溝通,進一步拓展了應用的廣度。對於內容創作者而言,Vidu S2-Editing 帶來的最大改變是「試錯成本」的降低。過去更換一個物體或調整一段動作,可能意味著整個場景需要重新渲染,既耗時又浪費算力。

現在,創作者可以在播放過程中直接選取目標區域,輸入新的描述或參考圖,模型便會自動完成修改,且不影響畫面其他部分。這種精細化的控制能力,讓 AI 影片編輯真正達到了專業後製軟體的操作水準,但所需時間卻大幅縮短。而在虛擬角色領域,Vidu S2-Avatar 的價值體現在「持久性」與「一致性」。許多現有的 AI 角色生成工具能夠一次產出高品質的角色影像,但當需要角色在連續對話或動作中保持同一張臉時,往往會出現五官變形、服裝錯亂等問題。Vidu S2-Avatar 透過動態參考圖機制,讓角色在每次生成時都對照同一個身份特徵基準,從而實現長期穩定的互動表現。

這對於品牌建立虛擬代言人、線上教育打造虛擬教師、直播平台設計虛擬主播等商業應用而言,是一個至關重要的突破。此外,Vidu S2 的頭顯適配能力雖然尚在展示階段,但其代表的戰略方向值得關注。空間計算被認為是下一波運算平台的關鍵,而影片生成與編輯正是空間內容創作的核心環節。生數科技率先將即時影片生成模型與 VR 頭顯結合,讓使用者能夠在虛擬世界中直接「捏」出動態內容,這比傳統的 3D 建模與動畫製作流程更為直覺且快速。未來,隨著頭顯裝置的解析度與算力持續提升,這類技術有望成為空間內容創作的標準配備。

總體而言,Vidu S2 的推出不僅延續了生數科技在影片生成領域的技術積累,更透過即時編輯、動態角色與頭顯適配三大特色,為 AI 影片的應用場景打開了新的想像空間。從平面螢幕到沉浸式頭顯,從一次性生成到即時互動修改,Vidu S2 正逐步將影片生成從工具轉變為一種真正可與創作者協作的生產平台。在商業落地方面,影視後製、遊戲開發、虛擬活動、線上教育等產業都有機會率先導入這項技術,重新定義內容的生產與消費方式。

Related

相關文章

量子位生成式AI

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向

無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。

1 小時前
IT之家生成式AI

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作

作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

4 小時前
鈦媒體生成式AI

月之暗面遞表之後,Kimi 的成色要被驗算三遍

舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

7 小時前

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"

這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。

8 小時前