ICML 2026|美圖提出BridgeRemoval,讓視頻消除不再穿幫
隨著人工智慧修圖技術日益普及,在照片中移除路人、雜物早已不是新鮮事,每逢假期出遊後「一鍵消除」幾乎成為許多人必備的後製流程。然而,當這項能力從靜態圖片延伸到動態影片時,技術難度卻大幅攀升——不僅要在每一幀中精準補全被遮擋的景物,還要同時維持單一幀內的空間連貫性與前後幀之間的時序一致性,否則就會出現畫面穿幫、抖動甚至閃爍等惱人的瑕疵。為了突破這項長期困擾業界的瓶頸,美圖公司日前在國際機器學習大會 ICML 2026 上正式發表了一項名為 BridgeRemoval 的創新方法,試圖為影片消除帶來更流暢、更自然的解決方案。
BridgeRemoval 的核心目標是解決影片目標移除過程中時空不一致的難題。與圖片消除相比,影片消除的挑戰在於需要同步處理兩層資訊:一層是空間層——每一幀內部必須保持背景結構的合理與完整;另一層則是時間層——前後幀之間的背景必須連續變化,不能出現突然跳動或分段感。過去許多方法往往只能專注於單一幀的補全,卻忽略了幀與幀之間的關聯,導致結果在播放時產生明顯的視覺瑕疵。BridgeRemoval 正是在此背景下誕生,透過更先進的時空建模機制,讓移除目標後的背景修補能夠同時兼顧兩個維度的穩定性。這項技術的推出,也反映出現階段 AI 影片編輯正在朝向更高階的時空建模邁進。
過去一般消費者若要手動去除影片中的不必要元素,往往需要借助專業軟體逐幀處理,耗時費力,且成果難以掌握。美圖此次提出的 BridgeRemoval 方法,有望大幅降低影片後製的門樻,讓一般使用者也能輕鬆獲得流暢、自然的消除效果。雖然官方並未公開具體的模型架構細節,但從命名與論文摘要推測,BridgeRemoval 很可能是透過「橋接」的設計來連結前後幀的訊息,從而消除過去因斷層造成的穿幫狀況。從技術發表的場合來看,ICML 是機器學習領域的頂尖國際會議,每年吸引全球頂尖研究者與企業參與。美圖能在 ICML 2026 上發表這項成果,本身就代表了其在影像與影片處理領域的研發實力受到學術界認可。
同時也說明了當前 AI 影片編輯的研究熱點正從單純的生成轉向更高品質的編輯與修復,而 BridgeRemoval 正是這波趨勢下的代表性成果。美圖近年來持續投入 AI 影像技術的創新,從最早的圖像美顏、去背,到後來的圖片修復與生成,其技術路徑已逐步延伸至動態影片。這次發表的 BridgeRemoval 補全了其在影片消除上的關鍵拼圖,讓使用者未來在拍攝日常短片或短影音時,無需因為畫面中出現干擾物而重拍,只需一鍵即可讓背景回歸純淨。這對於內榮創作者、電商賣家,甚至一般家庭用戶都有實質幫助。實際上,影片消除的難點不僅在於補全被遮擋的像素,更在於維持前後幀的邏輯流暢。
例如消除一段走動畫面中的行人,背景的紋理與陰影必須隨著鏡頭移動而自然變化,若某幀補全的紋理與前後幀不同,就會產生閃礫效應。BridgeRemoval 之所以強調「穩定性與自然度」,正是針對這類問題進行優化。雖然目前還處於學術發表階段,但這類技術往往很快就能落地為產品功能,屆時使用者只要在 App 中選擇影片、框選目標物件,就能輕鬆完成消除。值得注意的是,BridgeRemoval 的提出也揭示了 AI 模型從靜態到動態的遷移能力正在快速提升。過去許多影像處理模型是針對單張圖片訓練的,套用到影片後往往需要逐幀處理,缺乏時間維度的學習。
而 BridgeRemoval 則明顯是專為影片設計的時空模型,這意味著美圖在模型架構上已經做了針對性的調整,使其能夠捕捉幀與幀之間的關聯。這也讓外界對美圖未來在影片編輯領域的產品路線圖充滿期待。從更大的視角來看,AI 影片編輯正處在技術爆法的窗期。除了美圖以外,多家科技公司也在積極布局影片修復、生成與編輯工具。BridgeRemoval 的出現,不僅為影片消除提供了新的解方,也為業界確立了一項新的標竿。隨著這類方法的進一步完善,未來消費者或許只需透過手機,就能完成專業級別的影片後製,徹底改寫傳統影片創作的工作流。
目前美圖尚未公布 BridgeRemoval 的具體上線時間表,但業內人士預估,這類技術將以軟體升級或新功能的形式逐步整合至美圖旗下產品中。屆時,無論是生活記錄還是商業拍攝,影片中的不必要元素都將不再是麻煩。而這一切的基礎,正是建立在像 ICML 2026 這樣的學術研討會上,研究人員與工程師們為了「讓消除不穿幫」所做的每一次突破。
Related
相關文章

前保安殺進了AI決賽,高中生拿走25萬!這AI比賽辦得有點絕
! 他叫彭銘裕,今年24歲,之前從事的職業是保安。 而就是這麼與AI八竿子打不著邊的他,竟能從數萬人中殺出一條血路,直接斬獲全國第20強。 △《動動脖子》項目作者,彭銘裕 如此的反轉,還要從彭銘裕當保安那段時間說起。 當時,他刷抖音時被各種抖音特效給吸引注了,下班後便開始自己琢磨怎麼做特效。隨著一點點的經驗積累,也讓彭銘裕從小白新手走到了高級特效師。
FigmaTrace開源
Dataset Viewer Auto-converted to Parquet API Embed Duplicate Data Studio Subset (1) default · 3.47k rows default (3.47k rows) Split (2) train · 2.

石頭 A30 Pro Steam 3.0 圖賞:180℃ 蒸汽與 90℃ 熱水加持,主打蒸熱雙洗
作者:馬卡 責編:馬卡 評論: 8 月 21 日消息,8 月 18 日,石頭旗下 A30 Pro Steam 3.0 洗地機正式開售,新品宣稱首次實現了 180℃ 活性蒸汽與 90℃ 高溫熱水的一鍵混洗,可在重度油汙環境使用,首發價 3299 元,購機可返 200 元現金,到手價 3099 元。

美政府機構警告:黑客正利用 AI 攻擊全美多地供水系統
作者:清源 責編:清源 評論: 8 月 20 日消息,據外媒 TechCrunch 今天(20 日)報道,美國供水系統近期接連遭遇網絡攻擊,美國網絡安全和基礎設施安全局(CISA)、美國聯邦調查局和美國國家安全局等安全機構警告,黑客正持續入侵關鍵基礎設施使用的西門子 S7 可編程邏輯控制器。

“AI焚書”,其實是個誤解
字母榜2026.08.19 17:00 · 來自山西全文4876字00:00 / 13:46“獲取知識,而非消除知識。文 | 字母榜在硅谷,“AI焚書”這件事,只能說是越鬧越瘋了。在最新的一篇報道中,媒體和二手書商合作,在一批被神秘買家訂走的書裡塞了一枚AirTag,一路追蹤,最後追到了亞馬遜位於拉斯維加斯的工廠。工廠員工表示,這是亞馬遜一個名為VGT3的項目,專門幹切書掃描那檔子事。一本二手書硬是走出了刑偵劇的路線。這事發展到現在,多少有點魔幻。
Cartesia 推出 Sonic-3.6:串流 TTS 模型,現已稱霸 Artificial Analysis 兩大語音競技場
Cartesia 發布了即時文字轉語音模型的最新版本 Sonic-3.6,距離 Sonic-3.5 推出約三個月。本次更新著重在自然度,且可獨立驗證。Sonic 3.6 目前在 Artificial Analysis 的兩項語音排行榜皆位居第一——在提供者語音榜上獲得 1,283 Elo 分數,在受控語音榜上則有 1,123 分。後者的結果更具意義:該榜單將所有模型複製到相同的八個參考語音上,從而將合成引擎與語音庫分離。Sonic-3.6 在此領先,Sonic-3.5 位居第二,ElevenLabs Eleven v3 排名第三。該模型基於狀態空間模型而非 Transformer,且 Cartesia 宣稱首次音訊輸出時間低於 90 毫秒。目前以 Beta 版形式提供。能否部署?可以,它提供 Beta 版及託管 API 服務。