谷歌相冊推出AI“視頻混音”功能:搭載Gemini Omni,主打數秒內電影級剪輯
重點摘要
谷歌相簿推出全新AI影片編輯工具「影片混音」,搭載Gemini Omni處理器,讓用戶數秒內即可完成電影級影片剪輯與風格轉換。該功能支援一鍵調整光線、更換背景及套用水彩、油畫等藝術效果,於發佈日起陸續在美國、印度、日本等十多國向特定訂閱用戶推出。
谷歌相冊近日正式推出全新生成式AI影片編輯工具「視頻混音」(Video Remix),這項功能標榜能讓一般使用者在沒有專業剪輯技術的條件下,於數秒內完成電影等級的影片轉換與修剪。根據谷歌於7月8日發布的消息,該工具已整合至Google Photos的「創建」標籤頁,用戶可直接開啟使用,無需額外下載或切換應用程式。「視頻混音」的核心技術來自谷歌最新發表的Gemini Omni處理器。這款晶片具備「根據任何輸入創建任何內容」的強大多模態多媒體處理能力,能同時理解與生成文字、影像、音訊與影片,為這項編輯工具提供即時的算力支援。
得益於此,用戶只需一鍵操作,即可為昏暗畫面套用電影級重新照明、智慧替換純色背景,或是將整段影片快速轉化為水彩、素描、油畫等藝術風格。這項新功能是谷歌深化消費級應用生成式AI布局的最新一環。透過在Google Photos內無縫整合輕量但高品質的編輯能力,谷歌正試圖強化其生態系的用戶黏著度,並持續與蘋果、OpenAI及Adobe等競爭對手在AI影像與影片工具領域交鋒。近期Google Photos已陸續上線AI智慧修圖工具以及基於AI的數字衣櫥虛擬試穿功能,顯示科技巨頭正加速將底層大模型能力轉化為高頻、低門檻的日常應用場景。
關於推出時程與地區,谷歌表示「視頻混音」功能已於發布當日開始向美國、印度、日本、韓國、巴西等十多個國家的Google AI Plus、Pro與Ultra訂閱用戶滾動推送。符合資格的使用者可以在Google Photos的「創建」標籤頁中找到該工具,並立即嘗試一鍵轉換影片風格的體驗。隨著AI技術逐步滲透至大眾創作者端,傳統內容生產範式正被全面重塑,而Google Photos此次更新無疑是這一趨勢下的具體實踐。除了影片編輯外,谷歌也持續擴大AI在手機與雲端服務中的應用範圍。
例如,先前推出的AI智慧修圖工具讓用戶能無痕移除照片中的路人或雜物,而數字衣櫥虛擬試穿則允許用戶在線上模擬不同服裝的穿著效果。這些功能共同構成了谷歌在AI消費級產品上的多維度布局,旨在讓使用者無需專業知識就能享受生成式AI帶來的創作便利。業界觀察指出,Google Photos作為全球最受歡迎的相簿與備份服務之一,擁有龐大的用戶基礎與豐富的影音資料。將「視頻混音」這類生成式AI工具直接嵌入其中,不僅能降低使用者轉換平台的門檻,也能進一步收集使用者對AI編輯效果的偏好與回饋,有助於谷歌持續迭代Gemini模型與相關應用。
同時,此舉也對Adobe Premiere Pro、蘋果iMovie等傳統剪輯軟體形成壓力,因為後者往往需要較高的學習成本或付費門檻。值得一提的是,Gemini Omni處理器在谷歌近期的AI發展藍圖中扮演關鍵角色。除了Google Photos,該晶片也已用於其他多模態生成任務,例如文字轉影片、影像字幕生成以及即時語音翻譯等。谷歌I/O大會上曾展示Gemini Omni如何以單一架構處理跨模態資訊,而「視頻混音」正是這項技術成熟落地的具體案例。對於創作者而言,過去需要專業軟體與繁複步驟才能達成的調色、背景置換與風格化效果,如今只需輕點幾下即可完成。
在可預見的未來,類似「視頻混音」的AI工具將變得更加普及,甚至可能成為手機相簿應用的標準功能。谷歌此次選擇在Google Photos中優先推出此功能,也反映出公司對於個人創作場景的高度重視。畢竟,使用者每天產生的照片與影片數量龐大,若能快速為這些內容增添電影感或藝術風格,將大幅提升內容分享的意願與平台的活躍度。目前該功能僅限於付費訂閱用戶使用,但隨著技術成熟與成本下降,谷歌未來可能逐步開放給更多用戶,甚至納入免費方案中的部分額度。這也符合過去Google Photos在AI功能上的一貫策略:先以高階訂閱方案測試市場反應,再視情況擴大覆蓋範圍。
對於期待體驗AI剪輯魔力的用戶而言,現在已是時候考慮升級至AI Plus、Pro或Ultra方案,以搶先試用這項革新工具。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。