AI日報:World Labs推多模態世界模型Atlas;WorkBuddy宣佈開放平臺上線;網信辦重點整治AI換臉、魔改名著

2026年9月2日 00:0019100 次瀏覽
站內 AI 整理稿

AI 領域今日出現多項新動態。World Labs 正式推出名為 Atlas 的多模態世界模型,並稱其為全球首個同類型模型。這款模型的核心突破,在於實現像素級的相機控制能力,能直接生成高品質圖像與影片,同時完成三維空間的精準重建,把影像生成與空間理解整合在同一套架構中處理。對創作者來說,Atlas 最直接的改變是鏡頭語言的操作彈性大幅提升。當相機控制細緻到像素層級,畫面中的鏡頭運動不再只能靠文字提示間接揣摩,而是可以被更精確地指定與調整,讓生成出來的結果更貼近創作者原本的構想。這項能力也讓特效模擬變得更為可行。

透過對鏡頭運動的細膩操控,Atlas 能夠模擬出電影等級的「子彈時間」效果,這種過去多半得靠多機拍攝或繁複後製才能完成的視覺語言,如今有機會在生成流程中被重現,靜態與動態影像之間的界線也因此更加模糊。所謂世界模型,強調的是對三維空間與場景結構的掌握,而不僅止於平面像素的排列。Atlas 同時輸出高品質影像與三維重建結果,意味著視覺內容生成正從「產生一張圖」推進到「建構一個可以被觀看、可以被運鏡的空間」,為視覺內容生成開創新的可能性。World Labs 將這款模型定位為多模態,反映的正是影像生成與三維空間理解在同一個系統中並行運作。

另一方面,Google 也推出全新的 AI 圖像設計與編輯工具 Google Pics,並正式開放給用戶使用。與獨立的影像軟體不同,這款工具直接整合於網頁版、Google Docs 與 Slides 之中,使用者在編輯文件時就能直接點選圖片進行修改,不需要切換到外部軟體,整體流程更為連貫。功能方面,Google Pics 涵蓋素材上傳、對象分割以及文字修改等常見的編輯需求。使用者可以把素材帶進工具之中,針對畫面裡的特定對象進行分割處理,或是直接修改圖像中的文字內容,對日常的文件製作與簡報設計而言,這些都是高頻率使用的操作。

在開放節奏上,Google 採取分階段方式,個人與企業用戶將依照階段陸續取得存取權限。這樣的安排意味著並非所有使用者都能在第一時間用到完整功能,實際可用範圍仍會依帳號類型與推進階段逐步擴大。從產品定位來看,Google Pics 的意義在於進一步降低日常影像處理的門檻。當圖片編輯被放進文件與簡報的編輯環境裡,使用者不必為了修一張圖而中斷手邊工作,也不需要額外學習一套獨立工具的操作邏輯,影像處理因此更貼近一般人的工作習慣。今日這兩項發布雖然分屬不同技術路線,卻都指向同一個方向,也就是把生成與編輯能力直接嵌入既有的工作流程之中。

Atlas 聚焦在影像與三維空間的生成品質與可控性,Google Pics 著重的是使用者取得工具的便利性與即時性,兩者共同反映出 AI 視覺工具正快速往更可控、也更貼近日常使用的方向推進。除此之外,今日 AI 日報的其他焦點還包括 WorkBuddy 宣佈開放平台上線,以及網信辦針對 AI 換臉、魔改名著等現象展開重點整治。前者屬於平台服務的對外開放,後者則涉及 AI 生成內容的規範方向,分別從產業供給與內容治理的角度,構成今日 AI 動態的另一條主線。

整體而言,從 World Labs 的多模態世界模型、Google 的圖像設計與編輯工具,到平台服務開放與內容整治,今日的訊息同時涵蓋技術突破、產品整合與規範治理等層面。這些進展也顯示,AI 的發展已不再只是單一技術課題,而是逐步擴散到內容創作流程以及使用規範之中,成為影響視覺內容生產方式的關鍵變數。

Related

相關文章

創意任務解決率95%,讓視覺AI自己練習,還能把經驗帶到視頻

在視覺AI領域,一項最新進展顯示,該技術在創意類任務中的解決率已達到95%。這項成果並非來自人工干預或反覆調參,而是透過讓AI自行積累與驗證有效的運作流程,逐步提升對複雜任務的處理能力。不僅如此,這種自我練習所獲得的經驗還能被順暢遷移至視頻領域,進一步拓展應用場景。 據了解,這套方法的核心在於讓AI在執行創意任務的過程中,自動記錄哪些工作流能帶來最佳成效,並反覆驗證其可靠性。

13 小時前

從技術炫技到交付為王,AI辦公“四強”並立

從技術炫技到交付為王,AI辦公「四強」並立 AI辦公賽道的敘事重心正在轉移。過去一段時間,外界評估這類產品時,最常被拿出來討論的是模型能力、生成速度與演示效果;如今,討論的重點逐漸轉向更務實的問題——產品究竟能不能被真正導入日常工作、能不能穩定地交付可用的結果。伴隨這個轉向,市場格局也從早期的多方競逐,收斂成「四強」並立的局面。 在生成式AI剛進入辦公場景時,技術展示幾乎是唯一的競爭語言。誰能在會議紀要、文件起草、資料整理、簡報生成這些場景裡做出更吸睛的效果,誰就更容易拿到關注。

15 小時前

影視颶風Tim稱「iPhoneDuo燙到握不住,可以煎雞蛋」;羅福莉直播小米大模型訓練,每小時燒掉超20萬元;曝瑪莎拉蒂與華為合作兩款新車

要聞提示1.影視颶風Tim稱“iPhoneDuo燙到握不住,可以煎雞蛋”,蘋果客服回應2.你會買嗎?曝瑪莎拉蒂已與華為敲定合作兩款新車:尊界工廠負責製造3.每小時“燒掉”超20萬元!“AI才女”羅福莉直播小米大模型訓練4.華為汪濤:昇騰960芯片將提前至2027年Q1發佈5.

23 小時前
何夕2077AI應用場景

訓練數據訴訟加碼

。紐約時報案最新解封材料顯示,付費牆內容的抓取行為同時牽涉微軟與 OpenAI 兩方,並非單一平台所為。文件具體提到約 9 萬份作品,數量規模讓案件的舉證基礎更為明確。 材料中另一項焦點是 Copilot 對流量生態的衝擊。相關數據指出,AI 摘要式回答可能導致原始來源的點擊率下滑達 93%,意味著內容被用於訓練與生成之後,回饋給出版方的實際導流幾近消失。 這兩項發現疊加,讓版權談判更難繞開。付費牆作品的取得途徑、模型輸出對點擊的替代效應,都成了談判桌上無法迴避的問題,後續授權條件的設計空間也被進一步壓縮。

1 天前
何夕2077AI應用場景

微軟Anthropic爭擬人AI

微軟Anthropic爭擬人AI。 Reddit帖擬人AI爭辯梳理兩邊分歧。Suleyman稱模型只是補全器���。Anthropic認為不確定性要認真處理。產品設計會受影響。

1 天前