AI日報:World Labs推多模態世界模型Atlas;WorkBuddy宣佈開放平臺上線;網信辦重點整治AI換臉、魔改名著
AI 領域今日出現多項新動態。World Labs 正式推出名為 Atlas 的多模態世界模型,並稱其為全球首個同類型模型。這款模型的核心突破,在於實現像素級的相機控制能力,能直接生成高品質圖像與影片,同時完成三維空間的精準重建,把影像生成與空間理解整合在同一套架構中處理。對創作者來說,Atlas 最直接的改變是鏡頭語言的操作彈性大幅提升。當相機控制細緻到像素層級,畫面中的鏡頭運動不再只能靠文字提示間接揣摩,而是可以被更精確地指定與調整,讓生成出來的結果更貼近創作者原本的構想。這項能力也讓特效模擬變得更為可行。
透過對鏡頭運動的細膩操控,Atlas 能夠模擬出電影等級的「子彈時間」效果,這種過去多半得靠多機拍攝或繁複後製才能完成的視覺語言,如今有機會在生成流程中被重現,靜態與動態影像之間的界線也因此更加模糊。所謂世界模型,強調的是對三維空間與場景結構的掌握,而不僅止於平面像素的排列。Atlas 同時輸出高品質影像與三維重建結果,意味著視覺內容生成正從「產生一張圖」推進到「建構一個可以被觀看、可以被運鏡的空間」,為視覺內容生成開創新的可能性。World Labs 將這款模型定位為多模態,反映的正是影像生成與三維空間理解在同一個系統中並行運作。
另一方面,Google 也推出全新的 AI 圖像設計與編輯工具 Google Pics,並正式開放給用戶使用。與獨立的影像軟體不同,這款工具直接整合於網頁版、Google Docs 與 Slides 之中,使用者在編輯文件時就能直接點選圖片進行修改,不需要切換到外部軟體,整體流程更為連貫。功能方面,Google Pics 涵蓋素材上傳、對象分割以及文字修改等常見的編輯需求。使用者可以把素材帶進工具之中,針對畫面裡的特定對象進行分割處理,或是直接修改圖像中的文字內容,對日常的文件製作與簡報設計而言,這些都是高頻率使用的操作。
在開放節奏上,Google 採取分階段方式,個人與企業用戶將依照階段陸續取得存取權限。這樣的安排意味著並非所有使用者都能在第一時間用到完整功能,實際可用範圍仍會依帳號類型與推進階段逐步擴大。從產品定位來看,Google Pics 的意義在於進一步降低日常影像處理的門檻。當圖片編輯被放進文件與簡報的編輯環境裡,使用者不必為了修一張圖而中斷手邊工作,也不需要額外學習一套獨立工具的操作邏輯,影像處理因此更貼近一般人的工作習慣。今日這兩項發布雖然分屬不同技術路線,卻都指向同一個方向,也就是把生成與編輯能力直接嵌入既有的工作流程之中。
Atlas 聚焦在影像與三維空間的生成品質與可控性,Google Pics 著重的是使用者取得工具的便利性與即時性,兩者共同反映出 AI 視覺工具正快速往更可控、也更貼近日常使用的方向推進。除此之外,今日 AI 日報的其他焦點還包括 WorkBuddy 宣佈開放平台上線,以及網信辦針對 AI 換臉、魔改名著等現象展開重點整治。前者屬於平台服務的對外開放,後者則涉及 AI 生成內容的規範方向,分別從產業供給與內容治理的角度,構成今日 AI 動態的另一條主線。
整體而言,從 World Labs 的多模態世界模型、Google 的圖像設計與編輯工具,到平台服務開放與內容整治,今日的訊息同時涵蓋技術突破、產品整合與規範治理等層面。這些進展也顯示,AI 的發展已不再只是單一技術課題,而是逐步擴散到內容創作流程以及使用規範之中,成為影響視覺內容生產方式的關鍵變數。
Related
相關文章

創意任務解決率95%,讓視覺AI自己練習,還能把經驗帶到視頻
在視覺AI領域,一項最新進展顯示,該技術在創意類任務中的解決率已達到95%。這項成果並非來自人工干預或反覆調參,而是透過讓AI自行積累與驗證有效的運作流程,逐步提升對複雜任務的處理能力。不僅如此,這種自我練習所獲得的經驗還能被順暢遷移至視頻領域,進一步拓展應用場景。 據了解,這套方法的核心在於讓AI在執行創意任務的過程中,自動記錄哪些工作流能帶來最佳成效,並反覆驗證其可靠性。

從技術炫技到交付為王,AI辦公“四強”並立
從技術炫技到交付為王,AI辦公「四強」並立 AI辦公賽道的敘事重心正在轉移。過去一段時間,外界評估這類產品時,最常被拿出來討論的是模型能力、生成速度與演示效果;如今,討論的重點逐漸轉向更務實的問題——產品究竟能不能被真正導入日常工作、能不能穩定地交付可用的結果。伴隨這個轉向,市場格局也從早期的多方競逐,收斂成「四強」並立的局面。 在生成式AI剛進入辦公場景時,技術展示幾乎是唯一的競爭語言。誰能在會議紀要、文件起草、資料整理、簡報生成這些場景裡做出更吸睛的效果,誰就更容易拿到關注。
影視颶風Tim稱「iPhoneDuo燙到握不住,可以煎雞蛋」;羅福莉直播小米大模型訓練,每小時燒掉超20萬元;曝瑪莎拉蒂與華為合作兩款新車
要聞提示1.影視颶風Tim稱“iPhoneDuo燙到握不住,可以煎雞蛋”,蘋果客服回應2.你會買嗎?曝瑪莎拉蒂已與華為敲定合作兩款新車:尊界工廠負責製造3.每小時“燒掉”超20萬元!“AI才女”羅福莉直播小米大模型訓練4.華為汪濤:昇騰960芯片將提前至2027年Q1發佈5.
微軟Anthropic爭擬人AI
微軟Anthropic爭擬人AI。 Reddit帖擬人AI爭辯梳理兩邊分歧。Suleyman稱模型只是補全器���。Anthropic認為不確定性要認真處理。產品設計會受影響。
Microsoft Open-Sources TauGrid: A Kubernetes-Native Stack for GPU AI Workloads
Platform teams running AI on Kubernetes rarely run one thing. They run a queueing system, a distributed runtime, GPU node health checks, dashboards, and a layer of submission scripts holding all of it together.