Meta Muse Video 生成視頻樣片曝光,單次 AI 最長生成 10 秒視頻

2026年8月20日 10:41
Meta Muse Video 生成視頻樣片曝光,單次 AI 最長生成 10 秒視頻
站內 AI 整理稿

作者:故淵 責編:故淵 評論: 8 月 20 日消息,科技媒體 testingcatalog 昨日(8 月 19 日)發佈博文,報道稱 Meta 公司即將推出 Muse Video 模型,目前已邀請部分合作夥伴 Beta 測試,單次可以生成最長 10 秒視頻。根據該媒體測試生成的視頻,Muse Video 在細節呈現、對場景和物體關係的理解,以及連續畫面在時間維度上的穩定性方面,展現出較高潛力。Meta 此前承認模型仍存在音頻與畫面同步不足的問題,對高速運動的物理準確性也有差距。現有樣本為 10 秒片段,尚不足以驗證模型在更長時長敘事、複雜角色持續一致性或高強度動作場景中的穩定表現。

附上相關測試生成的視頻如下:提示詞“A woman with curly red hair and a green scarf walks toward camera down a crowded Tokyo street at night, stops, and looks up”(一位有著紅色捲髮、圍著綠色圍巾的女子在夜晚擁擠的東京街道上走向鏡頭,她停下腳步,抬頭望向前方。)A shaky, low-quality iPhone video recording.

A guy holding the camera selfie-style walks up to random people on a busy city street and asks each one, "How do you feel about being AI generated?" The video has authentic smartphone artifacts—slight motion blur, overexposed sky, wind noise, and the occasional finger over the lens.

"“一段抖動且畫質很差的 iPhone 視頻。一個男人拿著手機,像自拍一樣,走到繁忙的城市街道上隨機問路人:“你對被人工智能生成有什麼感覺?”視頻中存在典型的智能手機拍攝痕跡 —— 輕微的運動模糊、過曝的天空、風噪,以及偶爾出現的遮擋鏡頭的手指。”"The rocket at the rocket station is launching.Everything looks normal until the rocket explodes into confetti pieces and leaves nothing behind."“火箭發射站的火箭正在發射。

一切看起來都很正常,直到火箭爆炸成碎片,什麼也沒留下。”"The man couldn't believe it when he finally became a kitten dad.Excitedly he shouted "I'm a dad now!A cat dad!".He's so happy that he starts tearing up.The kitten meows before the video ends."“當他終於當上貓爸時,他簡直不敢相信自己的眼睛。他興奮地大喊:‘我當爸爸啦!貓爸!’他高興得熱淚盈眶。視頻結束前,小貓喵喵叫了一聲。

”"A glass of red wine tips over on a white marble counter, spilling toward the camera.Static shot" 一杯紅酒傾倒在白色大理石臺面上,酒液濺向鏡頭。固定鏡頭。

"A cat made out of Lego technic in the rain made out of fluffy plastic rain"“一隻用樂高科技系列積木拼成的貓,在蓬鬆塑料雨中”"Orbiting shot around a chef plating a dish, 180-degree arc, shallow depth of field."“圍繞正在擺盤的廚師進行 180 度弧線環繞拍攝,景深較淺。”"A neon sign reading ‘OPEN 24 HOURS’ flickers on above a diner door in the rain.

" 雨中,一家餐館門上方的霓虹燈招牌閃爍著“24 小時營業”的字樣。"A car’s headlights sweep across a bedroom wall at night, shadows shifting."“夜裡,汽車前燈掃過臥室牆壁,影子不斷移動。”Two swordsmen in a bamboo forest exchange three strikes, blades meeting mid-frame.Wide shot, overcast light.兩名劍客在竹林中交鋒三下,刀刃在畫面中央相撞。遠景鏡頭,陰天光線。

"Two fighters in a dimly lit warehouse; one throws a punch, the other blocks and counters.Handheld camera, shallow depth of field."“兩名拳擊手在光線昏暗的倉庫裡對打;一人出拳,另一人格擋反擊。手持攝像機,淺景深。

”"Cyberpunk hacker robot working in front of many monitors"“賽博朋克黑客機器人正在多個顯示器前工作” 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Meta,MuseMeta 推出 Meta AI 原生 Mac 應用:支持窗口共享、跨應用聽寫“AI 換臉”色情 App 營銷引發爭議:Meta 下架廣告、蘋果移除應用因隱私擔憂,美國移民與海關執法局禁止員工佩戴 Meta 智能眼鏡美國 29 州起訴 Meta 案開庭,後者否認刻意誘導兒童沉迷社交平臺Meta 專利探索智能眼鏡未來:可識別人臉自動梳理、AI 提取精彩片段涉嫌誘導青少年成癮,美國多州起訴 Meta 公司

Related

相關文章

阿里達摩院推出肝癌AI模型,精準識別1釐米微小腫瘤

8月24日消息,阿里巴巴達摩院聯合中國醫科大學附屬盛京醫院等機構研發出肝癌診斷AI模型DAMO LiON 8月24日消息,阿里巴巴達摩院聯合中國醫科大學附屬盛京醫院等機構研發出肝癌診斷AI模型DAMO LiON,可通過CT影像識別微小的肝臟癌變病灶。在兩個月的真實世界前瞻臨床試驗中,該AI模型發現了15例原本被遺漏的惡性腫瘤,絕大部分為1釐米左右的病灶,幫助患者得到及時的手術或藥物治療。

剛剛

WRC 2026|原生全模態世界模型:從模擬世界到交互世界

世界機器人大會期間,智象未來創辦人梅濤於「物理AI引領者論壇」發表演講,提出原生全模態世界模型從「模擬世界」走向「交互世界」的觀點。他強調即使AI模型智商接近140,高IQ不代表全能,需具備在真實物理世界中穩定完成任務的能力,此為Physical AI發展的關鍵。論壇聚焦通用物理智慧的技術演進與產業路徑,匯聚眾多專家參與。

剛剛

阿里巴巴達摩院推出肝癌 AI 模型:可精準識別 1 釐米微小腫瘤

作者:遠洋 責編:遠洋 評論: 感謝網友 HH_KK 的線索投遞!8 月 24 日消息,阿里巴巴達摩院聯合中國醫科大學附屬盛京醫院等機構研發出肝癌診斷 AI 模型 DAMO LiON,可通過 CT 影像識別微小的肝臟癌變病灶。在兩個月的真實世界前瞻臨床試驗中,該 AI 模型發現了 15 例原本被遺漏的惡性腫瘤,絕大部分為 1 釐米左右的病灶,幫助患者得到及時的手術或藥物治療。

剛剛
何夕2077研究與前沿

棋類模型可解釋

在人工智慧研究領域,模型的可解釋性一直是備受關注的課題。近期有觀點指出,棋類模型具備可解釋的特性,這意味著此類模型的決策過程與內部運作機制,能夠被研究者或使用者以相對直觀的方式理解與分析。相較於許多深度學習模型常被視為「黑箱」,棋類模型在處理圍棋、象棋等棋類遊戲時,其每一步的選擇與策略推演,往往能透過棋譜或演算法邏輯加以回溯,從而為AI的透明化提供了一個具體的觀察窗口。

9 小時前