萬相Wan3.0視頻生成模型正式上線,解鎖30秒長視頻創作新體驗

2026年8月24日 07:036000 次瀏覽
站內 AI 整理稿

萬相Wan3.0視頻生成模型今日正式上線,此次版本在生成時長、萬能創作、全能參考與真實世界還原四大維度迎來全面升級。其中最受矚目的變化在於,模型單次生成能力大幅提升,最高可直接產出30秒的連續視頻,為創作者提供更完整的敘事空間,也讓長鏡頭、多場景轉換等複雜創作需求得以在單次生成中實現。過去視頻生成模型多半受限於短片段輸出,創作者若要呈現完整情節,往往需要分段生成再手動拼接,不僅耗時,也容易出現畫面風格不一、動作不連貫等問題。萬相Wan3.0將單次生成時長一舉推進至30秒,意味著從人物對話、場景推移到情緒鋪陳,都能在單一生成流程中完整保留,敘事節奏不再被技術框架打斷。

對於廣告短片、劇情預告、產品展示等需要完整起承轉合的應用場景而言,這項突破直接改變了創作工作流的規劃方式。除了時長突破,萬相Wan3.0也首次導入多種文檔格式的輸入支援,包括 doc、xls、ppt、pdf、md 等常見辦公與文字檔案類型。這項設計讓使用者能直接以既有素材驅動視頻生成,進一步降低創作門檻,使從腳本構思到畫面呈現的流程更加直覺。舉例來說,創作者可以將一份完整的腳本文檔、產品簡報或數據表格直接匯入系統,模型便能根據文件內容理解敘事重點與結構,進而生成對應的視覺畫面。這項功能對於不熟悉傳統視頻剪輯工具的文字工作者、企劃人員與研究者而言,等於打開了一條更直接的創作路徑。

官方表示,新版本旨在精準還原物理世界的動態規律與視覺細節,同時讓不同背景的創作者都能更輕鬆地掌握專業級視頻生成工具。所謂真實世界還原,指的是模型在處理光影變化、物體運動軌跡、材質質感等物理特性時,能夠呈現更貼近真實拍攝的視覺效果。這對於需要高度寫實感的商業應用,例如產品模擬、建築預覽、情境重現等領域,具有實質意義。而「萬能創作」與「全能參考」兩大面向,則分別對應生成的多樣性與輸入素材的靈活度,讓模型不僅能依照文字指令創作,也能參考既有圖像或文件內容進行延伸生成。自8月6日開放公測以來,萬相Wan3.0已累積大量創作者與企業用戶的實際測試回饋。

團隊根據這些使用經驗,持續針對指令遵循能力與跨鏡頭一致性進行優化,確保模型在理解複雜提示詞的同時,也能維持前後畫面的風格與內容連貫,為正式上線版本打下更穩定的基礎。公測期間的用戶反饋顯示,創作者對於長視頻生成的需求相當強烈,尤其是在劇情類內容與教學影片的製作上,30秒的連續生成能力大幅減少了後製拼接的負擔。同時,企業用戶則更關注文檔輸入功能在簡報自動化與產品說明影片生成上的應用潛力。指令遵循能力的提升,意味著模型能夠更精確地理解使用者的文字描述,包括場景設定、角色動作、鏡頭運動等細節要求。

而跨鏡頭一致性的強化,則確保了在30秒的視頻中,人物外貌、服裝細節、環境光線等元素不會因為場景切換而產生突兀變化。這兩項能力的協同作用,正是萬相Wan3.0能夠勝任長篇幅敘事創作的關鍵技術支撐。從市場角度觀察,視頻生成模型的競爭已從單純的畫質比拼,逐步轉向生成長度、輸入彈性與物理真實感的綜合較量。萬相Wan3.0此次的版本更新,明顯針對創作者在實際工作中最常遇到的痛點進行回應:一是生成長度不足導致敘事破碎,二是素材轉換流程繁瑣導致創作門檻過高。透過單次30秒生成與多格式文檔輸入的組合,模型試圖打造一條從文字構想到視覺成片更為順暢的生產鏈路。

對於專業創作者而言,30秒的連續生成能力開啟了更多實驗性的創作可能,例如一鏡到底的氛圍短片、連續動作的舞蹈畫面、或是帶有時間流逝感的場景變換。而對於一般使用者來說,直接上傳既有文件即可生成視頻的設計,則讓視頻製作不再被視為一項需要專門學習的技術門檻,而是如同編輯文檔一般自然。萬相Wan3.0的正式上線,也代表著視頻生成工具正逐步從「輔助創作」走向「協同創作」的階段,模型不再只是被動執行指令的生成器,而是能夠理解素材脈絡、參與敘事規劃的創作夥伴。

Related

相關文章

鈦媒體生成式AI

偷書要賠15億美元,AI巨頭燒幾百萬本書反而合法了

偷書要賠15億美元,AI巨頭燒幾百萬本書反而合法了藍字計劃2026.08.24 18:01 · 來自廣東全文4120字00:00 / 11:49只要能訓練出更好的大模型,究竟要銷燬多少本實體書,甚至在實體書之外還會消耗多少前AI時代的“資產”,也許就再也沒人關心了。文 | 藍字計劃,作者|Chester一場現代版的“焚書”,正在美國發生。最近幾年,美國二手書市場出現了一個奇怪現象:不少神秘買家,一次性採購成百上千本書,不挑書、不問價,甚至連冷門舊書都照買不誤。隨著電子閱讀的普及,現在還有多少人看實體書?更別說這種成百上千的掃貨始買書。書商們自然也開始好奇:究竟是誰在買走這批書?最近,美國科技媒體404 Media聯繫到一名二手書商。對方剛剛通過書籍交易平臺Biblio,接到了一筆大約1000本舊書的訂單,其中還包括不少稀有、絕版和具有收藏價值的書。為了找出背後的買家,404 Media把一枚AirTag塞進其中一本書裡,然後一路追蹤。最終,這本書被送進了亞馬遜位於拉斯維加斯的一家倉庫。據404 Media調查,這些書到了亞馬遜倉庫後,命運卻只有三步:切掉書脊、批量掃描、然後扔進碎紙機。負責這項工作的VGT3團隊,甚至還給自己設計了一個頗為應景的Logo:一隻露著牙齒、手裡抓著書的霸王龍。 自己也賣書的亞馬遜卻幹起了銷燬實體書的活已經夠驚奇了,但更驚奇的是同樣這樣乾的,不只有亞馬遜。在更早之前,Anthropic就被曝光過一個代號為“巴拿馬計劃”的秘密項目。他們的目標,是把全世界的書都“破壞性掃描”一遍。在大約一年時間裡,Anthropic為此花費數千萬美元,買下數百萬本實體書,然後切掉書脊、掃描內容,再把剩下的紙張送去回收。美國的AI大公司,怎麼就和舊書幹上了?互聯網內容,不夠AI用了AI公司瘋狂買二手書,其實是想買下書裡的內容和數據。過去,互聯網是大模型最方便的數據來源。

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛