我,用美圖Agent,一句話拍出AI短劇
美圖公司近日宣布推出名為「美圖Agent」的全新功能,使用者只需輸入一句描述劇情或場景的文字,系統便能在短時間內自動生成一部完整的AI短劇。這項技術結合自然語言處理與影像生成模型,將口語化的指令轉化為連續畫面與角色動作,大幅降低短劇創作的技術門檻。無論是想製作古裝愛情片段,還是現代職場小品,使用者都不需要具備專業的剪輯或動畫背景,只要在平台上寫下想法,就能快速產出內容。這項服務的核心,是美圖自研的AI模型。該模型能夠理解複雜的指令,並自動將文字拆解成分鏡腳本,再透過圖像生成與動畫化技術,把靜態畫面串聯成流暢的影片。
根據官方說明,整個流程包含語義解析、場景建構、角色生成與動作編排,最終輸出帶有對話、背景轉換與基本特效的短片。在實際測試中,輸入類似「一個上班族在捷運站撿到神奇手機」這類簡單句子,系統約在數分鐘內就能產出約30秒的短劇,效果相當直觀。目前「美圖Agent」已整合進美圖旗下的應用程式中,用戶可以免費試用基本功能,但若想使用更高解析度、更長影片長度或更多風格選項,則需要付費訂閱。這種免費試用加進階付費的模式,與多數AI工具常見的訂閱制相似,旨在降低入門門檻的同時,也為後續商業化鋪路。美圖方面表示,這項功能不僅瞄準短影音創作者,也試圖為品牌行銷與教育內容提供快速產製方案。
從技術角度來看,美圖Agent涵蓋的環節相當完整。使用者輸入一句話後,AI會先進行語意分析,判斷場景類型、角色數量、情緒基調與故事走向,再自動生成對應的分鏡腳本。接著,系統調用影像生成模型,根據腳本逐一繪製畫面,並運用動畫化技術讓角色做出簡單動作,例如走路、對話、表情變化等。最後,這些畫面會被串聯成影片,並自動加上基本特效與過場。美圖強調,這個過程不需要使用者手動調整任何參數,真正實現了「一句話拍片」的體驗。美圖公司過去以修圖軟體聞名,近年積極轉向AI內容創作平台。此次推出短劇生成功能,顯示其不再滿足於靜態影像處理,而是企圖搶攻快速成長的短影音與AI生成內容市場。
隨著抖音、TikTok等平台帶動短劇需求暴漲,許多創作者經常面臨拍攝成本高、剪輯耗時的痛點,而AI生成工具正好能提供低成本、高效率的解決方案。美圖Agent正是瞄準這塊缺口,讓沒有專業設備與技術的使用者也能參與短劇創作。值得注意的是,這類「一句話生成影片」的服務並非美圖獨有。近年來,包括OpenAI的Sora、Runway的Gen系列,以及國內多家新創公司,都在探索文字到影片的技術。然而,美圖的優勢在於其龐大的既有用戶基礎與成熟的影像處理底層技術。透過將Agent整合進現有App,美圖能直接觸及數億活躍用戶,無需從零培養新用戶習慣。
此外,美圖自研的模型針對亞洲審美與常見場景進行優化,這在生成東亞風格的角色與背景時,往往比其他通用模型更有細節。根據美圖官方說法,目前「美圖Agent」支援多種風格與主題,從古裝、仙俠到現代都市、科幻題材皆可一鍵生成。生成的影片長度目前以30秒為主流,但未來將持續優化生成品質與長度。美圖還提到,正在考慮加入更多互動式編輯功能,讓使用者能進一步調整角色外貌、場景細節或對話內容,而不是只能被動接受AI的輸出。這種「生成後可編輯」的設計,能夠兼顧效率與創作彈性,避免使用者因AI結果不符預期而放棄使用。從市場定位來看,這項工具不僅服務個人創作者,也瞄準商業應用。
品牌行銷人員可以用它快速產出產品介紹短劇,教育機構也能用它製作互動式學習影片,大幅降低影片製作的人力與時間成本。尤其對於中小型企業而言,過去要製作一支30秒的廣告影片,可能需要編劇、導演、演員、攝影、剪輯等多個角色,成本動輒數萬到數十萬元;如今透過AI,只需輸入一句話就能在幾分鐘內獲得初步成果,雖然品質還無法完全取代專業團隊,但已足以用於快速測試或社交媒體日常更新。美圖此次推出Agent功能,也反映出整個AI產業從「生成圖片」進化到「生成影片」的趨勢。過去一年,AI繪圖已經相當普及,但影片生成因涉及時序連貫性與動作合理性,技術難度更高。
美圖選擇從短劇切入,因為短劇的時長短、場景簡單、角色單一,對AI的連貫性要求相對較低,更容易達成可接受的品質。隨著模型持續迭代,未來生成更長、更複雜的影片也將逐漸成為現實。對於使用者而言,目前可以透過美圖旗下應用程式免費體驗「美圖Agent」的基本版本。操作流程非常直觀:打開App,找到Agent功能入口,輸入一句描述,點擊生成,等待數分鐘即可觀看結果。如果對結果不滿意,可以修改句子重新生成,或嘗試不同風格的參數。雖然現階段生成的影片在細節流暢度上仍有改進空間,例如角色動作略顯僵硬或背景偶有變形,但對於快速構思故事腳本或製作社交媒體素材來說,已經具有實用價值。
總體而言,美圖從修圖軟體跨界到AI短劇生成,是其平台轉型的重要一步。這項功能的推出,不僅讓普通使用者也能輕鬆創作短劇,更為內容產業提供了一個低成本、高速度的產製工具。隨著AI技術持續演進,未來我們可能真的只需要一句話,就能讓腦中的故事躍然螢幕上,而美圖正試圖在這一波浪潮中佔據先機。
Related
相關文章

商湯發佈 SenseNova U1 Pro 正式版圖片創作模型,至高支持 8K 分辨率及特殊長寬比
作者:沁滄(實習) 責編:沁滄 評論: 9 月 21 日消息,商湯今日發佈 SenseNova U1 Pro 正式版模型,上線商湯小浣熊,和商湯日日新 API 服務。據介紹,SenseNova U1 Pro 模型可通過內生的圖文交錯思維鏈創作出內容準確、設計精美、生產可用的圖片素材,效果比肩海外頂尖模型。
Best Voice Cloning APIs in 2026: Speaker Similarity, Consent Checks, and Price per 1M Characters
A stock voice only needs to sound good.A cloned voice must sound like one specific person.That is a harder test, and the 7 Voice cloning providers here handle it very differently.
Linkup Research Releases SPARSEUP: A 149M-Parameter Open-Source Sparse Embedding Model
Linkup research team releases SPARSEUP, an open-source learned sparse embedding model. The model runs on a 149M-parameter ModernBERT backbone and ships under Apache 2.0. Linkup team reports 56.4 average nDCG@10 on BEIR-13.

創意任務解決率95%,讓視覺AI自己練習,還能把經驗帶到視頻
在視覺AI領域,一項最新進展顯示,該技術在創意類任務中的解決率已達到95%。這項成果並非來自人工干預或反覆調參,而是透過讓AI自行積累與驗證有效的運作流程,逐步提升對複雜任務的處理能力。不僅如此,這種自我練習所獲得的經驗還能被順暢遷移至視頻領域,進一步拓展應用場景。 據了解,這套方法的核心在於讓AI在執行創意任務的過程中,自動記錄哪些工作流能帶來最佳成效,並反覆驗證其可靠性。

從技術炫技到交付為王,AI辦公“四強”並立
從技術炫技到交付為王,AI辦公「四強」並立 AI辦公賽道的敘事重心正在轉移。過去一段時間,外界評估這類產品時,最常被拿出來討論的是模型能力、生成速度與演示效果;如今,討論的重點逐漸轉向更務實的問題——產品究竟能不能被真正導入日常工作、能不能穩定地交付可用的結果。伴隨這個轉向,市場格局也從早期的多方競逐,收斂成「四強」並立的局面。 在生成式AI剛進入辦公場景時,技術展示幾乎是唯一的競爭語言。誰能在會議紀要、文件起草、資料整理、簡報生成這些場景裡做出更吸睛的效果,誰就更容易拿到關注。
影視颶風Tim稱「iPhoneDuo燙到握不住,可以煎雞蛋」;羅福莉直播小米大模型訓練,每小時燒掉超20萬元;曝瑪莎拉蒂與華為合作兩款新車
要聞提示1.影視颶風Tim稱“iPhoneDuo燙到握不住,可以煎雞蛋”,蘋果客服回應2.你會買嗎?曝瑪莎拉蒂已與華為敲定合作兩款新車:尊界工廠負責製造3.每小時“燒掉”超20萬元!“AI才女”羅福莉直播小米大模型訓練4.華為汪濤:昇騰960芯片將提前至2027年Q1發佈5.