阿里千問發佈 Qwen-Image-3.0 圖像生成基礎模型:落字成畫,字字如印

重點摘要
首頁 > 智能時代>人工智能 阿里千問發佈 Qwen-Image-3.0 圖像生成基礎模型:落字成畫,字字如印 2026/7/21 14:56:42 來源:IT之家 作者:遠洋 責編:遠洋 評論: 感謝IT之家網友 烏蠅哥的左手 的線索投遞! IT之家 7 月 21 日消息,阿里發佈最新圖像生成基礎模型 Qwen-Image-3.0。新模型支持最大 4.
阿里於今日(7月21日)正式推出最新一代圖像生成基礎模型——Qwen-Image-3.0,這是千問(Qwen)系列在影像生成領域的第三代產品。此次發佈的核心亮點在於模型不再只是追求畫面美感,而是著重解決「實用性」難題,讓AI生成的圖像真正能承擔具體工作任務。 Qwen-Image-3.0支援長達5,000個token的超長輸入,這項能力讓模型可以一次性處理並生成包含大量文字與複雜結構的圖像。例如,它能同時產出數學試卷、學術論文等需要公式符號、幾何圖形、邏輯推導步驟等多種元素融合的知識圖解,也能生成複雜的UI介面設計。過去AI圖像生成模型往往在文字渲染上表現不佳,經常出現字體歪斜、字元錯亂或無法辨識的情況,而Qwen-Image-3.0特別強化了文字生成能力。 在文字渲染方面,該模型支援12種語言的文字生成,並內建超過20款字體的原生渲染能力,能夠確保文字清晰、排版精準。這項突破大幅降低了多語言產品海報、影視分鏡、漫畫分鏡等「可讀可用」商業素材的生產成本。以往需要設計師手動調整文字排版或使用多種工具組合才能完成的工作,現在可以透過單一模型直接生成,且字字清晰,如同印刷一般。 阿里千問團隊在官方介紹中指出,AI圖像生成模型的進步有目共睹,畫面越來越精緻,風格也越來越多元。然而,當需求從「生成一張好看的圖」轉向「完成一項實際工作」時,侷限便隨之顯現。例如,模型可以生成一張驚豔的寫實人像,卻難以渲染一份排版精確的數學試卷,或是一頁公式複雜的學術論文,甚至無法修復破損的古畫。Qwen-Image-3.0的目標正是讓圖像從「好看」真正走向「好用」。 除了文字與圖表生成,Qwen-Image-3.0也保留了前代模型在風格多樣性與畫質上的優勢,同時在理解複雜指令與長文本描述方面有顯著提升。這意味著使用者可以輸入更詳細的場景描述,模型便能一次生成符合所有要求的完整圖像,減少反覆修改的次數。 這一代模型特別適合需要大量文字與圖像結合的場景,例如教育領域的試題插圖、學術簡報的圖表製作、跨國企業的多語言宣傳品設計,以及內容創作者的分鏡繪製。過去這些工作往往需要設計師、排版師與翻譯人員協作,現在透過AI模型可以大幅縮短流程,讓創作者更專注於核心創意。 值得注意的是,Qwen-Image-3.0在處理「知識圖解」方面表現突出。過去的模型很難同時生成正確的數學公式、幾何圖形以及邏輯推導步驟,因為這些元素對文字與圖形的對齊要求極高。而新模型透過長上下文理解與字體渲染技術,能夠在單一圖像中整合多種訊息,且保持可讀性與正確性。 此外,該模型也支援生成複雜的UI介面,對於軟體開發者與設計師而言,可以快速產出高保真度的原型畫面,減少從概念到實作的時間成本。這項能力同樣受益於超長輸入與多語言支援,能夠針對不同語言市場定製介面內容。 阿里千問團隊強調,Qwen-Image-3.0的開發目標是降低AI圖像生成在商業應用中的門檻。過去模型生成的圖像往往只能用作裝飾或靈感參考,難以直接投入生產,因為文字錯誤、排版混亂等問題無法避免。而新一代模型透過精準的文字渲染與結構化生成,讓輸出的圖像可以直接用於印刷、網路發布或產品設計,真正實現「落字成畫,字字如印」的願景。 目前Qwen-Image-3.0已經開放給開發者與企業用戶在阿里雲平台上進行測試與整合。未來阿里千問計畫持續優化模型在專業領域的表現,例如醫學圖解、工程圖紙等需要高度精確性的場景,進一步拓展AI圖像生成的應用邊界。
Related
相關文章

在天使輪就押注多傢俱身智能獨角獸,這幾家機構贏“麻了”
這篇消息聚焦「在天使輪就押注多傢俱身智能獨角獸,這幾家機構贏“麻了”」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

市值蒸發超3000億後,MiniMax如何講好下一個“故事”?
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

一顆芯片,暴露了DeepSeek更大的野心
這篇消息聚焦「一顆芯片,暴露了DeepSeek更大的野心」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

Google要把AI大模型「刻」進芯片裡
Google正推動將大型AI模型直接固化在晶片硬體層級,以減少對外部記憶體與頻寬的依賴。此技術若成真,可大幅降低推論階段的延遲與功耗,對大規模部署生成式AI服務極具戰略意義。

AI獨角獸創始人最新判斷:90%企業AI場景,已經不需要最強模型
AI獨角獸Glean創辦人指出,目前超過九成企業AI應用場景不需使用最強模型,開源模型已能滿足多數需求。企業導入AI的真正瓶頸在於上下文工程,而非模型能力,模型商品化將使價值轉向應用層。應用公司應深入客戶核心工作流程,不必過度擔心模型廠商直接競爭。

WAIC觀點:最快兩年,迎來機器人“ChatGPT時刻”
在2026世界人工智能大會上,具身智能企業聚焦機器人真實場景落地,業界認為最快兩年內將迎來機器人「ChatGPT時刻」。然而,訓練世界模型仍面臨數據、表徵與閉環三大挑戰,各企業在數據來源與模型架構上各有不同策略。