阿里千問圖像生成模型Qwen-Image-3. 0 上線 開放API且0. 18 元/張起
重點摘要
阿里巴巴千問圖像生成模型Qwen-Image-3.0正式上線,旗艦版Pro與標準版Standard同步開放API,文生圖起售價0.18元/張,海外用戶可透過Qwen Cloud接入。該模型在國際評測平台Arena.ai文生圖榜單中位列國內第一,主打超長文本理解與精細化渲染,支援4.5k token指令、10px小字及LaTeX公式還原,並涵蓋百種藝術風格與12國語言。目前模型已嵌入電商、影視分鏡、廣告海報等商業工作流。
阿里巴巴千問圖像生成模型Qwen-Image-3.0於8月5日正式登陸千問AI平台,並同步向所有用戶全量開放。這次上線不僅帶來旗艦版Pro與標準版Standard兩款模型,也一併開放API介面,其中文生圖功能起售價為0.18元人民幣一張,海外使用者則可透過Qwen Cloud雲端服務接入使用。根據國際評測平台Arena.ai日前公布的最新文生圖榜單,Qwen-Image-3.0在整體表現上位列中國大陸所有模型中的第一名,顯示出阿里巴巴在生成式AI影像領域的技術實力已獲得國際評測機構的肯定。該模型在同級別的全球主流模型中,也具備相當突出的競爭位置,讓千問在影像生成這條賽道上站穩腳步。
這一代模型主打兩大核心能力,分別是超長文本理解與精細化渲染。在文字輸入方面,Qwen-Image-3.0最高可支援4.5k token的指令長度,這意味著使用者可以一口氣輸入包含大量細節的複雜描述,讓模型一次生成電影分鏡、考卷題目、九宮格知識圖卡等需要精確版面編排的內容。相較於前一代,這代的文本理解能力有顯著提升,對於需要大量指定元素的專業使用者來說,實用性大幅增加。在細節渲染部分,模型能夠還原10px大小的微小文字,即使是整頁LaTeX學術公式也能逐一精確重現,對於學術研究、教育訓練與技術文件的視覺化需求來說是一大突破。
除此之外,人像生成表現也相當細膩,皮膚質感與髮絲細節接近實拍效果,大幅降低AI生成影像常見的塑膠感,讓作品更貼近商業攝影的品質。除了文字與人像,Qwen-Image-3.0也具備古畫無縫修復的能力,這項功能對於文化資產數位化、藝術品修復模擬等應用場景具有高度價值。模型更內建超過100種藝術風格,涵蓋從寫實、插畫到特定美術流派的多樣化視覺語彙,使用者不需另外準備風格參考圖,就能直接指定想要的視覺調性。在語言支援方面,Qwen-Image-3.
0原生支援12國語言的文字渲染,無論是中文、英文、日文、韓文還是歐洲主要語言,都能直接生成該語言內建的文字元素,避免了過去模型在處理非英文文字時容易出現亂碼或字形錯誤的問題。此外,模型也內置世界知識與聯網檢索能力,能在生成圖像時引入對真實世界物件、場景與文化脈絡的理解,提高內容的正確性與豐富度。從商用角度來看,Qwen-Image-3.0已經開始嵌入多種商業工作流程,包括電商商品效果圖、影視前製分鏡腳本、廣告行銷海報設計,以及建築與室內設計的渲染圖生成。這些應用場景共同的特點在於對版面精確度、文字準確度與視覺品質的高度要求,而新一代模型恰好補足了過往AI繪圖工具在這些面向的不足。
定價策略方面,Qwen-Image-3.0在標準版Standard上,1K與2K解析度的文生圖價格均為0.18元人民幣一張,展現出極高的成本效益。旗艦版Pro則根據解析度區分收費,1K解析度每張0.25元人民幣,2K解析度每張0.5元人民幣。值得注意的是,圖像編輯功能的輸入價格低至0.02元人民幣一張,讓使用者可以更頻繁地進行細部修改與後製調整,整體而言拉高了商業級AI圖像生成的效能與性價比。此次模型的開放,不只是單純的技術更新,更代表了阿里巴巴在AI基礎模型商業化布局上的進一步深化。
透過開放API與雲端接入,不同規模的企業都能彈性採用這項技術,無論是新創團隊快速打造視覺內容產線,還是大型品牌整合進既有設計系統,都能在合理的成本範圍內獲得高品質的圖像生成能力。從長遠來看,Qwen-Image-3.0的技術突破與價格策略,將對AI繪圖市場產生一定的影響力。尤其在全球各大模型陸續強化多模態能力的當下,阿里巴巴選擇以文字理解深度、細節渲染精度與價格競爭力三管齊下的方式切入,顯示出千問團隊對於台灣及全球企業用戶實際需求的掌握。而模型的廣泛商用落地,也將持續推動AI圖像生成從實驗性工具,逐步轉變為內容產業不可或缺的基礎設施。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。