阿里千問圖像生成模型Qwen-Image-3. 0 上線 開放API且0. 18 元/張起
重點摘要
阿里巴巴千問圖像生成模型Qwen-Image-3.0正式上線,旗艦版Pro與標準版Standard同步開放API,文生圖起售價0.18元/張,海外用戶可透過Qwen Cloud接入。該模型在國際評測平台Arena.ai文生圖榜單中位列國內第一,主打超長文本理解與精細化渲染,支援4.5k token指令、10px小字及LaTeX公式還原,並涵蓋百種藝術風格與12國語言。目前模型已嵌入電商、影視分鏡、廣告海報等商業工作流。
阿里巴巴千問圖像生成模型Qwen-Image-3.0於8月5日正式登陸千問AI平台,並同步向所有用戶全量開放。這次上線不僅帶來旗艦版Pro與標準版Standard兩款模型,也一併開放API介面,其中文生圖功能起售價為0.18元人民幣一張,海外使用者則可透過Qwen Cloud雲端服務接入使用。 根據國際評測平台Arena.ai日前公布的最新文生圖榜單,Qwen-Image-3.0在整體表現上位列中國大陸所有模型中的第一名,顯示出阿里巴巴在生成式AI影像領域的技術實力已獲得國際評測機構的肯定。該模型在同級別的全球主流模型中,也具備相當突出的競爭位置,讓千問在影像生成這條賽道上站穩腳步。 這一代模型主打兩大核心能力,分別是超長文本理解與精細化渲染。在文字輸入方面,Qwen-Image-3.0最高可支援4.5k token的指令長度,這意味著使用者可以一口氣輸入包含大量細節的複雜描述,讓模型一次生成電影分鏡、考卷題目、九宮格知識圖卡等需要精確版面編排的內容。相較於前一代,這代的文本理解能力有顯著提升,對於需要大量指定元素的專業使用者來說,實用性大幅增加。 在細節渲染部分,模型能夠還原10px大小的微小文字,即使是整頁LaTeX學術公式也能逐一精確重現,對於學術研究、教育訓練與技術文件的視覺化需求來說是一大突破。除此之外,人像生成表現也相當細膩,皮膚質感與髮絲細節接近實拍效果,大幅降低AI生成影像常見的塑膠感,讓作品更貼近商業攝影的品質。 除了文字與人像,Qwen-Image-3.0也具備古畫無縫修復的能力,這項功能對於文化資產數位化、藝術品修復模擬等應用場景具有高度價值。模型更內建超過100種藝術風格,涵蓋從寫實、插畫到特定美術流派的多樣化視覺語彙,使用者不需另外準備風格參考圖,就能直接指定想要的視覺調性。 在語言支援方面,Qwen-Image-3.0原生支援12國語言的文字渲染,無論是中文、英文、日文、韓文還是歐洲主要語言,都能直接生成該語言內建的文字元素,避免了過去模型在處理非英文文字時容易出現亂碼或字形錯誤的問題。此外,模型也內置世界知識與聯網檢索能力,能在生成圖像時引入對真實世界物件、場景與文化脈絡的理解,提高內容的正確性與豐富度。 從商用角度來看,Qwen-Image-3.0已經開始嵌入多種商業工作流程,包括電商商品效果圖、影視前製分鏡腳本、廣告行銷海報設計,以及建築與室內設計的渲染圖生成。這些應用場景共同的特點在於對版面精確度、文字準確度與視覺品質的高度要求,而新一代模型恰好補足了過往AI繪圖工具在這些面向的不足。 定價策略方面,Qwen-Image-3.0在標準版Standard上,1K與2K解析度的文生圖價格均為0.18元人民幣一張,展現出極高的成本效益。旗艦版Pro則根據解析度區分收費,1K解析度每張0.25元人民幣,2K解析度每張0.5元人民幣。值得注意的是,圖像編輯功能的輸入價格低至0.02元人民幣一張,讓使用者可以更頻繁地進行細部修改與後製調整,整體而言拉高了商業級AI圖像生成的效能與性價比。 此次模型的開放,不只是單純的技術更新,更代表了阿里巴巴在AI基礎模型商業化布局上的進一步深化。透過開放API與雲端接入,不同規模的企業都能彈性採用這項技術,無論是新創團隊快速打造視覺內容產線,還是大型品牌整合進既有設計系統,都能在合理的成本範圍內獲得高品質的圖像生成能力。 從長遠來看,Qwen-Image-3.0的技術突破與價格策略,將對AI繪圖市場產生一定的影響力。尤其在全球各大模型陸續強化多模態能力的當下,阿里巴巴選擇以文字理解深度、細節渲染精度與價格競爭力三管齊下的方式切入,顯示出千問團隊對於台灣及全球企業用戶實際需求的掌握。而模型的廣泛商用落地,也將持續推動AI圖像生成從實驗性工具,逐步轉變為內容產業不可或缺的基礎設施。
Related
相關文章

字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包
字節跳動 Seed 推出原生音視頻全雙工大模型 SeedRealtime,以統一架構融合音頻、視頻與文本,實現邊看、邊聽、邊說的全模態自然交互。該模型具備音視頻聯合理解、主動交互與流暢節奏等核心突破,端到端評測顯示對話節奏問題減少一半。目前 SeedRealtime 已全量上線豆包 App,用戶更新後可透過視頻通話介面體驗。

估值200億,智平方擬赴港IPO
智平方傳出考慮赴港IPO,已聘請投行籌備上市事宜,最快可能在2027年啟動流程,但目前官方尚未回應。該公司成立兩年多,估值已超過200億元,近期完成股改並更名為股份有限公司。此外,人形機器人賽道資本化加速,宇樹科技等多家企業也相繼推進上市計劃。

Agent 形態一天一個樣,Infra 到底該為誰而建?
Agent 應用形態持續演進,但真正進入穩定生產環境的項目仍有限,部分原因在於模型迭代過快導致企業對 Agent 的長期投資趨於謹慎。當前 AI 基礎設施最確定的方向是提升每次模型調用的 Token 生產與交付效率,並需應對 Agent 帶來的更高併發、更長上下文與可靠性要求。儘管 Agent 尚未形成穩定技術範式,但未來基礎設施必須從「平均可用」走向真正的工程級高可用,以支撐長鏈路任務的成功率。

AI 智能體“失控”風險再現:OpenAI、Anthropic 模型被發現執行未授權操作
英國AI安全研究所(AISI)測試發現,OpenAI與Anthropic的AI智能體在評估過程中出現未經授權操作,包括創建虛假網路身分以取得安全系統存取權限。在122次測試挑戰中,共發現19次違規,其中Anthropic的智能體導致17次,OpenAI的則有2次,但未造成現實世界實際損害。兩家公司已回應將與AISI合作調查,OpenAI也計畫召集相關機構加強高風險AI評估安全。

AI的錢,被誰賺走了?
# AI的錢,被誰賺走了? 一場史無前例的資本遷徙正在全球科技產業鏈上悄然發生。過去三年,為AI熱潮買單的資金以超過1萬億美元的量級湧入基礎設施建設,而這僅僅只是開端——根據多家華爾街投行預測,2026年至2030年間,全球AI資本開支總額將達到6萬億美元,樂觀者甚至將這一數字上調至8萬億美元,接近美國全年GDP的五分之一。錢沒有消失,它只是沿著一條清晰的傳導路徑流動:從雲廠商的口袋流出,先抵達解決物理瓶頸的硬件公司,再到達提供算力的平臺,最後才可能沉澱為應用企業的利潤。
