騰訊最新生圖模型來了!2K圖0.15元一張,元寶、WorkBuddy限時免費

2026年9月22日 05:43
站內 AI 整理稿

作者 | 江宇 編輯 | 李水青 9月22日報道,今日,騰訊混元正式發佈新一代圖像生成模型Hy Image3.5 preview,支持文生圖、圖生圖和多輪對話創作,最高可輸出2K分辨率圖像。距離今年1月混元Hy Image 3.0圖生圖版本開源過去近8個月,騰訊再次升級圖像生成能力,也在多模態方向繼續加快更新。在由內部數百名專業設計師參與的GSB盲測中,Hy Image3.5 preview相比Hy Image3.0的綜合表現提升30%,與字節Seedream 5.0 Pro表現相當,並略高於Nano-Banana Pro和Qwen-Image-3.0 Pro。

目前,該模型已經接入騰訊元寶、AI知識管家ima、專業影視智能平臺WorkRally、專業劇集及遊戲內容製作工具OnSolo、創意智能體Miora、辦公智能體工作臺WorkBuddy等多款原生AI應用。其中,用戶可以在元寶免費體驗人像編輯、智能P圖等功能,Miora、WorkRally和OnSolo則將開啟為期兩週的免費體驗。面向企業和開發者,Hy Image3.5 preview也已上線騰訊雲TokenHub,2K圖像API價格為0.15元/張,僅對最終輸出圖片收費。基於各家官方公開定價整理的對比,在13款主流生圖模型中,Hy Image3.

5 preview的單張2K圖片生成成本最低;作為對比,GPT Image 2.5 low約為0.162元/張,Qwen-Image-3.0約為0.2元/張。體驗地址: 混元官網:https://aistudio.tencent.com/ 騰訊雲TokenHub:https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy-image-v3.5-preview 一、最多參考5張圖,支持連續對話改圖 相比此前的Hy Image3.0,Hy Image3.

5 preview重點提升了語言與視覺理解,以及文本渲染與佈局、真實感、風格表現和編輯一致性等能力。具體來看,模型同時支持文生圖和圖生圖,單次最多可上傳5張圖片作為參考。它還支持基於歷史上下文進行多輪創作。例如,用戶生成一張圖片後,可以繼續通過自然語言修改其中的人物、背景、構圖或者其他細節,而無需每次重新描述完整需求。輸出方面,Hy Image3.5 preview支持多種圖片比例,最高分辨率達到2K。其應用場景主要劃分為兩類。

一類是日常修圖、人像美化、知識卡片等普通用戶場景; ▲換裝試穿 ▲局部風格化 另一類則面向商業海報、劇集分鏡、影視物料、UI設計、創意插畫、品牌視覺和電商物料等專業創作需求。▲影視場景 ▲電商場景 ▲海報設計場景 二、元寶已灰度測試兩個月,生圖請求量增超50% 實際上,在正式公佈前,Hy Image3.5 preview已經提前約兩個月在騰訊元寶中逐步灰度上線。據騰訊披露,灰度測試期間,元寶端內生圖整體請求量提升超過50%。目前,這款模型已經進入騰訊旗下多款AI產品。

普通用戶可以通過元寶體驗人像編輯、智能P圖、旅遊規劃圖和知識信息圖等能力; ima則可以結合Copilot,將知識庫內容轉化為網頁、PPT和圖片。面向影視和專業視覺創作的Miora、WorkRally、OnSolo也已接入新模型,並將提供兩週限時免費體驗。此外,Hy Image3.5 preview還接入了騰訊雲媒體處理MPS、雲點播VOD等服務。三、混元基礎模型團隊整合,多模態人才持續補強 今年以來,騰訊對混元模型團隊也進行了多輪調整。7月23日,騰訊將混元大語言模型部門與多模態模型部門合併,組建基礎模型部,由騰訊首席AI科學家姚順雨統一負責。

在此之前,前OpenAI研究員田永龍(Yonglong Tian)已於7月加入騰訊大語言模型部,後續參與VLM(視覺語言模型)相關研發。田永龍長期從事視覺表徵學習、對比學習等研究,也曾參與GPT-5研發。今年年初,騰訊還引入了前Sea AI Lab研究員龐天宇,擔任混元多模態強化學習首席研究員及技術負責人。此前,騰訊在多模態生成方向還引入了原阿里通義實驗室應用視覺團隊負責人薄列峰、微軟亞洲研究院原首席研究員胡瀚等研究人員。從此次Hy Image3.5 preview來看,騰訊正在將混元圖像模型更深地嵌入元寶、辦公、影視製作和雲服務等內部產品中,通過實際業務反饋繼續迭代模型。

結語:生圖能力之外,產品入口也在變重要 從元寶裡的日常P圖,到影視、電商和商業設計,騰訊把Hy Image3.5 preview同步鋪進了旗下多款AI產品。在生圖模型能力差距不斷縮小的情況下,除了模型本身的生成效果,調用價格、產品入口以及能否進入真實創作流程,也正在成為廠商競爭的另一層重點。

Related

相關文章

量子位生成式AI

Jev vs Decitron:同為決策AI,為什麼不是一回事?

它來自TypeSafe AI。這支有OpenAI背景的團隊沒有繼續卷生成和推理,而是換了個方向:讓AI直接做判斷。他們甚至把口號直接寫成:Decisions, not strings(要決策,不要文本)。Jev的走紅,也讓“Decision”(決策)重新成為AI圈的熱門詞。

剛剛

Win11 驚現 AI 惡意軟件 ClosedQuorum:入侵後自主決策,專挖最有價值信息

該惡意軟件主要針對 Windows 11 平臺,會在成功入侵用戶電腦後調用谷歌 Gemini、DeepSeek、Qwen 和 Mistral 等 AI 模型自主決策,專門挖掘攻擊目標最有價值的信息。調用 Gemini、DeepSeek 等模型,入侵後自主決策Talos 深入分析後發現,ClosedQuorum 在成功入侵目標設備後,會藉助多個 AI 模型來決策攻擊方案,包括竊取瀏覽器登錄憑證、提取加密貨幣信息、持久化執行惡意軟件,以及向其他設備橫向散播惡意軟件。

剛剛
量子位生成式AI

阿里千問AI平臺全面升級模型服務、Agent服務、AI應用

阿里巴巴宣布千問AI平台全面升級,以推動Agent進入生產為核心,新增Agent服務與行業AI解決方案,並推出API優速模式、Agent Studio、千問AI座艙等能力。平台強調從消耗Token轉向交付結果,並預計至2032年算力規模將超過20GW,以支撐完整AI體系。Agent Studio提供企業級全棧服務,支援模型路由、託管運行與生態工具接入,同時強化模型服務的效能與成本優化。

剛剛
量子位生成式AI

GPT-6 Astra搓3D刷屏後,3D生成的競爭規則變了

GPT-6 Astra的出現讓3D生成行業競爭標準從「Production-Ready」轉向「Agent-Ready」,強調生成能力需能被AI Agent理解和調用。影眸Hyper3D推出Agentic Mode,能自主分析雜亂輸入、規劃建模路徑,並支援後續參數化調整、材質替換與動畫預設,同時開放MCP接口讓外部Agent串接3D生成流程。

剛剛