騰訊最新生圖模型來了!2K圖0.15元一張,元寶、WorkBuddy限時免費
作者 | 江宇 編輯 | 李水青 9月22日報道,今日,騰訊混元正式發佈新一代圖像生成模型Hy Image3.5 preview,支持文生圖、圖生圖和多輪對話創作,最高可輸出2K分辨率圖像。距離今年1月混元Hy Image 3.0圖生圖版本開源過去近8個月,騰訊再次升級圖像生成能力,也在多模態方向繼續加快更新。在由內部數百名專業設計師參與的GSB盲測中,Hy Image3.5 preview相比Hy Image3.0的綜合表現提升30%,與字節Seedream 5.0 Pro表現相當,並略高於Nano-Banana Pro和Qwen-Image-3.0 Pro。
目前,該模型已經接入騰訊元寶、AI知識管家ima、專業影視智能平臺WorkRally、專業劇集及遊戲內容製作工具OnSolo、創意智能體Miora、辦公智能體工作臺WorkBuddy等多款原生AI應用。其中,用戶可以在元寶免費體驗人像編輯、智能P圖等功能,Miora、WorkRally和OnSolo則將開啟為期兩週的免費體驗。面向企業和開發者,Hy Image3.5 preview也已上線騰訊雲TokenHub,2K圖像API價格為0.15元/張,僅對最終輸出圖片收費。基於各家官方公開定價整理的對比,在13款主流生圖模型中,Hy Image3.
5 preview的單張2K圖片生成成本最低;作為對比,GPT Image 2.5 low約為0.162元/張,Qwen-Image-3.0約為0.2元/張。體驗地址: 混元官網:https://aistudio.tencent.com/ 騰訊雲TokenHub:https://console.cloud.tencent.com/tokenhub/models/detail?modelId=hy-image-v3.5-preview 一、最多參考5張圖,支持連續對話改圖 相比此前的Hy Image3.0,Hy Image3.
5 preview重點提升了語言與視覺理解,以及文本渲染與佈局、真實感、風格表現和編輯一致性等能力。具體來看,模型同時支持文生圖和圖生圖,單次最多可上傳5張圖片作為參考。它還支持基於歷史上下文進行多輪創作。例如,用戶生成一張圖片後,可以繼續通過自然語言修改其中的人物、背景、構圖或者其他細節,而無需每次重新描述完整需求。輸出方面,Hy Image3.5 preview支持多種圖片比例,最高分辨率達到2K。其應用場景主要劃分為兩類。
一類是日常修圖、人像美化、知識卡片等普通用戶場景; ▲換裝試穿 ▲局部風格化 另一類則面向商業海報、劇集分鏡、影視物料、UI設計、創意插畫、品牌視覺和電商物料等專業創作需求。▲影視場景 ▲電商場景 ▲海報設計場景 二、元寶已灰度測試兩個月,生圖請求量增超50% 實際上,在正式公佈前,Hy Image3.5 preview已經提前約兩個月在騰訊元寶中逐步灰度上線。據騰訊披露,灰度測試期間,元寶端內生圖整體請求量提升超過50%。目前,這款模型已經進入騰訊旗下多款AI產品。
普通用戶可以通過元寶體驗人像編輯、智能P圖、旅遊規劃圖和知識信息圖等能力; ima則可以結合Copilot,將知識庫內容轉化為網頁、PPT和圖片。面向影視和專業視覺創作的Miora、WorkRally、OnSolo也已接入新模型,並將提供兩週限時免費體驗。此外,Hy Image3.5 preview還接入了騰訊雲媒體處理MPS、雲點播VOD等服務。三、混元基礎模型團隊整合,多模態人才持續補強 今年以來,騰訊對混元模型團隊也進行了多輪調整。7月23日,騰訊將混元大語言模型部門與多模態模型部門合併,組建基礎模型部,由騰訊首席AI科學家姚順雨統一負責。
在此之前,前OpenAI研究員田永龍(Yonglong Tian)已於7月加入騰訊大語言模型部,後續參與VLM(視覺語言模型)相關研發。田永龍長期從事視覺表徵學習、對比學習等研究,也曾參與GPT-5研發。今年年初,騰訊還引入了前Sea AI Lab研究員龐天宇,擔任混元多模態強化學習首席研究員及技術負責人。此前,騰訊在多模態生成方向還引入了原阿里通義實驗室應用視覺團隊負責人薄列峰、微軟亞洲研究院原首席研究員胡瀚等研究人員。從此次Hy Image3.5 preview來看,騰訊正在將混元圖像模型更深地嵌入元寶、辦公、影視製作和雲服務等內部產品中,通過實際業務反饋繼續迭代模型。
結語:生圖能力之外,產品入口也在變重要 從元寶裡的日常P圖,到影視、電商和商業設計,騰訊把Hy Image3.5 preview同步鋪進了旗下多款AI產品。在生圖模型能力差距不斷縮小的情況下,除了模型本身的生成效果,調用價格、產品入口以及能否進入真實創作流程,也正在成為廠商競爭的另一層重點。
Related
相關文章

DeepSeek新論文公開Agent訓練!梁文鋒署名
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> DeepSeek新論文公開Agent訓練!梁文鋒署名 克雷西 2026-09-23 15:29:50 來源:量子位 每秒能產生5000+個沙盒 克雷西 發自 凹非寺 量子位 | 公眾號QbitAI 大模型訓練拼的是算力,Agent訓練拼的是環境。 環境怎麼造?梁文鋒署名的DeepSeek最新論文,把技術細節公開了。 DeepSeek做的這個系統叫DSec(DeepSeek Elastic Compute),乾的事情就是給Agent訓練批量製造沙盒。 它每秒能產生5000+個沙盒,一天能達到300萬個,峰值同時運行38萬個。 支撐這個規模的單集群也非常龐大,大約有160個節點、3萬核CPU和250TB內存。 為啥訓個Agent會這麼費勁? 因為大模型訓練的環境就是GPU集群,喂數據算梯度,但Agent完全不同。 它得在沙盒裡寫代碼、跑編譯、開瀏覽器,甚至裝操作系統……每執行一步都改變環境狀態,隨時可能把環境搞崩。 所以每輪訓練都得給它一個全新的、乾淨的沙盒,而且隨用隨拋、訓完就扔。 所以,問題兜兜轉轉,還是回到了基礎設施—— 這些基礎設施需要在每秒5000個的速度下,給每個沙盒裝好一整套操作系統和工具鏈。 同時,還不能讓幾十萬個併發沙盒把集群的內存和CPU擠爆。 具體怎麼辦,論文把這整套工程的全貌攤開了。 Agent訓練需要「一個世界」 DSec要解決的第一個核心問題是,不同類型的Agent任務對沙盒環境的要求差異極大,而且這些環境必須在同一個平臺上統一調度。 一個刷OJ題的Agent,只需要一個無狀態的函數調用環境,跑完拿到輸出就行,連文件系統都不

Qwen一號位定了!劉大一恆接棒
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> Qwen一號位定了!劉大一恆接棒 鷺羽 2026-09-23 15:27:49 來源:量子位 與稚暉君同屆天才少年 鷺羽 發自 凹非寺 量子位 | 公眾號QbitAI 定了!林俊暘離職半年,新任千問負責人終於就位—— 前華為天才少年劉大一恆。 阿里雲棲大會已經在官網嘉賓一欄中,將他掛在了C位。 緊隨蔡崇信、吳泳銘之後,title是: 阿里巴巴ATH事業群Token Foundry Qwen LLM項目負責人。 開幕式上,他也剛剛在吳泳銘主旨演講之後,帶來15分鐘的主題演講,標題是「Qwen:邁向真實世界智能體」。 重視程度不言而喻。。。 so為什麼是他? 這位新帥的來頭,可能比外界預想的更有料。 前華為天才少年接棒 劉大一恆,四川自貢人,本碩博均就讀於四川大學計算機學院。 師從呂建成教授,研究方向集中在自然語言生成與理解。 曾在ACL、ICML、NeurIPS、EMNLP、AAAI等頂會及其它期刊發表論文共計百餘篇,谷歌學術引用超六萬次,並以通訊作者身份獲得了NeurIPS 2025最佳論文獎。 另一位通訊作者正是前任負責人林俊暘。 劉大一恆同時也是Qwen初期核心成員。 2021年加入達摩院後,負責Qwen項目最早期的預訓練工作。 隨後幾年更是高產不斷: 主導開發Qwen1至Qwen3.5系列語言模型及Qwen-Math系列,核心參與Qwen-Coder、VL、Omni等模型開發,累計參與300多款Qwen模型開源。 換句話說,Qwen從早期研發到持續迭代,整個發展過程他其實一直都在。 只不過這一次,他終於正式走向臺前。 事實上,真正讓劉大一恆首

阿里千問發佈 Qwen-Audio-3.1 系列語音大模型,並下調全線產品價格
作者:遠洋 責編:遠洋 評論: 感謝網友 Domado、衝吧lzl 的線索投遞!9 月 23 日消息,今天,千問正式發佈 Qwen-Audio-3.1 系列語音大模型。本次升級不僅對語音識別、語音合成和實時語音交互三大核心模型進行了全面進化,更重磅推出了全新的音頻創作模型 Qwen-Audio-3.

Jev vs Decitron:同為決策AI,為什麼不是一回事?
它來自TypeSafe AI。這支有OpenAI背景的團隊沒有繼續卷生成和推理,而是換了個方向:讓AI直接做判斷。他們甚至把口號直接寫成:Decisions, not strings(要決策,不要文本)。Jev的走紅,也讓“Decision”(決策)重新成為AI圈的熱門詞。

高通發佈驍龍 8 Elite Gen 6 與 Extreme 芯片,支持本地運行 300 億參數大模型
這兩款新芯片將 AI 賦能作為核心發力點,旨在為移動終端提供更強大的端側智能算力,進一步推動 AI 代理(AI Agents)在手機端的深度個性化應用。在核心架構與本地大模型支持方面,這兩款芯片配備了全新的傳感中樞(sensing hub),能夠支持運行高達2.

實時世界模型進入“全科生”階段,PixVerse R2先交卷!
愛詩科技推出全新實時世界模型PixVerse R2,號稱解決了實時生成與通用能力難以兼顧的業界難題。R2基於統一可擴展框架,整合文字、圖像、聲音與動作,實現場景持續演化與音畫同步控制,上線後即登上X平台熱度榜。