商湯開源SenseNova U1.5-Lite-Preview:8B模型支持原生4K圖像生成
重點摘要
AI資訊AI新閒資訊正文商湯開源SenseNova U1.5-Lite-Preview:8B模型支持原生4K圖像生成發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘商湯科技宣佈開源輕量級統一多模態模型預覽版 SenseNova U1.5-Lite-Preview。
商湯科技近日宣布開源輕量級統一多模態模型預覽版 SenseNova U1.5-Lite-Preview,這款模型在僅 8B MoT 參數規模的條件下,實現了原生 4K 圖像生成能力,並在紋理表現、中英文文字生成以及圖像編輯穩定度上帶來顯著提升。作為 SenseNova U1 的系統性迭代版本,U1.5-Lite-Preview 採用 NEO-unify 架構,主打高效率與高品質的視覺生成,為開發者與研究人員提供一個更容易部署的多模態 AI 基座。 SenseNova U1.5-Lite-Preview 最大的亮點在於支援原生 4K 解析度的圖像生成,這意味著模型可以直接輸出高達 4K 畫質的圖片,無需後續放大或修補,大幅提升生成作品的細節與可用性。同時,模型在文字渲染方面也進行了深度優化,無論是中文還是英文,都能生成更精準、更清晰的字形,避免常見的模糊或錯字問題。 在圖像編輯能力上,新模型支援參考圖風格遷移、多參考圖組合編輯以及交互式精準調整。這使得 AI 圖像創作從過去的一次性生成,轉變為可持續迭代優化的流程。使用者可以根據需求逐步調整風格、構圖或細節,並透過長篇自然語言描述或結構化視覺指令,讓模型精準理解複雜的創作意圖。商湯表示,這項特性大幅提升了模型對視覺控制指令的掌握度,讓 AI 不再只是被動生成,而是能與創作者進行更深入的協作。 根據商湯公布的評測結果,SenseNova U1.5-Lite-Preview 在多項基準測試中均優於前一代模型,展現出更強的理解能力與生成品質。值得注意的是,這款模型僅使用 8B MoT 參數規模,卻能在生成質量與交互能力之間取得平衡,進一步降低多模態 AI 技術的應用門檻。對於開發者來說,這意味著不需要極高端的運算資源,就能在本地或邊緣設備上運行具備高品質圖像生成與編輯能力的模型。 目前 SenseNova U1.5-Lite-Preview 已正式在 GitHub、Hugging Face 以及魔搭社區開放下載,開發者與研究人員可以基於該模型進行二次開發,例如整合至自有應用、訓練特定領域的微調版本,或作為視覺語言模型的基礎元件。商湯此舉延續了其開放原始碼的策略,讓更多團隊能夠接觸到先進的多模態技術。 除了輕量級預覽版,商湯也透露面向專業創作者與企業用戶的交付級創作模型 SenseNova U1Pro 正處於緊密邀測階段。這款模型預計將提供更強大的生成能力與企業級穩定性,滿足商業場景下的高標準需求。從 U1.5-Lite-Preview 到 U1Pro,商湯正逐步建構從開發者社群到專業應用的完整產品線。 業界分析指出,當前多模態模型的競爭焦點已經從單純的參數規模競賽,轉向效率、控制能力與實際應用體驗。商湯此次開源輕量化模型,正是呼應了這股趨勢,透過降低使用門檻並開放核心技術,吸引更多開發者加入生態系,同時也為後續的商業化產品鋪路。隨著生成式 AI 持續滲透至設計、廣告、影視、遊戲等領域,像 SenseNova U1.5-Lite-Preview 這樣兼具高畫質與靈活編輯能力的模型,將有機會成為創作流程中的重要工具。 商湯在視覺 AI 領域的布局不只於此。近期該公司也陸續開源了 SenseNova-Vision-7B-MoT 等多任務視覺模型,以及統一視覺大模型 SenseNova-Vision,這些模型在目標檢測、OCR、深度估計、圖像分割等任務上展現出單一架構橫掃多領域的實力。整體來看,商湯正積極透過開源策略,推動視覺與多模態 AI 技術的標準化與普及化。 對於開發者而言,SenseNova U1.5-Lite-Preview 的出現提供了一個實驗與創新的絕佳平台。無論是想要打造文字生成圖像的應用,還是需要精準圖像編輯功能,都能在該模型上快速驗證。隨著開源社群的反饋與貢獻,這款模型也有望持續進化,進一步拉近 AI 與真實創作需求之間的距離。 商湯表示,未來將持續投入多模態技術的研發,並希望透過開放合作,讓更多行業從 AI 創新中受益。SenseNova U1.5-Lite-Preview 的開源,不僅是技術上的里程碑,更象徵著多模態 AI 正從實驗室走向廣大開發者與創作者手中,開啟更為多元的應用可能性。
Related
相關文章

這個新生圖模型有點夯:4K直出的,國產的,開源的!
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 這個新生圖模型有點夯:4K直出的,國產的,開源的! 十三 2026-08-03 19:59:32 來源:量子位 商湯預覽了SenseNova U1.5 Lite 金磊 發自 凹非寺 量子位 | 公眾號 QbitAI 剛剛,新出的一個生圖模型,著實是有點東西在身上的: 國產的,4K直出的,開源的,輕量的,還是可以指哪兒改哪兒的。 例如下面這張信息密度超高的圖片,就是它做出來的: 我們從結果可以看到,即便是把圖片放大了來看 ,不論是文字、圖片元素,都是細節拉滿的狀態。 再如這組充滿藝術感的視覺大片,這個AI也是不在話下: 那這是何許AI是也? 它,便是商湯剛剛面向社區開源的SenseNova U1.5-Lite-Preview。 這是一個輕量級原生統一多模態模型的早期預覽版本。它延續了商湯自研的NEO-Unify架構,把語言、視覺語義和像素生成放進同一套模型裡,覆蓋視覺理解、推理、生成與編輯。 不過有一說一,原生4K直出,還僅僅是它的亮點之一。 在僅有8B-MoT參數的輕量身形之下,U1.5-Lite-Preview做到了: 複雜Prompt能接住:支持長篇、多約束、層次化和結構化視覺指令; 文字和版式更能打:面向海報、信息圖、品牌視覺等高信息密度內容; 生成後還能繼續改:支持參考圖、多圖組合、局部文字編輯,以及紅框、座標和marker精準編輯。 畢竟在真實創作中,“會畫圖”只是第一步,真正決定它能不能進入創作流程的,還得看複雜任務和編輯能力。 那U1.5-Lite-Preview這個8B-MoT小模型創作起來有多方便?我們繼續往下看~ 能Hold住復

對話博登智能趙捷:十億訂單在手,具身智能最缺的仍是高質量數據
對話博登智能趙捷:十億訂單在手,具身智能最缺的仍是高質量數據TechPulse2026.08.03 19:48 · 來自河北全文5467字00:00 / 17:40機器人真正的進步,有時就藏在一次失敗之後:它有沒有記住,人類當時是怎樣把錯誤糾正過來的。具身智能的數據生意正在迅速升溫。斯坦福大學《2026 AI Index Report》顯示,機器人在仿真操作基準中的任務成功率已達到89.

在K3爆火之際,來聊聊Kimi的商業化前景
月之暗面推出的Kimi K3模型因開源且性能強勁而爆紅,上線後迅速登頂Hugging Face趨勢榜,並引發資本市場震盪。其商業化進展迅速,年度經常性收入(ARR)已突破3億美元,API收入佔比超過七成,海外付費用戶增長顯著,並藉助與亞馬遜雲科技等雲平台的合作拓展全球市場。

AI科研範式革命:花200美元即可攻克一道數學世紀難題
AI科研範式革命:花200美元即可攻克一道數學世紀難題硅谷Tech news2026.08.03 19:13 · 來自北京全文5638字00:00 / 14:37科研的邊際成本從百萬美元級降至百元級,重新定義成本結構往往意味著產業變革的開始。

怎麼看待AI大回調,大摩120頁研報深度解讀
怎麼看待AI大回調,大摩120頁研報深度解讀AlphaEngineer2026.08.03 18:40 · 來自北京全文3170字00:00 / 08:53摩根士丹利解讀AI板塊回調:屬技術性回調,看好AI基建。作者 | 費斌傑 北京市青聯委員 熵簡科技CEO6月下旬以來,全球AI板塊經歷了一輪顯著回調。這到底是短暫的技術性回調,還是週期見頂的信號,這是一個價值千金的問題。

深度:外賓 Genspark
Genspark 雖在公開信支持開放權重模型,但其真實立場更接近閉源實驗室,商業策略上則希望藉開放模型降低成本。該公司創辦人刻意淡化曾在百度任職的背景,並在矽谷華人社群活動中保持距離,反而積極贊助國際商業會議,塑造純正美國 AI 公司的形象。