商湯開源SenseNova U1.5-Lite-Preview:8B模型支持原生4K圖像生成
重點摘要
AI資訊AI新閒資訊正文商湯開源SenseNova U1.5-Lite-Preview:8B模型支持原生4K圖像生成發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘商湯科技宣佈開源輕量級統一多模態模型預覽版 SenseNova U1.5-Lite-Preview。
商湯科技近日宣布開源輕量級統一多模態模型預覽版 SenseNova U1.5-Lite-Preview,這款模型在僅 8B MoT 參數規模的條件下,實現了原生 4K 圖像生成能力,並在紋理表現、中英文文字生成以及圖像編輯穩定度上帶來顯著提升。作為 SenseNova U1 的系統性迭代版本,U1.5-Lite-Preview 採用 NEO-unify 架構,主打高效率與高品質的視覺生成,為開發者與研究人員提供一個更容易部署的多模態 AI 基座。SenseNova U1.
5-Lite-Preview 最大的亮點在於支援原生 4K 解析度的圖像生成,這意味著模型可以直接輸出高達 4K 畫質的圖片,無需後續放大或修補,大幅提升生成作品的細節與可用性。同時,模型在文字渲染方面也進行了深度優化,無論是中文還是英文,都能生成更精準、更清晰的字形,避免常見的模糊或錯字問題。在圖像編輯能力上,新模型支援參考圖風格遷移、多參考圖組合編輯以及交互式精準調整。這使得 AI 圖像創作從過去的一次性生成,轉變為可持續迭代優化的流程。使用者可以根據需求逐步調整風格、構圖或細節,並透過長篇自然語言描述或結構化視覺指令,讓模型精準理解複雜的創作意圖。
商湯表示,這項特性大幅提升了模型對視覺控制指令的掌握度,讓 AI 不再只是被動生成,而是能與創作者進行更深入的協作。根據商湯公布的評測結果,SenseNova U1.5-Lite-Preview 在多項基準測試中均優於前一代模型,展現出更強的理解能力與生成品質。值得注意的是,這款模型僅使用 8B MoT 參數規模,卻能在生成質量與交互能力之間取得平衡,進一步降低多模態 AI 技術的應用門檻。對於開發者來說,這意味著不需要極高端的運算資源,就能在本地或邊緣設備上運行具備高品質圖像生成與編輯能力的模型。目前 SenseNova U1.
5-Lite-Preview 已正式在 GitHub、Hugging Face 以及魔搭社區開放下載,開發者與研究人員可以基於該模型進行二次開發,例如整合至自有應用、訓練特定領域的微調版本,或作為視覺語言模型的基礎元件。商湯此舉延續了其開放原始碼的策略,讓更多團隊能夠接觸到先進的多模態技術。除了輕量級預覽版,商湯也透露面向專業創作者與企業用戶的交付級創作模型 SenseNova U1Pro 正處於緊密邀測階段。這款模型預計將提供更強大的生成能力與企業級穩定性,滿足商業場景下的高標準需求。從 U1.5-Lite-Preview 到 U1Pro,商湯正逐步建構從開發者社群到專業應用的完整產品線。
業界分析指出,當前多模態模型的競爭焦點已經從單純的參數規模競賽,轉向效率、控制能力與實際應用體驗。商湯此次開源輕量化模型,正是呼應了這股趨勢,透過降低使用門檻並開放核心技術,吸引更多開發者加入生態系,同時也為後續的商業化產品鋪路。隨著生成式 AI 持續滲透至設計、廣告、影視、遊戲等領域,像 SenseNova U1.5-Lite-Preview 這樣兼具高畫質與靈活編輯能力的模型,將有機會成為創作流程中的重要工具。商湯在視覺 AI 領域的布局不只於此。
近期該公司也陸續開源了 SenseNova-Vision-7B-MoT 等多任務視覺模型,以及統一視覺大模型 SenseNova-Vision,這些模型在目標檢測、OCR、深度估計、圖像分割等任務上展現出單一架構橫掃多領域的實力。整體來看,商湯正積極透過開源策略,推動視覺與多模態 AI 技術的標準化與普及化。對於開發者而言,SenseNova U1.5-Lite-Preview 的出現提供了一個實驗與創新的絕佳平台。無論是想要打造文字生成圖像的應用,還是需要精準圖像編輯功能,都能在該模型上快速驗證。隨著開源社群的反饋與貢獻,這款模型也有望持續進化,進一步拉近 AI 與真實創作需求之間的距離。
商湯表示,未來將持續投入多模態技術的研發,並希望透過開放合作,讓更多行業從 AI 創新中受益。SenseNova U1.5-Lite-Preview 的開源,不僅是技術上的里程碑,更象徵著多模態 AI 正從實驗室走向廣大開發者與創作者手中,開啟更為多元的應用可能性。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。