開源國產8B模型,比肩閉源Image 2了!

2026年8月25日 14:55
開源國產8B模型,比肩閉源Image 2了!
站內 AI 整理稿

商湯科技近日正式對外開源旗下最新的國產生圖模型「SenseNova U1.5 Lite」,這款僅有 8B 參數的輕量級模型,主打直接生成 4K 解析度影像,並在輸出完整度、準確度與穩定性上都有明顯提升。不同於一般生圖模型需要仰賴外部工具進行放大或後製修圖,U1.5 Lite 能在單一階段就產出高解析度影像,讓整體生成流程更為簡潔,也大幅降低使用者的技術門檻。這款模型最受關注的特色之一,是對複雜指令與多圖輸入的處理能力。根據官方展示的案例,模型可以一次讀取九張食物照片,並依照文字要求將它們整合成一張精美的食譜卡片,顯示出對多物件、多圖層內容的掌握能力。此外,SenseNova U1.

5 Lite 也支援精準的局部圖像編輯,使用者可以指定圖中特定區域進行修改,而其他部位的結構與空間關係仍能完整保留,避免傳統編輯方式容易造成的邊界模糊或整體變形問題。在技術亮點方面,SenseNova U1.5 Lite 涵蓋超長指令遵循、高品質視覺生成、可靠的原生編輯,以及優異的中英文文字渲染與複雜版面編排能力。對於需要大量文字嵌入圖像的應用場景,例如海報設計、社群貼文或產品介紹圖,這款模型提供更穩定的文字拼寫與排版表現,讓生成結果更接近專業設計師的品質。商湯此次選擇開源釋出,也讓開發者與研究人員能直接基於模型進行二次開發或部署,進一步擴大國產生圖模型的應用範圍。

這項策略不僅有助於吸引更多社群貢獻者參與模型優化,也能加速各行業導入生成式 AI 的腳步。相較於許多閉源模型需要付費 API 或受限制的使用條款,開源版本讓中小企業與個人開發者能以更低成本探索高解析度影像生成的潛力。從市場定位來看,SenseNova U1.5 Lite 的 8B 參數量級屬於輕量級,卻能挑戰 4K 直接生成,這代表商湯在模型架構與訓練資料上做了特殊設計。一般來說,參數量越大的模型通常能處理更複雜的任務,但同時也意味著更高的運算成本與部署門檻。U1.

5 Lite 在 8B 參數下實現 4K 輸出,意味著它可以在相對有限的硬體資源上運行,讓更多使用者無需昂貴的 GPU 就能體驗高解析度生成。值得注意的是,這款模型強調「原生」編輯能力,而非依賴後製工具。傳統的生成式 AI 在編輯圖像時,經常需要先產出影像,再用 Photoshop 或類似軟體手動調整,或是透過外掛模型進行修補。U1.5 Lite 直接在生成階段內建編輯功能,使用者只需給出指令,模型就會自動理解並執行區域修改,同時保持圖像的整體一致性。這項能力對於需要快速迭代設計的創作者來說極具吸引力。在處理多圖輸入方面,SenseNova U1.5 Lite 展現出優異的場景理解能力。

官方展示的九張食物照片整合成食譜卡片,只是其中一個例子。實際上,這項功能可以延伸到電商商品圖、活動宣傳素材、教學圖表等各種需要將多張圖片統合成單一畫面的場景。模型能夠辨識每張圖片的內容,並依照文字指令安排它們的相對位置、大小、配色與文字標注,讓最終結果兼具美觀與資訊完整性。此外,中英文文字渲染的穩定性也是這款模型的亮點之一。許多生圖模型在生成含有文字的海報或社群圖時,經常出現拼寫錯誤、字體歪斜或文字與背景融合不佳的狀況。SenseNova U1.5 Lite 透過優化文字嵌入模組,在複雜的版面設計中仍能保持文字清晰可讀,且支援多種字型風格,讓設計師可以更放心地將文字直接交給模型處理。

商湯此次開源,也反映出中國 AI 產業在生成式模型領域的競爭日益激烈。過去一年,各家廠商紛紛推出開源模型,試圖透過社群力量加速迭代。SenseNova U1.5 Lite 以 8B 參數挑戰 4K 直接生成,不僅在技術上建立了差異化,也為開源生態提供了新的選擇。開發者可以基於這款模型開發專屬的圖像生成工具,例如自動化行銷素材生成器、教育互動教材、或是個人化影像編輯應用。對於一般使用者而言,SenseNova U1.5 Lite 的推出意味著生成式 AI 的門檻進一步降低。

過去想要生成高解析度圖片,往往需要依賴雲端服務或昂貴的硬體,現在只要搭配適當的推理環境,就可以在本地端或雲端快速產出 4K 影像。這種「開箱即用」的體驗,有助於推動生成式 AI 在更多領域落地,例如獨立設計師、小規模電商、自媒體創作者等。整體來看,商湯 SenseNova U1.5 Lite 是一款兼具輕量、高效與開源特性的國產生圖模型。它不僅在參數規模與輸出品質之間取得了平衡,更在複雜指令遵循、多圖整合、局部編輯與文字渲染等核心能力上展現出成熟度。隨著開源社群對這款模型的測試與反饋,未來有望進一步最佳化,甚至衍生出更多垂直領域的應用版本。

對於關注 AI 影像生成技術發展的讀者來說,這款模型無疑是近期值得深入研究的對象。

Related

相關文章

鈦媒體生成式AI

四位掌權者,四種命運:美國四大AI巨頭全景

更關鍵的是節奏。8 月 13 日,Google 又拋出了 Gemini 3.7 Flash,主打編碼場景與商業自動化,輸入價格低至每百萬 token 0.75 美元、輸出 3.75 美元——僅為前代的一半。這套模型已經入駐 Gemini Spark 訂閱服務、面向 Google AI Pro 與 Ultra 用戶開放,並行接入 Google AI Studio及新上線的 agentic 開發平臺 Antigravity。但皮查伊麵對的並非全是好消息。第一是旗艦模型的“跳票焦慮”。市場長期以 Gemini 3.

剛剛
IT之家生成式AI

澳大利亞唱片業協會“重拳出擊”,純 AI 生成歌曲禁入官方排行榜

作者:清源 責編:清源 評論: 8 月 25 日消息,據美聯社報道,隨著生成式 AI 快速發展並開始威脅音樂人的生計,當地時間 25 日(今天),澳大利亞唱片業協會(ARIA)決定禁止完全由 AI 生成的歌曲進入官方排行榜。新規出臺前,一首由澳大利亞製作人利用 AI 生成人聲和鼓點重新制作了麥當娜的名曲《Like a Prayer》,並連續 16 周躋身澳大利亞前 20 名,也讓生成式 AI 在音樂行業中的地位成為爭論焦點。

剛剛
量子位生成式AI

AI4S開始進入「項目時代」:紫東太初把AI從做Task推向做Project

中科紫東太初旗下科研智能體ScienceClaw推出AutoProject引擎,將AI在科研中的工作單位從單一任務推進至完整項目層級,具備項目規劃、長程執行與證據驗證能力。該系統透過Project2Task拆解任務、TaskExecutor自主迭代,以及EviGraph確保結論可溯與可信,讓研究人員只需提出目標即可啟動全流程探索,象徵AI4S進入項目級自主科研階段。

剛剛
鈦媒體生成式AI

對話張朝陽:AI狂奔,為什麼要做“反效率”內容

LCC_Beta版2026.08.25 13:44 · 來自北京全文2888字00:00 / 08:07在大模型算法追求極致效率的時代,保留一些“笨拙”的空間。搜狐創始人、董事局主席兼首席執行官張朝陽站在現在這個時間節點看,中國互聯網初代大佬中,張朝陽始終是極具個人辨識度的。

剛剛