原生支持 4K 圖像生成,商湯科技開源多模態模型 SenseNova U1.5-Lite-Preview 預覽版本

重點摘要
商湯科技宣佈開源輕量級多模態模型 SenseNova U1.5-Lite-Preview 預覽版本,原生支援 4K 圖像生成,並在多項生成與編輯評測上超越前代 U1。該模型以僅 8B-MoT 的規模,實現可比肩商用閉源模型的圖像生成與編輯效果。
商湯科技於8月3日宣布,正式面向開發者社群開源輕量級統一多模態模型的預覽版本——SenseNova U1.5-Lite-Preview。這款模型在影像生成與編輯能力上獲得全面強化,特別引人注目的是原生支援4K解析度圖像生成,並以僅8B參數規模的混合專家架構(MoT),實現了可與商用閉源模型媲美的生成品質。 根據官方揭露的技術資訊,SenseNova U1.5-Lite-Preview在多項主流生成與編輯品質評測基準上,表現均顯著超越前代U1模型。這項進步不僅來自於模型架構的優化,更得益於訓練資料與演算法的同步升級,使模型在細節還原、紋理表現與真實感呈現上達到新的高度。 在具體強化方向上,U1.5-Lite-Preview首先實現了原生4K解析度的圖像生成能力,意味著使用者無需透過額外後處理或超解析度演算法,即可直接輸出超高畫質的圖像內容。這對於需要高解析度素材的設計、廣告、影視等行業應用而言,將大幅提升創作效率與成品品質。 其次,模型在局部紋理與細節刻畫上表現更為精細,無論是皮膚質感、布料褶皺還是金屬反射,都能呈現出更貼近真實世界的視覺效果。此外,U1.5-Lite-Preview在中文與英文字元生成方面也取得顯著進展,不僅能準確書寫複雜字形,還可依照指令組織複雜版式,例如生成含有大量文字的海報、菜單或資訊圖表。 在圖像編輯與視覺指令遵循能力上,U1.5-Lite-Preview同樣展現出更高的穩定性。使用者可以透過自然語言指令,要求模型對已生成的圖像進行局部修改、顏色調整、物件替換等操作,模型能夠準確理解意圖並執行,減少多次迭代的需求。 值得一提的是,這款預覽版本僅以8B-MoT的輕量級規模運作,在參數量遠小於許多商用閉源模型的情況下,依然能維持高水準的生成與編輯效果。這意味著開發者與研究機構無需配備頂級運算資源,即可在一般硬體上部署並測試該模型,大幅降低多模態AI應用的入門門檻。 SenseNova U1.5-Lite-Preview的開源,也反映了商湯科技持續推動AI技術民主化的策略。透過將模型原始碼、權重與使用說明文件公開於GitHub、Hugging Face與魔搭(ModelScope)等主流開源平台,商湯科技希望吸引更多開發者參與測試、反饋與二次開發,進而加速多模態模型的迭代與應用落地。 目前,該預覽版本已可透過以下開源管道取得:GitHub上存放了完整的技術文件與使用指南;Hugging Face平台提供模型權重檔案,方便快速下載;魔搭社群則為中國大陸開發者提供更便捷的存取途徑。商湯科技也鼓勵社群成員提出改進建議,並預告後續將根據回饋推出正式版本。 隨著生成式AI持續滲透各行各業,多模態模型的能力已成為競爭焦點。商湯科技此次推出的SenseNova U1.5-Lite-Preview,不僅在解析度、細節與文字生成等關鍵指標上大幅躍進,更以開源形式打破商業壟斷,為開發者社群提供了一個功能強大且易於擴展的基礎模型。未來,該模型有望在智慧設計、自動化內容創作、虛擬實境等領域發揮關鍵作用,推動AI生成內容的品質與效率邁向新台階。
Related
相關文章

英特爾:為開源多模態視頻模型 MiniMax H3 提供 Day 0 支持,實現基於多卡 GPU 的部署方案
首頁 > 智能時代>人工智能 英特爾:為開源多模態視頻模型 MiniMax H3 提供 Day 0 支持,實現基於多卡 GPU 的部署方案 2026/8/3 15:25:14 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 3 日消息,英特爾今日宣佈,為新一代開源多模態視頻模型 MiniMax H3 提供 Day 0 首發支持。

當品牌開始爭奪AI的答案:翰智GEO入場
AI已取代搜尋引擎成為用戶獲取資訊的主要管道,品牌在AI問答中的形象變得更重要,GEO(生成式引擎優化)因而興起。央視「3·15」晚會揭露黑帽GEO亂象後,中國信通院發布行業標準,中央網信辦也啟動專項整治,合規與可信成為GEO入場門檻。企業級服務商翰智推出智慧版GEO業務,以可量化、可溯源、可驗收的工程化打法,搶進這條新賽道。

沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型
沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。

數億元!螞蟻AGI研究中心主任大模型創業,拿下新融資
杭州大模型公司西湖心辰宣布完成數億元人民幣B+輪融資,由廣發信德領投,螞蟻集團等老股東支持,資金將投入擴散語言模型研發、多模態實時互動產品迭代及海外市場拓展。該公司由現任螞蟻集團通用人工智能研究中心主任藍振忠創立,專注擴散範式大模型,並已在全球市場建立商業化閉環。

剛剛,阿里Qwen3.8-Max來了!衝進全球第一梯隊,模型表現直逼Claude
阿里巴巴突襲發表新一代基座大模型Qwen3.8-Max,總參數量達2.4兆,在編程、專業工作、長程任務與多模態分析等場景表現亮眼,於Arena榜單衝進全球第一梯隊,直逼Anthropic的Claude系列,部分程式能力甚至超過Claude Opus 5。官方並以低於國際大模型的價格策略(輸入每百萬Tokens人民幣12元等)吸引用戶,多位搶先體驗的網友也稱讚其性價比高、能自主完成從需求到交付的完整專案。

Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配
首頁 > 智能時代>人工智能 Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配 2026/8/3 13:19:15 來源:IT之家 作者:浩渺 責編:浩渺 評論: 感謝IT之家網友 華南吳彥祖 的線索投遞! IT之家 8 月 3 日消息,今日,MiniMax 正式開源多模態生成模型 MiniMax H3。