原生支持 4K 圖像輸出,商湯開源 8B 參數量多模態大模型 SenseNova U1.5 Lite

作者:沁滄(實習) 責編:沁滄 評論: 8 月 21 日消息,商湯科技今日宣佈開源輕量級、原生統一多模態大模型 SenseNova U1.5 Lite。據介紹,SenseNova U1.5 Lite 原生支持 3-4k 上下文長度,能夠同時處理主體、數量、空間關係、文字、佈局、風格等多重約束,提升複雜視覺任務的執行穩定性。此外,SenseNova U1.5 Lite 還有以下特點:更高質量的視覺生成:改善整體構圖、色彩、材質、光影、真實感和局部細節,減少“局部正確但整體完成度不足”的情況。
更可靠的原生圖像編輯:增強主體身份、空間結構、版式關係和非編輯區域的保持,同時提升局部修改、元素替換、文字精修和多參考圖編輯能力。更好的文字與複雜佈局:加強中英文文字、海報、信息圖、品牌視覺及多文本排版能力,從“生成內容”進一步走向“組織完整視覺表達”。更精細的視覺控制:支持 Bounding Box、Visual Marker 以及單圖、多圖參考等方式,對指定區域和對象進行更準確的編輯。原生 4K 高分辨率輸出:在高分辨率生成中兼顧整體構圖與極精細的肌理、微小文字與光影折射。官方表示,作為 8B 參數的輕量化模型,SenseNova U1.
5 Lite 在指令遵循與圖像編輯保持度上超越了同量級模型,並在文字渲染與複雜佈局上達到了媲美超大規模商業模型的交付水平。附開源鏈接:GitHub:https://github.com/OpenSenseNova/SenseNova-U1Hugging Face:https://huggingface.co/collections/sensenova/sensenova-u15魔搭社區:https://modelscope.cn/models/SenseNova/SenseNova-U1.
5-8B-MoT廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:商湯,開源,多模態,模型,SenseNova螞蟻百靈開源 Ling-3.0 tiny / flash Base 模型,開放訓練過程中的關鍵節點Opus 4.8 級性能:Ornith-1.
5 系列開源 AI 模型發佈,量化版可在 iPhone 17 等手機上運行小米新一代人形機器人與觀眾實時互動視頻發佈:由大模型驅動,自主理解、判斷並完成動作百度 2026 Q2 業績會實錄:文心將重回 AI 第一梯隊,年底前完成香港主要上市哈佛大學和麻省理工造出 83 億個“AI 人”,模擬全球人類行為字節跳動與美國電影協會簽署協議,加強 AI 模型版權保護
Related
相關文章

王興興“錯配”梁文鋒?
王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。