公眾號插圖、秋招物料、潮玩設計,實測商湯SenseNova U1 Pro:生圖模型走向真實任務交付

2026年9月21日 12:30
站內 AI 整理稿

作者 | 畢偉豪 編輯|漠影 時常會有人感慨,各種生圖模型讓人眼花繚亂,但一到真正交稿時,還是免不了反覆“抽卡”。好不容易挑到一張滿意的圖,改個字、換個元素,又得重新開始。抽到一張好看的圖,和完成一項工作,畢竟不是一回事。在真實工作中,做一張圖往往只是任務的一部分:公眾號文章需要封面和多張配圖,企業招聘需要海報、易拉寶、摺頁等一整套物料,設計過程中還可能隨時需要改文字、換人物服裝、調整局部元素。這也意味著,辦公場景中的生圖需求,對模型提出的要求已經不只是畫面效果。它需要理解上下文和用戶意圖,處理已有素材,組織圖片中的信息與版式,並在發現問題後繼續修改。

信息要完整,設計要美觀,修改要可控,幾件事缺一不可。帶著這個問題,對商湯日日新SenseNova U1 Pro進行了多輪實測。相比單次給定提示詞生圖,U1 Pro更強調圍繞任務目標組織創作流程,將需求理解、生成、編輯和調整銜接起來,一次性完成交付。我們先從海報、漫劇人物和潮玩設計入手,再讓U1 Pro為公眾號文章配圖、製作成套秋招物料,最後測試換裝、多參考圖融合和局部修改。想看的不僅是它能不能把圖做好,更是它能否理解各種真實工作下的要求,讓成果逐步接近交付。

今天,SenseNova U1 Pro正式版已上線商湯小浣熊提供生成體驗,本次測試也通過商湯小浣熊、SenseNova Studio來完成。同時U1 Pro還面向企業客戶提供API服務。一、音樂節海報、漫劇人物、潮玩設計,先看U1 Pro能不能把圖做好 生圖模型真正進入工作場景,首先要過的還是視覺效果這一關。一張海報好不好看、人物設計是否統一、產品概念圖有沒有設計感,這些看起來比較基礎的需求,背後同時涉及構圖、色彩、字體、材質以及信息層級。因此,先從三個相對獨立的設計任務切入,看U1 Pro面對不同類型的視覺創作需求時,能不能理解設計意圖,並創作出有風格和審美的圖。

首先我們從很多年輕人喜愛的音樂節、演唱會入手,讓U1 Pro生成一張兼具潮流感和現場氛圍的說唱音樂節海報,提示詞裡給出了音樂節主題、時間地點、視覺風格和需要呈現的核心信息,整體構圖、字體設計和視覺元素安排則交給模型自主完成,提示詞如下: 為一場年輕人說唱音樂節設計一張宣傳海報,主題突出街頭、潮流、音樂現場感,畫面包含主標題、舉辦時間、地點、藝人信息等核心文字,並加入舞臺燈光、說唱人物等視覺元素。整體採用具有年輕潮流感的設計語言,突出主標題,建立清晰的信息層級,保證文字準確、易讀,同時讓人物、字體、背景和裝飾元素形成統一的視覺風格,最終呈現一張可以直接用於音樂節宣傳的完整海報。

從結果看,海報蠻有設計感。大幅標題、舞臺燈光和人物形成了視覺中心,也把街頭氣息和現場氛圍帶了出來。模型還補充了提示詞中沒有給定的活動信息,不過這些顯然屬於設計樣稿。這一輪我們主要觀察的是畫面構圖與信息排布,U1 Pro的整體設計相當不錯。第二個任務,我們讓U1 Pro為東方幻想題材的AI漫劇設計一個主角設定圖,包括人物名稱、身份、性格、服裝等信息,提示詞如下: 為一部東方幻想題材的AI漫劇設計一名核心主角的人物設定圖,保證文字準確性。角色定位為年輕的東方幻想冒險者,設計完整的人物形象,包括髮型、面部特徵、服裝、配飾、武器和整體配色,並通過服裝材質、細節紋樣和道具體現角色的身份與性格。

整體風格兼具東方幻想元素和現代動畫審美,人物需要具有鮮明的視覺辨識度。畫面採用專業角色設定集形式,以人物全身像作為主體,同時展示人物的局部細節,如面部、服裝紋樣、武器或關鍵配飾,並在畫面中合理加入角色名稱、身份、性格、能力等設定信息。要求人物主體、局部細節和文字信息之間具有清晰的視覺層級,字體易讀、排版整潔,所有文字準確無誤;人物各部分造型保持一致,不出現服裝、配飾或武器前後不一致的問題。最終呈現一張具有完整世界觀和專業角色設定集質感的AI漫劇主角設計圖。下面展示的就是U1 Pro創作的角色,人物畫風、武器、建模都符合中式美學的要求,而且很有仙俠漫畫的感覺。

不過,單獨生成一個人物,模型只要管好這一個角色即可。如果進入真實生產流程,它必須能夠在連續的創作中保持一致性,於是讓U1 Pro延續前面風格創作女主角設定圖。可以看到,U1 Pro生成的兩名角色各有辨識度,人物立繪、局部細節和設定信息的組織方式也比較接近。角色變了,整體畫風並沒有明顯割裂。這一輪重點看的是系列角色設計的風格連貫性,而不只是單獨一個人物好不好看。最後,我們把任務轉向產品視覺設計,讓U1 Pro設計一款盲盒類潮玩。

這一次除了角色本身,還加了材質、配色、造型和產品展示的要求,希望結果不只是一張角色立繪,而是一張有商品展示屬性的潮玩概念圖,提示詞如下: 設計一款高端收藏級原創潮玩產品,主題為“未來城市探索家(Future City Explorer)”。畫面是一張真實的潮玩新品商業產品攝影圖:一隻可愛、精緻、具有未來感的迷你宇航員機器人站在展示底座中央,旁邊擺放產品零售包裝盒,整體像真實潮玩品牌剛剛發佈的一款實體收藏玩具,而不是遊戲CG或AI概念圖。角色設計:機器人採用可愛的潮玩比例,大頭、小身體、圓潤四肢,整體比例協調,具有設計師潮玩的收藏感。

頭部略大,臉部是黑色嵌入式顯示屏,兩隻圓潤的大眼睛帶有非常柔和的青藍色發光效果,表情友好、可愛但不過度幼稚。身穿未來宇航服,主體以啞光白色和淺灰色ABS塑料為主,搭配少量銀色金屬零件、透明藍色樹脂和深灰色結構件。裝甲具有真實的拼接結構、細小接縫、圓角倒角、關節結構和合理的機械連接。透明頭盔具有真實透明樹脂質感,可以看到內部結構。材質必須像真實生產出來的潮玩:啞光塑料、半透明樹脂、局部金屬件、細膩噴塗、輕微表面紋理、自然邊緣高光。不同材料具有明顯但真實的材質差異,不要所有表面都高反光。展示底座:機器人站在一個簡潔的圓形收藏級展示底座上。

底座採用深灰色磨砂材質、銀色金屬和少量半透明藍色樹脂,融入少量未來城市建築元素,只保留幾棟精緻的微縮建築,不要做成複雜巨大的城市模型。底座具有真實的產品結構、接縫和固定方式,機器人雙腳自然站立在底座上,比例合理,接觸關係真實。包裝設計:在機器人右側放置一個與產品等比例的精緻潮玩包裝盒。包裝採用高級啞光紙盒+透明展示窗設計,盒面印有:“未來城市探索家”“FUTURE CITY EXPLORER”。包裝設計簡潔、現代、有品牌感,以白色、銀灰色和少量藍色為主,印有機器人產品視覺圖和簡潔的系列編號。包裝盒具有真實紙張紋理、摺痕、接縫和印刷質感,看起來像真正可以在商店貨架上銷售的潮玩產品。

攝影環境:使用真實高端商業攝影棚進行拍攝。背景為深藍灰色的未來城市氛圍,但保持克制,只出現柔和、虛化的藍紫色城市燈光和少量建築輪廓,不要滿屏霓虹燈。使用柔和的大面積攝影燈作為主光源,輔以微弱藍色輪廓光,讓機器人白色裝甲、透明頭盔、金屬零件和包裝盒的材質清晰可見。產品放置在深色啞光攝影臺上,具有自然接觸陰影和輕微真實倒影。最終效果:高端潮玩品牌新品宣傳照、設計師收藏玩具、實體產品攝影、真實工業設計、精緻製造工藝、真實材質、自然光影、淺景深、85mm產品攝影鏡頭質感。畫面重點是“這真的像一個可以生產、包裝、售賣的潮玩產品”。避免遊戲CG、概念藝術、電影海報和過度科幻視覺。

不要過度霓虹燈、不要誇張光暈、不要鏡面塑料、不要所有材質都發光、不要堆砌機械結構、不要複雜到無法生產的零件、不要漂浮、不要穿模、不要畸形四肢、不要重複建築、不要廉價塑料感、不要過度銳化、不要隨機文字、不要雜亂背景、不要過度複雜的底座。U1 Pro的輸出頗有產品展示圖的感覺,不管是材質還是包裝盒的紙質感,尤其是頂部光線照射下玻璃和金屬材質的反射,做的相當逼真,同時,在設計上也表現出了較高的審美能力。而且作為創意概念圖,這樣的輸出把角色、材質與包裝放在一起,讓產品方向不再只停留於文字描述。

從音樂節海報、漫劇人物到潮玩設計,三個任務的要求並不相同:一個看構圖與信息層級準確,一個看美學與系列畫風,一個看產品質感,都是交付能力最直接的體現。這幾項測試下來,U1 Pro能夠根據不同需求調整視覺表達,這也為我們模擬真實場景和實際應用的測試提供了信心。二、從公眾號配圖到企業秋招,把一項視覺工作完整做下來 單張圖片能夠完成之後,把測試進一步放進真實的辦公任務。實際工作中,生圖往往只是其中一個環節。一篇文章可能需要封面、配圖和信息圖,一次企業秋招則要同時準備招聘海報、宣傳摺頁、易拉寶甚至周邊設計。先從我們熟悉的任務開始。用AI創作了一篇關於SenseNova U1.

5的技術解讀文章,讓模型按照文章內容進行配圖。這是一個在媒體工作中非常重要的需求,不是單純找一張“有科技感”的圖片,而是要讓圖片回應具體段落。正文插圖提示詞如下,後面需要附上對應的文章內容: 請根據這段文章內容製作一張公眾號插圖,尺寸為1024×544。先理解並提煉文章的核心信息,再進行視覺設計。要求畫面簡潔、清晰、有信息量,通過圖形、人物/物體和簡短文字結合的方式,把文章段落的核心邏輯完整呈現出來,整體採用簡潔、有設計感的科普插畫風格,信息層級清楚,構圖舒展,文字清晰易讀,避免堆砌文字和無意義裝飾。

公眾號文章封面的提示詞如下: 根據完整文章內容,提煉文章的核心主題和最重要的信息,設計一張公眾號文章封面圖。要求尺寸為900×383,畫面簡潔、有視覺衝擊力,突出文章的核心主題和主體元素。以圖形、人物或場景為主,文字儘量少,只保留必要的標題或關鍵詞,避免堆砌信息。整體風格專業、現代、有科技感,構圖清晰,主體突出,適合微信公眾號文章封面展示。最終,我們為這篇技術解讀文章生成了封面和插圖。從效果上看,封面側重突出主題,正文配圖則嘗試通過圖形、簡短文字和漫畫式表達輔助理解。對編輯來說,有價值的不是圖片數量增加了,關鍵是要讓圖片中的概念、關係和說明符合文章原意。

主題相關只是第一步,內容準確、圖文配合,才是配圖任務需要繼續核對的部分。U1 Pro精確理解了文章和段落的內容,所做的插圖易於理解、構圖清晰,還附帶了不少漫畫的形式輔助理解。封面和正文插圖在整體視覺語言上也保持了統一性。除了媒體,企業同樣有大量的設計需求,如果從現在這個時間節點來看,秋招無疑是最重大的活動了。下面這個測試,我們給U1 Pro出了一道更復雜的題——為企業秋招準備一套視覺物料。為此,編輯部還特意請教了公司HR,把所有任務一網打盡。這項任務的難點,不只是多生成幾張圖。公司名稱、崗位信息、時間和地點要準確,各類物料之間要有統一的視覺風格,不同用途又不能照搬同一種版式。

比如,海報需要先吸引注意,崗位信息圖需要讓人快速找到招聘方向,摺頁則要組織更多說明內容。既要讓信息講完整,也要讓佈局好看、讀起來不費勁。從U1 Pro的輸出結果上看,招聘海報、易拉寶和摺頁用了相近的配色和視覺元素,但根據使用場景不同,信息排布做了相應調整;崗位信息圖更突出文字和數據,沒有簡單複製海報的版式,宣講會的伴手禮也做了相應的視覺設計。完整物料的視覺方案展示如下: 這裡值得注意的是,成套設計不等於把同一張圖拉成不同尺寸。它需要一邊沿用既有風格,一邊根據用途重新安排內容。從單張圖片走到整套物料,這種關聯性比單張圖的效果更接近真實工作。

三、一鍵換裝、局部修改,多圖融合製作漫畫風拍立得 前面的測試,主要是從無到有的創作。但真實工作裡的圖片處理任務還有另一半:在已有圖片上繼續修改。比如給人物換一套衣服、調整房間裝修風格、刪除畫面中的路人,或者只修改海報裡的某段文字。用戶要的往往不是“再來一張”,而是把眼前這一張改好。首先來測試換裝。我們生成了一張身穿連衣裙的模特圖片,然後上傳藍色連衣裙圖片,並讓U1 Pro替換衣服和背景,並將海邊背景換成草原,儘量保留人物本身的外觀特徵和姿態。從最終效果看,藍色連衣裙和草原背景都完成了對應替換,人物的臉部、髮型和整體姿態保持了較高連續性,人物明暗也隨新環境做了適配。

這個任務的難點在於要分清楚哪些該改、哪些該保留,衣服和場景需要變化,人物則不能因為換裝被改成另一個形象。U1 Pro處理的不再只是“生成什麼”,還包括“哪些地方不要動”。隨後,通過一個更復雜的需求,來測試一下U1 Pro的多張參考圖的理解和編輯能力,我們上傳了一張在青島吃海鮮的照片、兩個人物漫畫形象以及一張拍立得相框參考圖,讓U1 Pro對原圖進行精細化修改。提示詞如下: 這幾張參考圖裡,原照片提供就餐場景、餐桌和食物佈局,人物形象提供角色特徵,拍立得參考則提供邊框與呈現方式。U1 Pro首先要分清哪些信息需要保留、哪些元素需要替換,再協調人物比例、光影和前後關係。

從結果看,U1 Pro對參考圖的理解到位,將主圖中的人物替換為了漫畫形象,同時,女生形象和男生形象的融合也很自然,人物替換以及桌子上小精靈的出現沒有影響原圖,背景和食物都保持了原狀,整體呈現出統一的照片風格。最後,我們又進行了幾項快速編輯測試,包括房間重新裝修、畫面調色、刪除部分內容、海報局部文字調整等。這些任務的共同要求只有一個:只改需要修改的地方。例如在房間裝修測試中,我們要求保留原始房間的結構、門窗和空間佈局,只更換傢俱和整體裝修風格,毛坯房搖身一變成了精裝修房間。從前後對照中,仍能辨認出原空間的主要框架,室內則加入了傢俱和飾面,毛坯房變成了裝修效果圖。

風景圖也可以修改,比如一鍵把藍天換成陰雨天,加上自然下落的雨絲並刪掉某電線杆。從前後對照看,畫面光線變得更陰沉,樹木、欄杆和步道的主要佈局得到保留。我們還對下面這張海報進行了局部調整,把臭豆腐改成了香豆腐,然後在旁邊添加了拼音“buchou”字樣。幾輪測試下來,這類局部任務的完成度整體較高,修改能夠集中在指定區域,原始畫面的主體結構、畫面風格連續性也得到保留,沒有出現“改一個地方、整張圖都變了”的情況。結語:從“生成一張圖”到“完成一項任務” 整體實測結束後,商湯U1 Pro給我們留下最深刻的印象,是它不再只是追求“生成一張好看的圖”,而是開始圍繞一項完整任務解決問題。

海報、角色與潮玩,看的是設計表達;公眾號配圖和秋招物料,看的是內容關聯與成套組織;換裝、多圖融合和局部改字,則進一步考驗修改能否對準目標、保住已確認的部分。這幾件事放在一起,才更接近真實工作的要求。用戶需要的不是不斷拿到新的圖片,而是讓手上的成果一步步接近可用狀態。當然,交付也不是一句“生成成功”就能完成。信息是否完整準確,佈局是否清晰美觀,修改是否符合要求,輸出能否滿足實際用途,都要繼續接受核驗。對U1 Pro這樣的多模態模型,評價不應只停留在第一張圖有多驚豔,而要進一步看:面對一項包含多種素材、多個交付物和多輪修改的任務,它能否持續回應需求,把信息完整性、設計表現和修改可控性放在一起做好。

這也意味著,AI生圖的價值正在從“生成一張圖片”,進一步走向“完成一項任務”,並能夠真正嵌入個人和企業的工作流程,把一項工作持續推進到符合要求的成果。

Related

相關文章

IT之家模型更新

鴻蒙 PC 生態首款 AI 編程智能體工作臺,阿里 Qoder 支持鴻蒙電腦

作者:沁滄(實習) 責編:沁滄 評論: 9 月 21 日消息,阿里 Qoder 今日宣佈,Qoder 登陸鴻蒙 PC 應用市場,是鴻蒙 PC 生態首款 AI 編程智能體工作臺。據介紹,Qoder 團隊與鴻蒙團隊緊密配合,重點解決了幾個關鍵問題:讓 Qoder 的完整任務閉環 —— 從理解意圖、拆解步驟、調用工具到交付結果 —— 在鴻蒙系統上流暢運行,確保核心體驗不打折。

剛剛

百度文庫網盤宣佈AI辦公出海,庫庫AI全球月活超4000萬

通用智能體“庫庫AI”全球AI辦公月活已超4000萬,百度文庫網盤去年推出的海外一站式AI辦公平臺Oreate AI同步煥新為庫庫AI海外版“Kooko”,海外用戶一年內突破1000萬。作為百度文庫網盤三年前佈局的通用AI辦公產品,庫庫AI前身GenFlow於2025年4月上線1.

剛剛

用 AI 造謠再收費刪帖:自媒體博主敲詐科技企業 230 萬元被抓

今年以來,上海警方共偵破涉企謠言案件百餘起,依法清理涉企不實信息 8.7 萬餘條;累計偵破涉企黑客類案件 68 起,抓獲犯罪嫌疑人 210 餘名。上海警方重點介紹了一起故意製造企業負面輿情、實施敲詐勒索的案件:犯罪嫌疑人針對一家剛剛宣佈獲得融資的科技企業,連續發佈十餘篇不實文章持續抹黑造謠,敲詐 230 萬元。

2 小時前
量子位模型更新

百曜科技發起,《AI虛擬細胞(AIVC)技術趨勢、產業生態與應用前景研究報告》正式發佈

百曜科技發起並由《麻省理工科技評論》中國團隊撰寫的《AI虛擬細胞(AIVC)技術趨勢、產業生態與應用前景研究報告》正式發布,將AIVC定位為AI時代生命科學的新型基礎設施。報告梳理了AIVC的技術路線、產業格局與未來趨勢,指出產業競爭正從模型規模走向數據、模型與實驗的閉環整合,並展現百曜科技在模型架構、數據工廠及乾溼閉環等方面的布局。

3 小時前
雷峰網模型更新

AI4S青年志① | 搖瓶子的手與調參數的腦:兩個95後和一場物質科學的化學反應

在AI4S,AI出身的人是在等AI出奇跡,而Science出身的人是在給AI立規矩。作者丨周蕾 編輯丨岑峰 【編者按】這是AI科技評論“AI4S青年志”系列專訪的第一篇。當所有人都在談論AI4S,我們想聽真正在做的人怎麼說。本系列與這個領域的青年人對談,記錄他們如何走向兩個學科的交界,在難題與彎路中走到今天。

4 小時前