講真,我沒看出這圖是AI做的,更沒想到是國產AI做的

答案是,都是AI。即便我們把圖片放大,似乎也是找不到以前那種“一眼AI”的細節: 而且啊,這兩張圖片並非出自你以為的Image 2.5之手,實則是來自一個國產AI—— 正是我們之前稱之為“今年WAIC最驚豔的圖”背後的模型,來自商湯科技的SenseNova U1 Pro(下文簡稱U1 Pro)。而這次是正式版上線,現在已經可以在商湯小浣熊平臺上使用,API也已經開始向企業客戶開放了。不過有一說一,圖生成的好只是一方面;生成後能不能繼續改、直到達到可商用,同樣也是現在AI生圖圈裡比較關注的一點。
因此,接下來,我們就要對U1 Pro來一波深度實測了~ 生完圖還能繼續精修 在實測之前,老規矩,我們先來介紹一下操作方式。首先是小浣熊這個平臺,點擊輸入框下方的“一圖讀懂”,就可以選擇U1 Pro模型了: 不過目前小浣熊平臺僅支持複雜圖片的生成,企業客戶可以通過API或者SenseNova Studio體驗多輪修改等功能。所以我們特意申請了實測邀請碼,接下來的實測也將在SenseNova Studio平臺上展開,同樣是選擇U1 Pro模型即可(2K清晰度起步,最高4K): 給生活照換個風格 第一輪實測,我們小試牛刀一下,拿一張隨手拍的生活照,把它重構成完全不同的風格。
首先我們上傳一張自己拍的照片: △此圖為實拍圖 並附上這樣的Prompt: 僅僅幾分鐘時間,寫實的人物照片就切換好風格了: 可以看到,U1 Pro很好地理解到了Prompt的意圖,並在沒有發生任何畸變的情況下,將整體圖片變成了紙質的感覺。但到這裡還沒有完,我們繼續給U1 Pro上難度,讓它在新圖的基礎上,只對局部進行調整: 只修改人物深色外套裡面的黑色圓領T恤,將T恤改為白色。修改範圍嚴格限定在敞開外套之間、頸部下方至腰部上方可見的內搭T恤紙片,包括圓領邊緣。這張圖局部改色的難點在於,T恤是黑色的、皮帶是黑色的、褲子也是黑色的,加上人物胸前還有胸牌遮擋,AI極容易混淆邊界。
但U1 Pro卻精準地把T恤的邊界給拿捏住了;由此可見,它對於圖片整體的把控還是相當到位的。多圖合成一家貓咪經營的微縮咖啡店 剛才的實測我們只是輸入了一張圖,那如果是多個參考圖,U1 Pro是否也能hold住呢?來,上四張圖: 這次實測的效果,我們想要把這四張圖片揉成一張一家貓咪經營的微縮咖啡店。Prompt如下: 將四張參考圖組合成一張橫版4:3的微縮咖啡店宣傳海報,主題是虛構店鋪“街角補給站”。請明確區分四張圖的作用。圖1:只參考店面的建築輪廓、門窗數量、門窗相對位置和遮陽棚形狀,把它製作成擺在桌面上的1:12微縮店鋪模型。原圖招牌文字統一替換為“街角補給站”,不要改成另一種建築。
圖2:參考這隻貓的毛色、額頭花紋、臉部輪廓和胸口特徵,製作成店鋪裡的微縮貓店長。讓貓坐在門口一張小凳子上,系一條深藍色圍裙,身體比例自然,不做成人類身體。圖3:參考杯子的形狀、把手、顏色和表面圖案,把它縮小後放在店外的小桌上。杯子與桌椅符合微縮場景的相對比例,不修改產品結構,不額外增加杯子。圖4:只參考海報的版面分區和文字層級,不復制其中的物品、配色或示例文字。店鋪使用塗漆木材、透明亞克力窗、織物遮陽棚和細小金屬門把手,呈現真實手工模型的質感。所有主體採用一致的透視與左上方柔和光線,有合理接觸陰影,不能像四張圖片直接拼貼。
海報必須完整、準確地出現以下文字:店名“街角補給站”;主標題“今天,先喝一杯再出發”;產品信息“桂花拿鐵 28元”;營業信息“營業時間 08:00—20:00”。店名可以出現在實體招牌上,其餘信息放在海報文字區。不要編造地址、聯繫方式、促銷信息或二維碼。整體溫暖、有生活感,信息在手機正常閱讀尺寸下清楚可辨。貓還是那隻貓,杯子還是那個杯子,店鋪門面也沒有改變,並且最終生成的圖片也跟結構草圖完全對應上了。由此可見,U1 Pro不僅能一口氣抓取每張參考圖的關鍵信息,同樣是不發生任何畸變的情況下,把它們按照Prompt要求完整輸出出來。修改,修改,再修改!
在第一輪實測中,雖然我們已經感受到了U1 Pro修改局部內容的能力,但在真實工作環境中,修改這件事,可能還真不是隻發生一次。所以接下來,我們就測試一下,當連續修改時,U1 Pro是否依舊能夠穩定發揮。先來改一下剛才“貓咪咖啡店海報”的價格: 編輯這張海報,只把“桂花拿鐵 28元”改為“桂花拿鐵 26元”。保持產品名稱、原有字體風格、字號、文字顏色和所在位置,儘量只改價格中的必要字符。店鋪、貓咪、杯子、招牌、主標題、營業時間、背景、光影和其他文字保持原樣,不重新設計整張海報。可以看到,原先的“28元”,已經改成了“26元”,並且是毫無違和感的那種。
繼續修改: 把主標題“今天,先喝一杯再出發”替換為“今天的好心情,從這一杯開始”。新標題仍放在原主標題區域,可以在這個區域內合理換行並小幅調整字號,保持原來的字體風格、顏色和視覺層級。不要遮擋店鋪、貓咪、杯子或其他信息。再繼續: 只把桌上咖啡杯的杯身底色改為深墨綠色。保留杯子原來的形狀、把手結構、表面圖案、大小、位置、材質和光照關係。連續三輪的修改,圖片全程都是指哪兒改哪兒,其它地方可以明顯看到一點都沒有發生任何變化。由此可見,U1 Pro確實是經得起連續折騰的那種生圖AI了。一口氣生成八格連續動作 第四輪實測,我們再上難度。之前Image 2.
5剛出的時候,就有不少網友整個了活兒,就是讓基於一張原圖,生成一個八宮格、連續動作的圖片;再基於生成出來的圖片,做成一個可以動的GIF。那麼我們也來看下U1 Pro能否做到,輸入圖是這樣的一隻貓咪: Prompt如下: 根據上傳的貓咪參考圖,生成一張橫版16:9的連續動作圖集,嚴格分成4列×2行,共8格。每格都是同樣尺寸的正方形,格間使用等寬窄白邊,方便後續裁切,不添加格號或任何文字。主角是一隻以參考照片中的貓為原型的手工毛氈貓,保留它的額頭花紋、臉部輪廓、胸口毛色和尾巴紋路,佩戴一條深藍色小圍巾。畫面具有真實毛氈纖維和定格動畫布景的質感。
八格按從左到右、從上到下的順序,連續表現同一只貓在辦公桌前結束工作的過程:第1格,貓坐在凳子上,兩隻前爪放在打開的筆記本電腦前;第2格,貓抬起右前爪,伸向電腦屏幕上沿;第3格,右前爪把屏幕壓到半合狀態;第4格,屏幕完全合上,前爪仍搭在電腦上;第5格,貓收回前爪,身體轉向畫面右側;第6格,貓從凳子上跳下,身體處於低空,朝右移動;第7格,貓落在地面,向右邁步;第8格,貓走到畫面右邊緣,身體仍完整可見,辦公桌與合上的電腦留在身後。鏡頭固定為能同時看見桌面和地面的正側面中遠景。背景是簡單的米白牆和木地板,只有一張桌子、一張凳子和一臺無品牌標識的電腦。
每格的鏡頭、桌椅位置、物體尺寸、光線與背景保持一致,電腦從第4格起一直保持合上。所有格子只有同一只貓,不增加角色,不更換圍巾或花紋。每格推進一個明確動作,不要生成八張彼此無關的姿勢圖。從結果來看,即使是8張連續的圖,輸入的貓咪依舊是穩穩保持住了原型;然後生成的最終圖片,也是按照Prompt要求,生成了連續的動作。最後把這張圖變成GIF,效果就出來了: 這樣的宮格圖片,其實在AI視頻生成場景中是比較實用的,我們可以用類似的方式,讓同一個人物生成連續的動作,再由AI視頻生成的工具基於此去穩穩地生成一段視頻。例如這樣的: 做一張複雜的科普圖 最後的實測,我們來做一張複雜的科普圖。
不過這一次,我們不會給U1 Pro任何輸入圖,也不會給它任何資料素材。僅僅通過一段Prompt,讓它自行去搜集資料: 為面向普通讀者的科普賬號製作一張豎版3:4中文海報,標題為“月亮為什麼會變臉?” 請先實際查閱NASA的Moon Phases與Moon Facts等官方資料,核實以下問題:月光從哪裡來;常見月相變化如何形成;月相變化與月食有什麼區別。將核實後的內容組織成一張完整海報。視覺採用“紙上月亮博物館”:用八枚糖霜餅乾式圓形月亮表現一個月相循環,表面為啞光、輕微顆粒感和淺浮雕質感,亮面與暗面要清楚區分。暗面仍保留完整圓形輪廓,避免把月相誤畫成月球缺了一塊。
八個月相嚴格依次排列並標註:“新月”“蛾眉月”“上弦月”“盈凸月”“滿月”“虧凸月”“下弦月”“殘月”。採用北半球常見月相示意的亮面方向,所有月亮的表示方式保持一致,並在圖中註明這一示意約定。圖中必須準確表達:月光主要是反射的太陽光;月相變化來自我們看到的月球受光部分發生變化;普通月相變化不是地球影子遮住月亮。將解釋壓縮為適合手機閱讀的三條短句,不塞入整段百科文字。用奶油白、炭灰和少量淡金色形成安靜、有收藏感的科普視覺,文字與月相名稱清晰,不增加未經核實的數字或日期。完成後檢查月相名稱、順序、亮面方向和解釋文字是否一致,再輸出海報。
請在圖片之外提供實際參考的官方頁面標題與鏈接;不要編造來源,也不要把檢索過程塞進畫面。如果當前入口無法檢索,請明確說明,不能假裝已經查閱。可以看到,U1 Pro自己先從網絡上搜集到了更多與之相關的材料,而後將資料與我們Prompt相匹配,並進行整合;最終給出了一張信息量豐富的科普圖。能交付的生圖AI,才算過關 最後,我們回頭再來看一下剛才實測中的一個細節——那杯從28元改到26元的拿鐵。類似這樣的修改,其實在現實工作、創作場景中是非常常見的,而且往往不可能只修改一次。所以剛才我們連續三次對圖片做了修改,並且能夠保持圖片其它細節沒有發生任何畸變,其中的意義和價值就不言而喻了。
畢竟AI生圖這塊,此前最被大家詬病的一個點,便是牽一髮而動全身。但U1 Pro卻能經得住多輪、連續的修改和折騰,說明它已經是一個具備可交付性的那種生圖AI了。順著這個思路,我們又給它派了個品牌電商從業者會碰到的活兒:拿現成的咖啡杯白底圖,做一張能放進商品詳情頁的生活場景圖。桌面、背景和光線都可以重新安排,但杯型、把手和杯身圖案得跟原商品對得上,畢竟消費者看完圖片,下單買的就是這隻杯子。以及簡單2句話,就能生成可直接商用的複雜信息海報,信息還是U1 Pro自己檢索的那種: 請圍繞“第83屆威尼斯國際電影節”自主檢索並製作一張豎版3:4中文新聞信息海報。
所有事實、日期、文案和視覺編排均由你根據檢索結果完成。當然,可交付性不能只侷限在廣告海報這一類商業場景,對於創作者來說,人物的細節、畫面的質感、元素的豐富度,也都屬於可交付性的範疇。由此我們也就能夠理解商湯為什麼要給U1 Pro安排一套更完整的創作流程: 需求理解、信息搜索與補全、素材處理、生成編輯,以及檢查修正,都被納入同一套創作管線,圍繞最終用途推進。用戶交過去的任務,可以從一組零散素材開始,做到一份有明確使用目的的成果。總而言之,現在的生圖AI已經不缺“啊哈時刻”了,缺的是能繼續不出錯地改、直到可以最終交付的那種AI。而U1 Pro,絕對是符合這一標準的生圖AI之一。
One More Thing 剛才我們的實測更傾向於展現U1 Pro的功能,但其實它在藝術的表現力上,也是夠打的。來,欣賞一下U1 Pro的Gallery(左右滑動查看更多圖片): SenseNova U1 Pro小浣熊體驗地址:https://office.xiaohuanxiong.com/ 版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章

當 AI 開始給自己動刀,“智能爆炸”可能真不遠了:兩篇論文拆解AI下一步進化路徑
硅谷Tech news2026.09.23 10:17 · 來自北京全文6004字00:00 / 14:22當 AI 開始“改進自己”,AI 的下一個躍遷,取決於在群體中相互成就。最近,AI 圈同時被兩件事刷了屏:一邊是 MIT 材料科學家 Markus J.
世衛組織發佈重磅報告,呼籲全面升級醫療 AI 研究倫理監管
報告指出,雖然人工智能正在以前所未有的速度重塑健康研究、加速科學發現並改善醫療成果,但在缺乏強有力的倫理防線與監管 oversight 的情況下,AI 醫療研究也可能引入新的風險,從而危及人權、社會公平以及公眾信任。在現有的倫理審查機制方面,世衛組織警告稱,傳統的審查體系往往難以應對人工智能帶來的新型風險,包括算法透明度、偏見、公平性、問責制、隱私保護,以及快速部署 AI 工具可能引發的潛在危害。
Grok Bot 上線僅一個月,周活躍用戶數正式突破 40 萬大關
根據最新行業報道顯示,由馬斯克的 SpaceX AI 團隊推出的 Grok Bot 人工智能智能體在上線大約一個月後,其周活躍用戶數已經成功突破40萬大關。具體數據表現十分亮眼。截至9月14日的統計數據顯示,Grok Bot 的用戶規模已迅速攀升至41.
蘋果高管稱不建議給iPhone貼膜!網友:免費換屏幕我就信你;高德地圖成「職場版大眾點評」?回應來了;Muse大火,扎克伯格身價暴漲1700億
要聞提示1.蘋果高管稱不建議給iPhone貼膜!網友:免費換屏幕我就信你2.知情人士:DeepSeek將向聯合國安理會介紹AI風險,月之暗面等中國企業也受邀參會3.高德地圖成“職場版大眾點評”?回應來了4.字節通報二季度違規案例:114名員工被辭退,其中8人被移交司法機關處理5.

消息稱 DeepSeek 本週參加聯合國安理會,講解 AI 安全風險
作者:潞源 責編:潞源 評論: 感謝網友 咩咩洋、軟媒用戶1238620、西窗、HH_KK 的線索投遞!9 月 22 日消息,據路透社今日援引知情人士消息,中國人工智能初創公司 DeepSeek(深度求索)將在本週參加聯合國安理會,講解 AI 安全風險。

499元,OPPO發了一款別在領口的AI新硬件
(公眾號:zhidxcom) 作者 | 雲鵬 編輯 | 李水青 9月22日深圳晚間報道,昨天vivo剛剛出招,今天OPPO就緊接著掏出了自家年度旗艦機Find X10系列,其核心定位還是影像旗艦,Pro Max版首發了三顆2億像素鏡頭群。 作為發佈會的“One More Thing”,OPPO首席產品官劉作虎正式發佈了售價499元的OPPO AI“心力球”,實際上這是一個AI穿戴產品,可以別在領口。