OpenAI 旗下 GPT-Image-2 模型現支持生成透明背景圖像

2026年8月21日 16:53
OpenAI 旗下 GPT-Image-2 模型現支持生成透明背景圖像
站內 AI 整理稿

OpenAI 今日宣布,其旗下 AI 圖像生成模型 GPT-Image-2 正式導入透明背景圖像的輸出支援。即日起,使用者可直接產出附帶透明背景的 PNG 圖片,無需再透過額外去背工具進行後製處理。這項更新對於時常需要製作商品圖的電商賣家,或為簡報、PPT 尋找搭配素材的設計者而言,能有效縮短後製流程,提升工作效率。過去,要讓 AI 生成的圖片呈現透明背景,往往需要先產生一張完整圖像,再透過影像處理軟體手動去背。步驟雖然不算複雜,但在大量產製素材時,重複性的去背工作仍會耗費不少時間。

如今 GPT-Image-2 直接將這項能力整合進模型輸出,讓使用者從源頭就取得背景透明的圖檔,省下中間的額外工序,也讓整個創作流程更為直覺。根據 OpenAI 的說明,開發者與一般使用者只需在 API 請求中加入 background=transparent 參數,即可啟用這項功能,無需額外設定。這意味著,只要是使用 GPT-Image-2 的應用程式、自動化流程或客製化工具,都能夠以簡單的指令呼叫透明背景輸出,不需要理解複雜的影像處理原理,也不必在生成後另行處理圖檔。這樣一來,無論是獨立創作者還是整合了該模型服務的開發團隊,都能輕鬆導入這項新能力。

這項透明背景輸出能力,讓 GPT-Image-2 在素材生成、圖層合成等應用場景中更具彈性。以電商產業為例,商品圖往往需要乾淨的背景以凸顯產品本身,無論是放在網站上、製作廣告素材,還是加入型錄設計,透明背景的 PNG 都是相當實用的格式。過去賣家必須仰賴專業設計人員或去背工具,現在則可以透過 GPT-Image-2 直接生成產品圖,將心力更集中於商品行銷與品牌經營。對於設計工作者而言,透明背景的好處同樣不言可喻。在製作簡報或 PPT 時,經常需要各種插圖、圖示或裝飾素材來豐富版面,但如果背景與投影片底色不一致,就會產生明顯的色塊或邊界,影響整體視覺。

有了 GPT-Image-2 的透明背景生成能力,設計者可更自由地將 AI 產出的物件放入各種背景顏色與版面設計中,不必再為了去除背景而逐一處理,工作流程也更加順暢。此外,透明背景也讓 AI 生成圖像更容易融入更複雜的視覺專案。舉例來說,設計師可以將多個透明背景的 AI 圖像分層疊合,搭配文字與其他視覺元素,快速組合成具有完整構圖的主視覺。這類型的圖層合成工作,過去多半需要仰賴高階影像處理軟體與熟練技術,如今透過簡單的參數設定,即可取得可直接使用的去背圖層,大幅降低進入門檻。從技術角度來看,這項更新代表 AI 圖像生成模型不再只是單純輸出完整的靜態畫面,而是更進一步理解圖像內部的結構與內容。

透明背景的輸出需要模型在生成過程中精確判斷主體與背景的界線,並保留主體邊緣細節。這也顯示 GPT-Image-2 在影像理解與生成品質上已具備更高水準,使其能勝任更貼近實際商業需求的任務。OpenAI 指出,這次的新功能讓 GPT-Image-2 在商業設計與內容創作上的實用性進一步擴展。無論是社群媒體貼文、廣告橫幅、商品型錄,還是簡報投影片,都能更有效率地運用 AI 生成的圖像素材。特別是在內容產量需求較大的電商或數位行銷領域,節省每一道後製時間,都能讓團隊投入更多資源於策略與創意發想。

值得注意的是,GPT-Image-2 的透明背景輸出是透過簡單的 API 參數啟用,而非需要繁複的設定流程。這樣的做法,有助於讓更多第三方應用程式與平台快速整合該功能,也讓一般使用者在各種 AI 繪圖工具中,都能更方便地切換不同輸出模式。對於正在發展 AI 影像應用的開發者來說,這也是一個讓產品更具競爭力的重要功能。隨著 AI 圖像生成工具日益普及,使用者對輸出品質與後製便利性的期待也越來越高。GPT-Image-2 這次加入透明背景支援,可說是回應了市場上的實際需求。

除了讓既有使用者受惠,也可能吸引更多過去因為去背麻煩而對 AI 素材卻步的創作者,重新考慮將 AI 生成圖像導入日常的工作流程之中。整體而言,這次更新不僅替電商賣家與設計者提供更直接便利的解決方案,也讓 AI 圖像生成的應用範圍更加寬廣。從單一圖片的產出到複雜的多圖層合成,透明背景功能都是其中關鍵的基礎能力。未來若能進一步搭配其他進階功能,勢必能讓 AI 在視覺創作領域扮演更不可或缺的角色。可以預期,在實際使用經驗陸續累積之後,會有更多創作者會基於這項功能發展出新的工作方法或應用模式。

而對 OpenAI 而言,持續擴充 GPT-Image-2 的能力,無疑也是穩固其 AI 圖像生成市場地位的重要布局。對一般使用者來說,最重要的是:那張圖終於能在不經任何額外步驟的情況下,直接帶有透明背景,讓想像力與設計之間的距離又縮短了一些。

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛
全天候科技生成式AI

企業AI最後一公里:三路人馬在此交鋒

鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。

剛剛