量子位生成式AI

別再吹AI生圖了,不能圖層編輯的AI都是“畫餅”

2026年8月5日 22:19
別再吹AI生圖了,不能圖層編輯的AI都是“畫餅”

重點摘要

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.

站內 AI 整理稿

過去兩年,AI 大模型幾乎徹底改寫了內容生產的產業面貌。從最初連手指都畫不對的「六指琴魔」,到如今能生成複雜海報、真實 UI 介面、高密度中文排版,視覺 AI 大模型的能力以驚人速度進化。AI 會畫圖早已不是新聞,真正值得討論的問題是:當模型越來越強,它還能做什麼?答案或許不是單純產出更精美的圖片,而是能否真正融入設計師的工作流程,補上最關鍵那塊拼圖——圖層編輯。過去市場上多數 AI 生圖工具,本質上仍是「一次性生成」:使用者輸入提示詞,系統產出一張圖,若想修改局部細節,往往只能重新生成,或仰賴後製軟體手動調整。

這種「黑箱式」輸出,讓設計師無法像在 Photoshop 或 Sketch 中那樣,對文字、圖層、元件進行獨立編輯與調整。換句話說,AI 生圖雖然降低了創作門檻,卻無法承接專業設計流程中後續的修改、疊代與協作需求,形同「畫餅充飢」。如今這道難題有了新解法。兔展智能正式推出 RabbitVis,一款號稱能讓 AI 真正走完設計全流程的生產工具。不同於市面上單純的圖像生成器,RabbitVis 從底層架構上支援圖層分離、元件獨立編輯、文字修改與佈局調整,讓設計師在 AI 生成的基礎上,仍能保有傳統設計軟體的操作彈性。

這意味著,AI 不再只是產出「最終成品」,而是產出一個可編輯、可疊代的設計文件,徹底打通從靈感到落地的完整路徑。RabbitVis 的核心理念,是將 AI 生成能力與結構化設計相結合。傳統 AI 生圖將像素視為一體,難以區分背景、前景、文字、按鈕等不同元素;而 RabbitVis 在生成過程中便自動建立圖層結構,每個視覺元素都擁有獨立屬性,設計師可以隨時點選修改顏色、字體、尺寸、位置,甚至替換素材。這項突破讓 AI 從「繪圖助手」升級為「設計協作夥伴」,尤其適合需要大量改稿的電商海報、社群貼文、廣告素材等場景。

從技術路線來看,RabbitVis 代表視覺 AI 發展的新階段:從單純理解「畫什麼」,進化到理解「怎麼結構」。過去幾年,業界聚焦於提升生成解析度、提示詞遵循度、風格多樣性,卻忽略了設計流程中「可控性」這個核心痛點。兔展智能此次選擇從設計生產鏈的終端切入,直接把 AI 生成的結果轉換為可編輯的設計稿,可以說是對當前 AI 設計工具的一次重要補完。值得一提的是,RabbitVis 在中文排版與 UI 生成方面也做了針對性優化。

許多國外 AI 工具在處理中文字型、直排文字、標點符號時經常出現錯位或亂碼,RabbitVis 則內建繁體與簡體中文支援,能準確生成帶有複雜排版的海報與介面,對於台灣與華語市場的設計工作者而言,實用性大幅提升。官方已開放體驗連結,使用者可直接在網站上試用,並加入官方社群與其他設計師交流使用心得。當然,RabbitVis 並非完美無缺。目前它仍處於早期公開階段,部分進階功能如圖層混合模式、遮罩編輯、濾鏡等尚未完全開放,但路線圖顯示團隊正持續疊代。更重要的是,它代表了一個明確的產業方向:AI 設計工具的下一個戰場,不是誰能畫出更驚豔的圖,而是誰能讓 AI 生成的內容真正「可用」「可改」「可協作」。

不能圖層編輯的 AI,終究只是曇花一現的娛樂玩具;能融入設計流程的 AI,才有機會成為生產力核心。從更大視角看,視覺 AI 的發展正從「內容生成」走向「結構理解」。當 AI 不再只是輸出像素矩陣,而是能辨識、分層、重組畫面中的每個元件,設計自動化才能真正走進企業與工作室的日常。兔展智能的 RabbitVis 或許只是第一步,但它已經讓「AI 設計師」這個詞,離實用更近了一步。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

47 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前