IT之家生成式AI

防 AI 爬取字體 Decoy Font 問世,靈感源於瑪麗蓮 · 夢露和愛因斯坦混合照

2026年7月18日 14:29
防 AI 爬取字體 Decoy Font 問世,靈感源於瑪麗蓮 · 夢露和愛因斯坦混合照

重點摘要

防 AI 爬取字體 Decoy Font 問世,靈感源於瑪麗蓮·夢露和愛因斯坦混合照 隨著生成式人工智慧快速發展,網站與社群平台上的文字內容經常被爬蟲程式大量擷取,用以訓練大型語言模型。為了對抗這股趨勢,字體設計團隊 Mixfont 於 7 月 15 日發表一款名為 Decoy Font 的新字體,採用獨特的視覺欺騙技術,讓 AI 難以正確讀取文字,同時人類肉眼卻能輕鬆辨識。 這款字體以 TTF(TrueType 字體)格式釋出,使用者可以像安裝任何一般字體一樣,在作業系統、文書處理軟體、設計工具或網頁中直接套用。

站內 AI 整理稿

防 AI 爬取字體 Decoy Font 問世,靈感源於瑪麗蓮·夢露和愛因斯坦混合照

隨著生成式人工智慧快速發展,網站與社群平台上的文字內容經常被爬蟲程式大量擷取,用以訓練大型語言模型。為了對抗這股趨勢,字體設計團隊 Mixfont 於 7 月 15 日發表一款名為 Decoy Font 的新字體,採用獨特的視覺欺騙技術,讓 AI 難以正確讀取文字,同時人類肉眼卻能輕鬆辨識。這款字體以 TTF(TrueType 字體)格式釋出,使用者可以像安裝任何一般字體一樣,在作業系統、文書處理軟體、設計工具或網頁中直接套用。透過標準的 TrueType 編碼,Decoy Font 保留了完整的文字輸入與排版功能,但實際顯示時卻藏有玄機。

Decoy Font 的核心技術來自「混合圖像」(hybrid images)概念,這個領域最為人熟知的範例,是將愛因斯坦與瑪麗蓮·夢露的肖像融合為一張圖片:近距離觀看會看到愛因斯坦,當退遠一步,瑪麗蓮·夢露的臉孔便浮現出來。Decoy Font 運用相同的視覺原理,在每個字母的輪廓內疊加了兩組不同空間頻率的資訊。根據 Mixfont 的說明,多數 AI 系統在讀取圖像中的文字時,主要依賴近距離的像素資訊。當一張包含 Decoy Font 的文字圖片被輸入大型語言模型時,模型會優先擷取前景中銳利度較高、邊緣清晰的「誘餌字母」,而這些誘餌字母其實是刻意設計的干擾訊號。

真正的訊息則隱藏在較低空間頻率的圖層裡,人類在稍微拉開距離觀看時,大腦會自動補償並辨識出正確的文字。Mixfont 工程師 Eric Lu 表示:「每個真實的字母都隱藏在一個誘餌字母後面,這樣 AI 就很難讀出真正的消息。」他進一步解釋,這套方法不會影響一般使用者的閱讀體驗,只要螢幕與眼睛維持適當距離,人類視覺系統就能自動過濾誘餌圖層,直接看到正確的內容。值得注意的是,Decoy Font 並非透過加密或封鎖技術來防止爬取,而是利用人類與機器在視覺處理機制上的根本差異。AI 模型在處理圖像文字時,通常會先將影像縮小、取樣,並提取高頻邊緣特徵,這恰好會讓誘餌文字成為模型最先注意到的對象。

人類視覺則擅長從低頻資訊中整合整體形狀,因此不會被誘餌干擾。這款字體的推出,正值各界對 AI 訓練資料來源的爭議日益升溫。許多內容創作者與網站管理者開始尋求方法,避免自己的文字被未經授權地用於訓練商業模型。傳統的反爬蟲手段如驗證碼、機器人檢測或 robots.txt 協定,往往只能阻擋部分自動化程式,且可能影響正常使用者體驗。Decoy Font 提供了一種不改變網頁結構、不影響可讀性的新思路。目前 Decoy Font 以 TTF 格式免費提供下載,可在 Windows、macOS、Linux 等常見作業系統中安裝使用。由於採用標準字型封裝,它也相容於絕大多數網頁排版與設計軟體。

使用者只需將字型檔案安裝到系統字型庫,再於文書處理或設計程式中選用該字型,即可在靜態圖片或螢幕截圖中觸發誘餌效果。不過,Mixfont 也坦言,這項技術並非萬能。如果 AI 系統特意針對這類混合圖像進行優化,或採用多尺度分析、深度學習去卷積等更複雜的影像解析方法,仍有可能破解誘餌。但對於目前主流的大型語言模型和光學字元辨識(OCR)引擎而言,Decoy Font 已能產生顯著的干擾效果。業界人士認為,Decoy Font 的出現反映出人工智慧與反制技術之間的軍備競賽已從單純的網路協議層面,延伸到視覺感知的領域。

隨著模型越來越依賴螢幕截圖、網頁快照等非結構化資料進行訓練,類似 Decoy Font 的「知覺防禦」工具可能成為內容保護的新選項。Mixfont 團隊也計畫在未來推出更多字重與字型的變體,並開放原始碼供社群貢獻改良。對於擔心文字被 AI 爬取的一般使用者或企業來說,這款字體提供了一個低門檻、高相容性的解決方案,不必修改網站後端,也不必犧牲閱讀品質。只要在輸出圖像或網頁排版時選用 Decoy Font,就能讓 AI 讀到的文字與人類看到的內容出現分歧。隨著 AI 模型的訓練資料競爭愈演愈烈,從字體層面進行對抗,或許會成為未來內容保護的常態工具之一。

而 Decoy Font 從混合圖像經典案例中獲得的靈感,正好說明了人類視覺的獨特優勢,也能反過來被運用在數位內容的防護上。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

15 分鐘前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

1 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

1 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

1 小時前