大廠商戰下狠手,Meta被曝給競爭對手AI“投毒”

2026年7月6日 12:09
大廠商戰下狠手,Meta被曝給競爭對手AI“投毒”

重點摘要

《連線》雜誌調查揭露,Meta 長期執行名為「戛納計劃」的秘密項目,僱用數百名承包商偽裝成未成年人,向 OpenAI、Google 及 Character.AI 等競爭對手的 AI 發送超過 45,000 條高風險誘導性提問。Meta 回應稱此舉為負責任的行業標準做法,但該行動被視為大廠之間以安全為名進行商業攻擊的案例。

站內 AI 整理稿

科技巨頭之間的競爭早已白熱化,如今更傳出令人震驚的商業暗戰手法。根據《連線》(WIRED)雜誌的最新調查報導,社群媒體龍頭Meta被揭露長期執行一項名為「戛納計劃」(Cannes)的秘密項目,疑似透過系統性「投毒」方式,針對競爭對手的AI模型進行大規模誘導攻擊,試圖破壞其安全防護機制。這項代號充滿法國蔚藍海岸氣息的秘密行動,核心內容是僱用數百名外包承包商,偽裝成未成年使用者,向OpenAI的ChatGPT、Google的Gemini以及Character.AI等主流AI平台,發送超過四萬五千條涉及自殺、性暴力、毒品等高度敏感且具誘導性的提問。

這些提問刻意設計成觸及AI安全審查的紅線,目的在於測試對手模型的應對能力,甚至可能導致其產生不當回應。Meta對此調查的回應態度相當強硬。公司發言人公開表示,這項行動完全是「一種負責任的、行業標準的做法」,強調其目的是為了測試AI系統的安全性,並非惡意攻擊。然而,這番說法並未平息外界的質疑,反而讓這場以「安全測試」為名的商業互剿內幕,更加引人關注。根據調查報導,「戛納計劃」主要由Meta委託第三方外包承包商Covalen負責執行。直到2026年4月21日,這個項目仍在持續運轉。

為了避開競爭對手的安全監測系統,數百名外包員工必須使用臨時創建的Gmail或Outlook郵箱地址,並搭配共享密碼,批量偽造姓名、出生日期等符合未成年人特徵的虛假帳戶,以確保行動的隱蔽性。這些精心偽裝的虛擬帳號,會向目標AI平台發送大量經過設計的危險提問。例如,詢問如何進行自殘、如何取得非法藥物,或是描述性暴力場景等。這些內容不僅觸及AI倫理與安全的核心紅線,更可能導致模型在訓練或回應時產生偏差,甚至被迫學習不當的應對模式。業界人士分析,這種行為若屬實,已不僅是單純的「紅隊測試」(Red Teaming,指模擬攻擊者測試系統安全性的專業行為),而是帶有明顯商業打擊意圖的「投毒」行動。

透過大量誘導性輸入,Meta可能試圖讓競爭對手的AI模型在處理敏感話題時表現失常,進而損害其品牌信譽與使用者信任。值得注意的是,Meta本身也擁有自家的AI模型Llama系列。在AI軍備競賽中,各家公司無不投入巨資確保模型的安全與合規。然而,此次事件卻揭露了科技巨頭在「安全」大旗下,可能隱藏著更為複雜的商業算計。當一家公司以測試為名,系統性地向對手發起攻擊,整個產業的生態平衡與公平競爭原則都將受到嚴峻挑戰。對於這項指控,OpenAI、Google與Character.AI目前尚未發表正式回應。但可以預見的是,這起事件將進一步加劇AI領域的緊張局勢。

監管機構也可能因此重新審視現行的AI安全測試規範,是否已成為大廠之間相互傾軋的工具。從更宏觀的角度來看,「戛納計劃」的曝光,也凸顯了AI產業在快速發展過程中,缺乏一套公認且透明的安全測試標準。當各家企業各自定義「負責任的做法」時,所謂的「行業標準」很容易淪為攻擊對手的藉口。這不僅損害使用者權益,更可能拖慢整個AI技術的健康發展。目前,Meta尚未公布「戛納計劃」的具體起始時間與總投入成本。但根據《連線》取得的內部文件顯示,該計劃規模龐大,且執行細節極為縝密,顯然經過長期規劃與資源投入。這也讓外界更加懷疑,Meta是否早已將「安全測試」視為一種商業競爭的戰略武器。

隨著調查持續深入,這場由「投毒」風波引發的科技大戰,恐怕才剛揭開序幕。未來,AI產業的競爭將不再只是技術與算力的比拼,更可能演變為一場圍繞安全、倫理與商業道德的全面角力。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

33 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前