OpenAI 之後又是 Anthropic,Claude 將攻擊延伸至公共互聯網

2026年8月28日 16:56
OpenAI 之後又是 Anthropic,Claude 將攻擊延伸至公共互聯網
站內 AI 整理稿

繼 OpenAI 之後,又一家人工智慧實驗室正式將旗下模型的觸角伸向公共互聯網。這次的主角是 Anthropic,其明星產品 Claude 被賦予了一項全新能力——將攻擊行動從封閉的測試環境,延伸至開放的網路空間。這項變革的意義在於,AI 不再只是被動回應指令的工具,而是可以主動在真實網路中執行任務、尋找目標,甚至發起攻擊的自主代理。Anthropic 此舉顯然是為了強化 Claude 在真實世界中的實戰能力。過去,AI 安全測試大多在模擬環境或受控場域中進行,研究人員可以預先設定各種參數,觀察模型如何應對已知威脅。

然而,真實網路的複雜度遠非測試環境所能比擬,無論是層出不窮的防禦機制、瞬息萬變的網路流量,還是無法預期的突發狀況,都是實驗室中難以完整重現的挑戰。透過讓 Claude 直接面對公共互聯網上的各種考驗,Anthropic 希望能藉此蒐集更多第一手數據,進而調整模型在動態環境中的決策品質與應變速度。這並非單純的壓力測試,而是讓 AI 在真實對抗中學習如何判斷情勢、權衡風險,並在必要時採取行動。對 Anthropic 而言,唯有讓 Claude 真正走進網路世界的戰場,才能驗證其安全機制是否足以應付現實中的嚴峻考驗。事實上,Anthropic 並非第一個踏上這條路的業者。

在此之前,OpenAI 已經率先進行了類似嘗試,將旗下模型投入公共網路進行攻擊演練。如今 Anthropic 跟進,顯示整個 AI 產業對「真實環境測試」的態度正在發生根本性的轉變。過去被視為高風險、甚至帶有爭議的做法,如今正逐漸成為評測模型效能的必要環節。從產業發展的角度來看,這股趨勢反映了 AI 競爭日益激烈的現實。各家實驗室不再滿足於讓模型在基準測試中取得高分,而是更注重模型在實際應用場域中的表現。尤其近年來,AI 代理(AI agent)的概念迅速崛起,模型不再只是回答問題的聊天機器人,而是被賦予執行複雜任務的能力。若要讓這些代理在真實世界中可靠運作,就必須讓它們接受真實環境的洗禮。

然而,這也引發了安全與倫理層面的討論。讓 AI 在公共網路上主動發起攻擊,是否可能失控?一旦模型在真實環境中做出錯誤判斷,後果由誰承擔?這些問題並沒有簡單的答案。Anthropic 與 OpenAI 選擇將測試場域擴展至公共網路,無疑是希望在嚴謹的安全研究與實際效能提升之間取得平衡。值得注意的是,Anthropic 一向以 AI 安全為核心訴求,其「憲法式 AI」(constitutional AI)路線強調讓模型遵循明確的行為準則。如今讓 Claude 進入真實網路進行攻擊演練,表面上看似與其安全優先的形象有所出入,但實際上,這正是安全研究的一環。

唯有在真實環境中暴露問題,才能進一步修補模型的漏洞與盲點。從技術層面來看,真實網路的測試能為 Claude 提供極為豐富的學習素材。與模擬環境中的固定腳本不同,真實網路上充滿了各種防禦軟體、入侵偵測系統、人為操作模式與異常流量。這些變數讓 Claude 必須在高度不確定的環境中做出決策,而每一次的成功與失敗,都能成為後續模型調整的重要依據。對整個 AI 產業而言,OpenAI 與 Anthropic 的接連行動,等於宣告了一個新時代的來臨。AI 模型的評測標準,正從「能不能在考試中拿高分」逐漸轉向「能不能在真實世界中解決問題」。

這也意味著,未來的 AI 開發者必須更加重視模型的自主性、適應力與即時判斷能力。當然,這並不代表模擬測試將被完全淘汰。模擬環境仍然具有不可取代的價值,例如可以在安全的前提下重現特定類型的攻擊場景,或是進行大量重複性的回歸測試。但可以預見的是,真實環境測試將成為 AI 開發流程中越來越重要的一環,與模擬測試形成互補。回到 Anthropic 本身,這次讓 Claude 走向公共網路的決定,不僅是技術層面的突破,更是一項戰略布局。在 OpenAI 已經搶先一步的情況下,Anthropic 必須證明 Claude 在真實作戰環境中同樣具備競爭力。

透過直接面對公共互聯網的考驗,Claude 將有機會累積更多實戰經驗,進而縮小與競爭對手之間的差距。整體而言,AI 從實驗室走向開放的網路空間,已是無法逆轉的趨勢。無論是 OpenAI 還是 Anthropic,都在為下一代 AI 代理鋪路。這些模型將不再只是被動的輔助工具,而是能夠在複雜環境中獨立作業的數位行動者。對於使用者而言,這意味著 AI 將能承擔更多過去必須由人類親自執行的任務;而對於開發者而言,確保這些自主代理在真實世界中安全可靠地運作,將是未來最艱鉅的挑戰之一。

Related

相關文章

IT之家生成式AI

真香:《我的世界》創始人佩爾松承認自己早期拒絕 AI 編程“可能錯了”

作者:清源 責編:清源 評論: 8 月 28 日消息,據《商業內幕》今天(28 日)報道,《我的世界》創作者、億萬富翁馬庫斯 · 佩爾松對 AI 的態度發生了徹底轉變。以“Notch”之名廣為人知的佩爾松,過去曾堅決反對用 AI 編程。今年 1 月,他甚至寫道:“(AI 編程)仍然是個糟糕透頂的主意,任何鼓吹這種做法的人,不是無能就是邪惡。

剛剛
鈦媒體生成式AI

ChatGPT報警後:誰有權審判你的對話框?

腦極體2026.08.28 16:07 · 來自天津全文3780字00:00 / 11:54發現罪犯的AI,該不該報警?文 | 腦極體你敢相信,向AI吐露的私密想法,有一天會被直接遞交給執法部門嗎?在美國就發生了這樣一樁顛覆認知的事件。一名前高盛分析師在對話中向ChatGPT完整描述謀害前女友的犯罪計劃,OpenAI安全系統識別高危內容後,主動向FBI提交線索,當事人最終認罪獲刑。從結果來看,一場明確的預謀惡性案件被提前阻斷,但在行業規則、法律邊界、隱私權益層面,ChatGPT主動報警留下的爭議遠大於成果。

剛剛
IT之家生成式AI

Pro 和 Flash 系列“冰火兩重天”,曝谷歌內部開始測試 Gemini 3.8 Flash 模型

作者:清源 責編:清源 評論: 8 月 28 日消息,谷歌本月才剛發佈新模型,下一款就已經進入員工測試階段,部分谷歌員工開始試用 Gemini 3.8 Flash 預覽版。據《商業內幕》今天(28 日)報道,為了追趕 OpenAI 和 Anthropic,谷歌正在以數週為間隔快速更新模型,AI 競賽的節奏也由此可見一斑。

剛剛