Claude給閉源軍團再扣一分

2026年7月28日 18:16
Claude給閉源軍團再扣一分

重點摘要

Anthropic 旗下的 Claude 模型在最新一輪安全評測中表現亮眼,進一步衝擊了閉源 AI 陣營的市場信心,導致其安全估值遭遇重大打擊。過去一段時間,閉源 AI 廠商多以封閉系統與商業機密作為護城河,強調自身模型的安全性與可控性,但 Claude 在透明性與對抗攻擊方面的測試結果,讓外界開始重新評估閉源路線的實際防護能力。

站內 AI 整理稿

Anthropic 旗下的 Claude 模型在最新一輪公開安全評測中交出亮眼成績,不僅再次凸顯開源路線在防護能力上的優勢,也讓市場對於封閉式 AI 陣營的信任基礎出現鬆動。過去幾年,多家閉源廠商將封閉系統與商業機密視為核心護城河,反覆強調唯有不公開模型權重與訓練細節,才能確保產品不會被惡意破解或濫用。然而,Claude 在透明性與對抗攻擊測試中的實際表現,直接挑戰了這套論述的合理性。在這輪評測中,Claude 於常見的紅隊攻擊場景中展現出更低的漏洞率,代表其對於刻意誘導、對抗性輸入的抵禦能力勝過不少閉源競品。

更值得注意的是,Anthropic 選擇公開部分評估流程與測試方法,讓第三方研究機構能夠獨立驗證結果,這項做法反而為模型贏得了更高的信任度。相比之下,部分閉源廠商至今仍拒絕披露安全測試的具體細節,使得外界難以判斷其宣稱的防護水準是否屬實。安全估值的變化,已經開始反映在閉源廠商近期的融資與市場話語權上。投資人逐漸重新審視「封閉等於安全」這個邏輯是否真正成立,因為 Claude 的例子證明,開放模型架構與安全機制並不一定互相矛盾,甚至可能因為接受更廣泛的外部檢驗而提升整體防禦韌性。

當一個開源或半開源的模型能夠在實測中勝過許多封閉產品,那麼閉源陣營長期以來以安全為由拒絕開放的說法,就顯得難以自圓其說。這波評測結果也讓外界對那些以安全為理由拒絕開源的閉源產品產生更多疑問。若封閉系統無法提供比 Claude 更優異的實測保護,那麼這些廠商所依賴的商業機密與封閉生態的溢價空間,恐怕將進一步被壓縮。市場原本願意為「封閉即安全」支付較高成本,但當證據顯示開放模型同樣可以達到甚至超越相同水準時,這項溢價的合理性便開始動搖。從技術層面來看,Claude 的防護優勢並非來自於隱藏模型細節,而是來自於系統性的對抗訓練與持續的紅隊測試。

Anthropic 在安全研究上的投入,包括建立專門的測試團隊、設計多層次過濾機制,以及定期公開評估報告,這些做法都有助於模型在真實攻擊面前保持穩定。相反地,部分閉源廠商因為不願公開測試流程,反而讓外界難以判斷其安全機制是否真正有效,甚至可能隱藏了尚未被發現的弱點。投資人與客戶的態度正在發生微妙轉變。過去,許多企業在選擇 AI 模型時,直覺認為閉源產品因為不公開權重,所以較難被惡意使用者破解或改寫。但這項假設忽略了一個關鍵事實:封閉系統並不等於免疫攻擊,反而可能因為缺乏外部審查而讓漏洞長期存在。Claude 的案例提醒市場,安全性的優劣最終應由實測數據來決定,而非由封閉或開放的形式來標籤。

對於開源社群而言,Claude 的表現無疑是強心針。長期以來,開源 AI 模型在能力上經常被認為落後於閉源產品,但安全評測的結果顯示,開源路線在防護層面其實有獨特優勢。當更多研究人員能夠檢視模型的行為、測試其邊界、提出改進建議,模型的整體韌性反而會隨著時間累積而增強。這與閉源模型「黑箱式」的安全維護形成鮮明對比。當然,這並不意味著開源模型就完全沒有風險。開放權重確實可能讓惡意使用者更容易部署或改造模型,但 Claude 的經驗指出,只要建立完善的安全評估框架與使用規範,開放與安全之間並非零和關係。

Anthropic 的做法顯示,公開部分評估流程,同時保留對模型權重的適當控制,或許是一條值得更多廠商考慮的中間路線。市場分析師指出,這波評測結果可能加速 AI 產業的安全標準化進程。如果越來越多的第三方評測機構採用類似 Claude 的公開測試方法,那麼閉源廠商將難以再用「安全機密」作為拒絕接受外部檢驗的藉口。投資人也會更傾向於支持那些願意接受透明檢驗的團隊,因為這類團隊的產品往往具備更可靠的安全記錄。從更宏觀的角度看,Claude 的成績不僅是 Anthropic 一家公司的勝利,更代表著一種新的安全哲學正在崛起:信任來自於驗證,而非來自於隱藏。

過去閉源陣營所建構的「封閉護城河」,在公開、可重現的評測數據面前,顯得越來越脆弱。當客戶與監管機構都開始要求更透明的安全標準時,那些仍然堅持黑箱操作的廠商,可能在下一輪競爭中喪失話語權。目前,業界已經有部分閉源廠商開始調整策略,試圖在保密與透明之間找到平衡。例如,有些公司開始釋出部分安全測試報告,或邀請外部研究團隊進行有限度的紅隊演練。但這些做法是否足以重建市場信心,仍取決於其實際成效能否與 Claude 的表現相匹配。如果閉源產品無法在下次評測中拿出更有說服力的數據,其安全溢價的縮水恐怕只是時間問題。總體而言,Claude 在最新安全評測中的成功,為 AI 產業提供了一個重要的參考案例。

它證明開放路線並不等於安全妥協,反而可能因為接受更廣泛的檢驗而變得更強韌。對於閉源廠商而言,這份評測結果無疑是一記警鐘:在數據驅動的時代,空洞的安全口號已經無法說服市場,唯有實實在在的防護成績,才能贏得客戶與投資人的信任。

Related

相關文章

一年砸下110億美元,比紅杉還兇,白宮才是AI圈最猛投資人

美國白宮過去一年在AI領域投入110億美元,規模超越紅杉資本等傳統創投,顯示政府正以國家級資源全面押注AI產業。這筆資金分散於多個聯邦機構,涵蓋基礎模型訓練、醫療及氣候應用等關鍵環節,並強調負責任AI開發。此舉反映美國對維持全球AI領導地位的危機感,但也引發市場機制扭曲與技術商業化延緩的疑慮。

剛剛

一口氣發佈三款教育插件,OpenAI教育產品再升級

OpenAI 推出三款教育插件,分別為課程助手、作業輔導員與互動學習夥伴,旨在協助教師備課與學生自主學習。這些工具整合至教育版平台,強調引導式學習而非直接給答案,並內建防護機制避免學生過度依賴。OpenAI 計畫未來加強多語言支援與特殊教育需求,持續深化教育科技布局。

剛剛

騰訊、字節、阿里,搶著給打工人配「AI助理」

騰訊、字節跳動與阿里巴巴三大中國科技巨頭,近期紛紛推出或升級企業級AI助理,目標是提升白領工作效率。各家AI助理的競爭重點從回答問題轉向執行任務,並分別強調跨應用串聯、主動式智慧與企業級安全等不同特色。儘管面臨資料隱私與AI幻覺等挑戰,但市場調查顯示超過六成中國企業計劃在一年內導入AI辦公工具。

剛剛

推行AI提效後,策劃們開始加班趕工期

當AI開始重寫小遊戲生產流程,真正的變化何時發生?這個問題在近期引發了業界廣泛討論。隨著人工智慧技術逐步滲透進創意與策劃領域,許多公司開始導入AI工具來提升工作效率,然而實際情況卻與預期有所出入。部分策劃人員反映,在推行AI提效後,他們不僅沒有減少工作量,反而因為系統調整與流程磨合,導致加班趕工期的現象頻繁出現。 這場變革的起點,源自於企業對AI生產力的高度期待。許多遊戲開發與內容製作公司,尤其是中小型團隊,紛紛導入AI輔助工具,試圖透過自動化生成文案、腳本、美術素材甚至程式碼,來縮短專案週期。

4 分鐘前

DeepSeek大漲價,Token價格戰終於要結束了?

DeepSeek大幅調漲API服務價格,引發市場對AI模型價格戰是否結束的討論。業界分析指出,漲價反映營運成本壓力與市場定位調整,可能代表中國AI產業從低價競爭轉向追求盈利與可持續發展。未來競爭焦點將從價格轉向模型效果與生態系統完整性,但漲價能否終結價格戰仍取決於市場供需與競爭對手反應。

32 分鐘前

狂攬130億!英偉達投的AI基建獨角獸又融資了

澳洲AI基礎設施獨角獸Firmus宣布完成20億美元(約136億人民幣)戰略股權融資,現有投資方英偉達與Coatue持續參投,並新增黑石旗下基金及Jane Street。該公司專注於設計、建設及營運AI工廠,核心產品HyperCube整合供電、液冷與伺服器機架,並提供GPU雲端算力服務。英偉達透過股權投資與技術合作,協助Firmus擴張亞太地區AI數據中心,同時擴大其晶片與計算架構的市場覆蓋。

36 分鐘前