開源反派 Anthropic也有性價比?

重點摘要
Anthropic發布Claude Opus 5,性能逼近Fable 5但價格僅為後者一半,首次公開強調性價比優勢。然而,隨著開源模型崛起與業界開源倡議聲浪高漲,Anthropic長期堅持的閉源路線面臨越來越大的壓力與質疑。
Anthropic 於北京時間 7 月 25 日凌晨正式發表 Claude Opus 5,並罕見地主打性價比。這款新模型標榜其智慧表現已逼近該公司旗下最強旗艦 Fable 5,但價格卻只有後者的一半。這可能是 Anthropic 首次公開將自家模型的成本優勢作為核心賣點,反映出頂尖 AI 模型市場的競爭正在從單純的性能比拼,轉向性能與成本的平衡。Claude Opus 5 的定價為每百萬輸入 Token 5 美元、輸出 Token 25 美元,與前代 Opus 4.8 完全相同,但性能卻有顯著提升。即便與 OpenAI 的 GPT-5.6 Sol 相比,Opus 5 在輸出價格上仍低了 16.
7%,輸入價格則持平。Anthropic 強調,Opus 5 是專為日常使用場景設計,效率遠高於其他同級模型。根據 Artificial Analysis 的測試結果,Opus 5 的綜合智能指數與 Fable 5 幾乎不相上下,在部分智慧型代理與知識工作測試中甚至領先,而平均任務成本則低了 26%。這波降價壓力的背景,與中國開源模型的崛起密切相關。就在不久前,中國大模型公司月之暗面發表了擁有 2.8 萬億參數的開源模型 Kimi K3,其性能與 Fable 5 及 GPT-5.6 Sol 十分接近,價格卻顯著更低,一度引發美國科技產業的恐慌,被視為「DeepSeek 2.0」事件。
這股來自開源陣營的衝擊,讓原本憑藉編程場景優勢而維持高價的 Anthropic 不得不重新審視定價策略。過去,Anthropic 的模型因為在程式碼生成等領域表現突出,長期享有溢價,甚至在今年初其收入一度反超用戶體量比自己大數倍的 OpenAI。然而,隨著頂尖模型之間的性能差距逐漸縮小,企業客戶開始緊縮 Token 支出,Anthropic 的價格優勢問題便浮上檯面。更早之前的 Opus 4 模型曾定價高達每百萬輸入 15 美元、輸出 74 美元,直到去年底的 Opus 4.5 才大幅降價三分之二,並維持在 5/25 美元的水平至今。
如今 Opus 5 的問世,意味著 Anthropic 終於在價格與性能之間找到了新的平衡點。Opus 系列曾經是 Anthropic 旗下性能最強、價格最高的模型,但在今年 Mythos 及 Fable 模型推出後,Opus 的地位似乎有所動搖。部分更新如 4.7 版本甚至引發開發者集體吐槽,認為越更新越退步,一度讓人懷疑 Anthropic 是否將資源全部轉移到 Fable 模型上。Fable 5 於今年 6 月正式發布,性能確實大幅超越同期 Opus 4.
8,迄今仍為市面上最強模型,但高昂的定價與更高的 Token 消耗,加上 Anthropic 一貫以安全為由的降級操作,反而讓這款最強模型收穫了大量不滿。Opus 5 的推出被視為 Anthropic 的一次撥亂反正。不同於過去每次發布 Opus 系列時總是強調性能如何強悍,這次 Anthropic 開宗明義就說「智能水平接近 Claude Fable 5,但價格只有一半」,顯然是怕再把開發者們嚇跑。
在多項編碼與知識工作測試中,包括 Frontier-Bench 和 GDPval-AA,Opus 5 甚至超越了 Fable 5,被 Anthropic 稱為 SOTA 模型,僅在網路安全任務上稍顯落後。就連中國人民的老朋友馬斯克也對 Opus 5 發出「Very impressive」的讚美,不過他也補了一句,強調自家 Grok 即將發布的 4.5 模型將更具性價比。更重要的仍然是成本。Anthropic 特別強調,Opus 5 在前代 Opus 4.8 相同的成本下實現了更優的性能,完成相同任務所需的 Token 數量更少,平均成本比 Opus 4.8 降低約 30%。
例如在 CursorBench 3.2 測試中,最高推理強度下 Opus 5 的表現與 Fable 5 峰值成績相差不到 0.5%,但單任務成本只有後者一半;在 OSWorld 2.0 測試中,Opus 5 甚至以約三分之一的成本超過了 Fable 5 的最佳成績。此外,Anthropic 還為 Opus 5 加入了五檔推理強度,讓開發者能根據任務複雜程度調整計算量,即使在最高推理檔下,平均單任務成本 2.03 美元仍低於 Fable 5 的 2.75 美元。Opus 5 獲得的好評明顯高於前代 Opus 4.
8,許多開發者認為它更適合作為日常開發的主力模型,有人甚至直言「Fable 5 基本死了」。不過,Anthropic 仍然沒有停止降級策略,Opus 5 部分情況下仍會靜默切換至 Opus 4.8,這也延續了該公司一貫的爭議做法。Anthropic 被迫轉向性價比的背後,是整個 AI 行業的趨勢變化。大模型行業與消費電子產品有些相似,上一代旗艦模型的能力會不斷下放至更便宜的產品線,成本也隨之下降。但 Opus 5 並非簡單的能力下放,因為它在 Fable 5 發布僅一個多月後就以更低成本追平性能,這與過去需要等待一輪甚至數輪迭代的情況截然不同。
部分原因與 Fable 過於昂貴有關,即便當前 Token 價格較幾年前已大幅下滑,但由於 Agent 的 Token 消耗量更高,企業的 AI 支出不降反升,負擔日益加重。Fable 5 雖然性能出色,卻很難作為企業大規模調用的基礎模型。《華爾街日報》上個月報導指出,「AI 價格戰已全面打響」,大公司和初創公司越來越多轉向廉價的開源模型,令 OpenAI 和 Anthropic 面臨降價壓力。最直觀的壓力來自於中國開源模型,例如 Fable 5 的價格是 DeepSeek-V4 Pro 的 50 多倍。
AI 模型聚合平臺 OpenRouter 的數據顯示,自 5 月中旬以來 DeepSeek 一直是平臺 Token 使用量最高的 AI 公司,2025 年秋季至 2026 年春季,開源模型的 Token 使用量增速達到閉源模型的四倍,已有超過 500 家機構棄用專有模型轉向開源。Cursor 公司 CEO 邁克·薩克斯形容,性能最強的模型並非日常任務的必需品,「就像開著蘭博基尼去雜貨店買牛奶,而這款車本該用於賽道競速。」美國企業過去的潮流是 Token maxxing,如今新趨勢則是 Thrift-maxxing,極致省錢。公司不再把所有請求交給最貴模型,而是混合使用不同廠商和不同等級的模型。
Anthropic 超過八成收入來自企業客戶,更容易受到這波轉向影響。今年 5 月,微軟在內部叫停使用 Claude Code,原因之一就是 Token 過於高昂;亞馬遜也在減少 Claude 的調用,將更多請求路由至自研模型,並透過緩存和確定性程序處理簡單任務。此外,OpenAI 也正計劃大幅降價,試圖從 Anthropic 手中爭奪客戶。Opus 5 或許只是 Anthropic 轉向性價比的開始。隨著 Fable 及 Opus 模型相繼迭代至 5 代,更低等級的 Sonnet 及 Haiku 模型也將很快升級,同時價格會更低。
然而,Anthropic 一直以來都是美國科技界最反對開源模型的公司之一,長期強調模型權重安全、災難性風險測試和出口管制,甚至動輒指責中國開源模型「蒸餾攻擊」自家模型,並遊說美國政府封禁中國開源模型。如今,連微軟、OpenAI、Meta、英偉達等 AI 產業鏈核心企業都開始公開支持開放生態,Anthropic 的閉源路線正面臨前所未有的壓力。英偉達 CEO 黃仁勳在 X 平臺上發布了一封 AI 開源倡議書,強調美國在 AI 領域的領導地位不應只取決於一個最先進的閉源模型,而在於能否構建一個深入各行業的開放生態系統。
該倡議書發布之初就獲得微軟、Meta、IBM、a16z 等 24 家企業支持,隨後兩天內又新增 OpenAI、Google、GitHub 等 23 家,聯名企業擴大至 50 家。馬斯克雖尚未簽署,但也第一時間轉發表示「我完全支持」。截至發稿,Anthropic 仍未回應黃仁勳的開源倡議。不過,該公司一位研究員 Julian Schrittwieser 在社交媒體上公開揶揄黃仁勳,稱「期待 CUDA 和 GPU 驅動的開源」,並嘲諷微軟 CEO 納德拉的支持行為,說「太期待 Windows 和 MS Office 的開源了」。
這些言論迅速引發反對聲浪,有評論認為黃仁勳的倡議書更多是強調允許開源模型存在,而非強迫閉源公司轉向,但 Anthropic 似乎總是傾向於與整個開源世界對立。Huggingface 聯合創始人兼 CTO Julien Chaumond 表示,他不討厭 Anthropic,Anthropic 完全有權利不開源,但指出他們那些糟糕的觀點也是合情合理的。更早之前,馬斯克曾評價 Anthropic 的價值觀「反人類且邪惡」,指其 AI 厭惡特定群體。如今,隨著 Opus 5 的發布與開源浪潮的推進,Anthropic 不僅要在性能與價格之間找到平衡,更要在價值觀與市場趨勢之間做出抉擇。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。