開源反派 Anthropic也有性價比?

2026年7月27日 07:57
開源反派 Anthropic也有性價比?

重點摘要

Anthropic發布Claude Opus 5,性能逼近Fable 5但價格僅為後者一半,首次公開強調性價比優勢。然而,隨著開源模型崛起與業界開源倡議聲浪高漲,Anthropic長期堅持的閉源路線面臨越來越大的壓力與質疑。

站內 AI 整理稿

Anthropic 於北京時間 7 月 25 日凌晨正式發表 Claude Opus 5,並罕見地主打性價比。這款新模型標榜其智慧表現已逼近該公司旗下最強旗艦 Fable 5,但價格卻只有後者的一半。這可能是 Anthropic 首次公開將自家模型的成本優勢作為核心賣點,反映出頂尖 AI 模型市場的競爭正在從單純的性能比拼,轉向性能與成本的平衡。Claude Opus 5 的定價為每百萬輸入 Token 5 美元、輸出 Token 25 美元,與前代 Opus 4.8 完全相同,但性能卻有顯著提升。即便與 OpenAI 的 GPT-5.6 Sol 相比,Opus 5 在輸出價格上仍低了 16.

7%,輸入價格則持平。Anthropic 強調,Opus 5 是專為日常使用場景設計,效率遠高於其他同級模型。根據 Artificial Analysis 的測試結果,Opus 5 的綜合智能指數與 Fable 5 幾乎不相上下,在部分智慧型代理與知識工作測試中甚至領先,而平均任務成本則低了 26%。這波降價壓力的背景,與中國開源模型的崛起密切相關。就在不久前,中國大模型公司月之暗面發表了擁有 2.8 萬億參數的開源模型 Kimi K3,其性能與 Fable 5 及 GPT-5.6 Sol 十分接近,價格卻顯著更低,一度引發美國科技產業的恐慌,被視為「DeepSeek 2.0」事件。

這股來自開源陣營的衝擊,讓原本憑藉編程場景優勢而維持高價的 Anthropic 不得不重新審視定價策略。過去,Anthropic 的模型因為在程式碼生成等領域表現突出,長期享有溢價,甚至在今年初其收入一度反超用戶體量比自己大數倍的 OpenAI。然而,隨著頂尖模型之間的性能差距逐漸縮小,企業客戶開始緊縮 Token 支出,Anthropic 的價格優勢問題便浮上檯面。更早之前的 Opus 4 模型曾定價高達每百萬輸入 15 美元、輸出 74 美元,直到去年底的 Opus 4.5 才大幅降價三分之二,並維持在 5/25 美元的水平至今。

如今 Opus 5 的問世,意味著 Anthropic 終於在價格與性能之間找到了新的平衡點。Opus 系列曾經是 Anthropic 旗下性能最強、價格最高的模型,但在今年 Mythos 及 Fable 模型推出後,Opus 的地位似乎有所動搖。部分更新如 4.7 版本甚至引發開發者集體吐槽,認為越更新越退步,一度讓人懷疑 Anthropic 是否將資源全部轉移到 Fable 模型上。Fable 5 於今年 6 月正式發布,性能確實大幅超越同期 Opus 4.

8,迄今仍為市面上最強模型,但高昂的定價與更高的 Token 消耗,加上 Anthropic 一貫以安全為由的降級操作,反而讓這款最強模型收穫了大量不滿。Opus 5 的推出被視為 Anthropic 的一次撥亂反正。不同於過去每次發布 Opus 系列時總是強調性能如何強悍,這次 Anthropic 開宗明義就說「智能水平接近 Claude Fable 5,但價格只有一半」,顯然是怕再把開發者們嚇跑。

在多項編碼與知識工作測試中,包括 Frontier-Bench 和 GDPval-AA,Opus 5 甚至超越了 Fable 5,被 Anthropic 稱為 SOTA 模型,僅在網路安全任務上稍顯落後。就連中國人民的老朋友馬斯克也對 Opus 5 發出「Very impressive」的讚美,不過他也補了一句,強調自家 Grok 即將發布的 4.5 模型將更具性價比。更重要的仍然是成本。Anthropic 特別強調,Opus 5 在前代 Opus 4.8 相同的成本下實現了更優的性能,完成相同任務所需的 Token 數量更少,平均成本比 Opus 4.8 降低約 30%。

例如在 CursorBench 3.2 測試中,最高推理強度下 Opus 5 的表現與 Fable 5 峰值成績相差不到 0.5%,但單任務成本只有後者一半;在 OSWorld 2.0 測試中,Opus 5 甚至以約三分之一的成本超過了 Fable 5 的最佳成績。此外,Anthropic 還為 Opus 5 加入了五檔推理強度,讓開發者能根據任務複雜程度調整計算量,即使在最高推理檔下,平均單任務成本 2.03 美元仍低於 Fable 5 的 2.75 美元。Opus 5 獲得的好評明顯高於前代 Opus 4.

8,許多開發者認為它更適合作為日常開發的主力模型,有人甚至直言「Fable 5 基本死了」。不過,Anthropic 仍然沒有停止降級策略,Opus 5 部分情況下仍會靜默切換至 Opus 4.8,這也延續了該公司一貫的爭議做法。Anthropic 被迫轉向性價比的背後,是整個 AI 行業的趨勢變化。大模型行業與消費電子產品有些相似,上一代旗艦模型的能力會不斷下放至更便宜的產品線,成本也隨之下降。但 Opus 5 並非簡單的能力下放,因為它在 Fable 5 發布僅一個多月後就以更低成本追平性能,這與過去需要等待一輪甚至數輪迭代的情況截然不同。

部分原因與 Fable 過於昂貴有關,即便當前 Token 價格較幾年前已大幅下滑,但由於 Agent 的 Token 消耗量更高,企業的 AI 支出不降反升,負擔日益加重。Fable 5 雖然性能出色,卻很難作為企業大規模調用的基礎模型。《華爾街日報》上個月報導指出,「AI 價格戰已全面打響」,大公司和初創公司越來越多轉向廉價的開源模型,令 OpenAI 和 Anthropic 面臨降價壓力。最直觀的壓力來自於中國開源模型,例如 Fable 5 的價格是 DeepSeek-V4 Pro 的 50 多倍。

AI 模型聚合平臺 OpenRouter 的數據顯示,自 5 月中旬以來 DeepSeek 一直是平臺 Token 使用量最高的 AI 公司,2025 年秋季至 2026 年春季,開源模型的 Token 使用量增速達到閉源模型的四倍,已有超過 500 家機構棄用專有模型轉向開源。Cursor 公司 CEO 邁克·薩克斯形容,性能最強的模型並非日常任務的必需品,「就像開著蘭博基尼去雜貨店買牛奶,而這款車本該用於賽道競速。」美國企業過去的潮流是 Token maxxing,如今新趨勢則是 Thrift-maxxing,極致省錢。公司不再把所有請求交給最貴模型,而是混合使用不同廠商和不同等級的模型。

Anthropic 超過八成收入來自企業客戶,更容易受到這波轉向影響。今年 5 月,微軟在內部叫停使用 Claude Code,原因之一就是 Token 過於高昂;亞馬遜也在減少 Claude 的調用,將更多請求路由至自研模型,並透過緩存和確定性程序處理簡單任務。此外,OpenAI 也正計劃大幅降價,試圖從 Anthropic 手中爭奪客戶。Opus 5 或許只是 Anthropic 轉向性價比的開始。隨著 Fable 及 Opus 模型相繼迭代至 5 代,更低等級的 Sonnet 及 Haiku 模型也將很快升級,同時價格會更低。

然而,Anthropic 一直以來都是美國科技界最反對開源模型的公司之一,長期強調模型權重安全、災難性風險測試和出口管制,甚至動輒指責中國開源模型「蒸餾攻擊」自家模型,並遊說美國政府封禁中國開源模型。如今,連微軟、OpenAI、Meta、英偉達等 AI 產業鏈核心企業都開始公開支持開放生態,Anthropic 的閉源路線正面臨前所未有的壓力。英偉達 CEO 黃仁勳在 X 平臺上發布了一封 AI 開源倡議書,強調美國在 AI 領域的領導地位不應只取決於一個最先進的閉源模型,而在於能否構建一個深入各行業的開放生態系統。

該倡議書發布之初就獲得微軟、Meta、IBM、a16z 等 24 家企業支持,隨後兩天內又新增 OpenAI、Google、GitHub 等 23 家,聯名企業擴大至 50 家。馬斯克雖尚未簽署,但也第一時間轉發表示「我完全支持」。截至發稿,Anthropic 仍未回應黃仁勳的開源倡議。不過,該公司一位研究員 Julian Schrittwieser 在社交媒體上公開揶揄黃仁勳,稱「期待 CUDA 和 GPU 驅動的開源」,並嘲諷微軟 CEO 納德拉的支持行為,說「太期待 Windows 和 MS Office 的開源了」。

這些言論迅速引發反對聲浪,有評論認為黃仁勳的倡議書更多是強調允許開源模型存在,而非強迫閉源公司轉向,但 Anthropic 似乎總是傾向於與整個開源世界對立。Huggingface 聯合創始人兼 CTO Julien Chaumond 表示,他不討厭 Anthropic,Anthropic 完全有權利不開源,但指出他們那些糟糕的觀點也是合情合理的。更早之前,馬斯克曾評價 Anthropic 的價值觀「反人類且邪惡」,指其 AI 厭惡特定群體。如今,隨著 Opus 5 的發布與開源浪潮的推進,Anthropic 不僅要在性能與價格之間找到平衡,更要在價值觀與市場趨勢之間做出抉擇。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

39 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前