Anthropic發佈Claude Opus5.5:任務成本降40%、輸出提速30%,9項測試7項領先GPT-6Astra
AI資訊AI新閒資訊正文Anthropic發佈Claude Opus5.5:任務成本降40%、輸出提速30%,9項測試7項領先GPT-6Astra發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :1分鐘Anthropic於9月23日凌晨發佈Claude5.5系列首款模型Opus5.5,官方稱多數任務表現與Fable5.1相當,默認設置下典型任務成本較上代Opus5降低40%,輸出速度提升超30%,已上線Claude及亞馬遜雲科技、谷歌雲、微軟Azure。官方公佈的9項測試中,Opus5.5有7項領先Fable5.1、Opus5及OpenAI的GPT-6Astra、GPT-5.6Sol。
三項編程測試均取得最高分:Terminal-Bench4.0達66.4%,FrontierCode v1.1為54.4%,CursorBench4.0為57.8%,但業務流程與科研Agent測試落後於GPT-6Astra。Artificial Analysis Intelligence榜單上,其以58分位列第一,領先Fable5.1與GPT-6Astra的53分。長任務表現是升級重點:內部測試中,Opus5.5用9.5小時完成負載均衡軟件HAProxy從C語言到Rust的改寫,成本較Fable5.1低51%;在需逐一核對數字與引語的財報研究測試中,其18份報告有16份達標,Fable5.
1與Opus5均未通過;有早期測試者不到一天完成涉及68萬行代碼的遷移。價格方面,每百萬輸入、輸出Token收費4美元和20美元,較Opus5降20%,緩存讀取降60%;Pro、Max等套餐五小時使用額度同步提高,訂閱用戶另獲一次限額重置機會。安全上,Opus5.5嘗試繞過隔離邊界的頻率較Opus5降低約85%且自行報告相關行為,提示詞注入防禦與Fable5.1並列受測模型最低成功率;但大多數網絡安全任務仍會轉交Opus4.8,官方承認部署前評估無法發現所有失效情況。發佈近2小時後,OpenAI即推出GPT-6Sol與Luna;Sonnet5.5與Haiku5.5計劃未來幾週上線。
以效率與成本壓縮換取Agent規模化落地,正在成為頭部模型競爭的主線。相關推薦Claude Opus 5.5 已在內測:連跳兩級直逼 GPT-6,價格還打骨折爆料稱Claude Opus 5.5(代號claude-wafer-eap)已開啟內測,或於本週二突然發佈,版本跳過5.2。其定價為每百萬Token輸入4美元、輸出20美元,低於現役Opus 5的5/25美元,被視為直接對標GPT-6。Sep 21, 2026250.1k地球最強大模型打起價格戰!Anthropic發佈Fable 5.1:性能狂飆且成本驟降四成Anthropic在上市前夕發佈新一代旗艦大模型Fable5.
1,並同步向Mythos訪問權限用戶推出Mythos5.1。作為其產品體系最強核心,該模型多項基準測試全面超越上代Fable5及競品,同時大幅削減使用成本,延續超強性能,凸顯大模型軍備競賽正向極致性價比延伸。Sep 2, 2026257.6k被指“OpenClaw換皮”後,Meta罕見承認:產品設計確實深受其影響Meta超級智能實驗室產品負責人Nat Friedman迴應稱,AI代理Muse設計確受OpenClaw影響,但系從零創建。此前AI應用聯合創始人Ansh Nanda發帖稱Muse是面向普通用戶的OpenClaw,並曬對話顯示AI自認系統文件相似非巧合而是匹配。
社區還發現Muse存在更多相似之處。Sep 23, 202697.3kOpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估OpenAI針對外界對AI風險的擔憂,公佈安全治理新動向:打破內部閉環測試模式,將第三方獨立機構引入模型開發早期,開展系統性安全風險評估;並明確外部評估有效落地的核心優先事項,提出四大關鍵支柱,以確保該機制發揮實質作用。Sep 23, 202674.9kGrok Bot 上線僅一個月,周活躍用戶數正式突破 40 萬大關馬斯克旗下SpaceX AI團隊推出的Grok Bot智能體上線約一個月,周活躍用戶已突破40萬。截至9月14日達41.
8萬人,環比增長24%,顯示其市場熱度與競爭潛力,為AI格局帶來新變數。Sep 23, 202653.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

Meta Muse 爆紅,為什麼騰訊股價大漲?
Meta Muse 爆紅,為什麼騰訊股價大漲?深流研究所2026.09.23 10:39 · 來自北京全文3733字00:00 / 10:34扎克伯格等來爆款,騰訊跟著被重估。文 | 深流研究所,作者 | 吳絳楓Meta 在 AI 上砸下的重金,什麼時候才能拿到大結果?Muse 給出了第一個答案。9 月 8 日,Meta 推出個人 AI Agent Muse。上線不到兩週,Muse 登頂美國蘋果應用商店免費應用榜,排名超過 ChatGPT、Gemini 和 Claude。扎克伯格終於等來了一個消費級 AI 爆款。9 月 21 日,Meta 股價上漲 11.43%,創下 2025 年 4 月以來最大單日漲幅,市值一天增加約 1900 億美元。Muse 點燃的不只是 Meta。市場開始押注,個人 Agent 的普及會帶來更大的推理和計算需求。於是,Arm 上漲 17.2%,英特爾上漲 12.1%,AMD 上漲近 10%,市值首次突破 1 萬億美元。這輪行情很快傳到中國。9 月 22 日,騰訊控股盤中一度上漲 7.77%,股價升至 463.4 港元。在當天普遍上漲的港股科技股中,騰訊表現最突出。Muse 有什麼特別之處?它為什麼能讓華爾街重新相信扎克伯格,又為什麼讓遠在中國的騰訊獲得重估?為什麼說Muse是“社交+Agent”?從產品體驗看,Muse 完成表格填寫、日程整理、預訂餐廳、規劃旅行及購物等一系列任務。接到任務後,它會將目標拆解為多個步驟,再調用用戶已經授權的賬戶和服務。涉及發送郵件、提交訂單和付款等敏感操作時,Muse 會暫停執行,等待用戶再次確認。說實話,這些能力本身並不新鮮。OpenAI、Google、Anthropic,以及一批創業公司都有嘗試。Muse 的不同之處在於,Meta 第一次把個人 Agent 放進一個成熟的社交體系,嘗試藉助 Instagram、F

Opus 5.5來了,性能趕超Fable,成本低至40%
Opus 5.5來了,性能趕超Fable,成本低至40%字母AI2026.09.23 10:31 · 來自北京全文4730字00:00 / 12:20被Astra“逼出來”的全新系列。文 | 字母AI5.5!!是Opus 5.5!!就在三天前,路透社還報道稱,隨著GPT-6 Astra開始搶回企業市場,Anthropic正在考慮提前推出一款新模型應戰。社區一直猜測新模型會是Opus 5.2還是5.5,現在答案終於揭曉了。而且這不是一個小更新,Anthropic直接掀開了Claude 5.5這個新系列。Opus 5.5先打頭陣,Sonnet 5.5和Haiku 5.5也已經排在後面,將在幾周後推出。某種意義上,Astra這腳油門踩下去,Anthropic連換代速度都被一起帶快了。和新模型同時到來的還有一個重置,正好方便用戶體驗。 Fable的定位有點尷尬了 既然被認為是衝著Astra來的,那就把它和Astra放在一起看。先說價格,Opus 5.5的API輸入價格是每百萬Token 4美元,輸出20美元;Astra則分別是10美元和50美元。也就是說,Opus 5.5的Token單價只有Astra的40%。兩款模型的上下文沒太大差別,Opus 5.5是100萬Token,Astra是105萬;最大輸出也都是128K Token。Astra的知識截止日期是2026年4月30日,Opus 5.5則更新到了2026年6月。兩款模型均支持low到max五檔推理強度。而且Opus 5.5相比自家上一代Opus 5也降價了。Opus 5原本是每百萬Token 5美元輸入、25美元輸出,新模型兩邊都降了20%;Anthropic稱,再加上Token使用效率提升,完成一項典型任務的實際成本能比Opus 5低約40%,輸出速度則提高了30%以上。便宜歸便宜,Opus 5.5在跑分上倒是一點沒客氣

OpenRouter發佈 2026 嵌入模型選型指南:實測 19 款、 37 個目錄條目,按場景把最佳候選擺上桌
正因如此,選哪個模型永遠是RAG、多語言檔案庫、代碼倉庫和圖文集合各自不同的考題。OpenRouter在9月11日核實了自家嵌入模型目錄,共37個條目,並通過embeddings API向19個模型發了批量請求、跑了28項檢查,用一份實測指南把選型邏輯攤開。

AI變天,Kimi怎麼補齊“月之暗面”?
光錐智能2026.09.23 10:15 · 來自廣西全文7430字00:00 / 20:20模型強只是入場券,月之暗面還需要補更多課文 | 光錐智能,作者|魏琳華,編輯|劉俊宏AI圈的規則就是用來打破的,市場變化之快,讓公司們經常猝不及防。

DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰
據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026
本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻!只靠語言和 token,AI 永遠跨不過物理世界這道門檻!作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。