Anthropic上線Claude Opus 5.5 ,任務成本大降 40%
AI資訊AI新閒資訊正文Anthropic上線Claude Opus 5.5 ,任務成本大降 40%發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :3分鐘Anthropic 發佈 Claude Opus 5.5,這是 Claude 5.5 系列的首款模型。Anthropic 稱,新模型在多數任務上的表現與 Claude Fable 5.1 相當,但默認設置下的典型任務成本較上一代 Opus 5 降低 40%,輸出速度提升超過 30%。發佈約兩小時後,OpenAI 也推出了 GPT-6 Sol 和 GPT-6 Luna,GPT-6“宇宙”再添新成員。
成本降四成、速度提三成,編程測試領跑在官方公佈的 9 項測試中,Opus 5.5 有 7 項成績領先 Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol。其中三項編程測試(Terminal-Bench 4.0、FrontierCode v1.1、CursorBench 4.0)均拿下最高分,分別為 66.4%、54.4% 和 57.8%;但在業務流程和科研 Agent 測試上仍落後於 GPT-6 Astra。第三方機構 Artificial Analysis 的 Intelligence 榜單上,Opus 5.5 以 58 分位列第一,領先 Fable 5.
1 與 GPT-6 Astra 的 53 分。價格方面,Opus 5.5 每百萬輸入、輸出 Token 分別收費 4 美元(約 26.8 元)和 20 美元(約 134 元),較 Opus 5 下調 20%,緩存讀取價格下降 60%。Claude Code 與 Claude Platform 還提供快速模式,速度最高達普通模式 2.5 倍,相應收費為輸入 8 美元、輸出 40 美元每百萬 Token。Anthropic 同時提高了多個付費套餐的五小時使用額度,並向訂閱用戶提供一次可自選時間的額度重置機會。9.5 小時改寫 HAProxy,長任務成賣點Opus 5.
5 的升級重點明顯偏向長時間任務。Anthropic 稱,一名早期測試者用不到一天完成了涉及 68 萬行代碼的遷移;對 20 萬行代碼庫的審查與修復,Opus 5.5 用時不到 3 小時,而 Opus 5 需超 20 小時、消耗 Token 為前者 2.5 倍。內部測試中,雙方被要求將負載均衡軟件 HAProxy 從 C 語言改寫為 Rust,改寫版本均通過幾乎全部迴歸測試——Opus 5.5 用時 9.5 小時、成本比 Fable 5.1 低 51%。財報研究測試更考驗“零編造”:模型只能在難找的網頁副本中檢索並撰寫季度業績報告,自動評分逐一核對數字與引語。結果 Opus 5.
5 生成的 18 份報告中 16 份達標,Fable 5.1 與 Opus 5 均未通過。知識工作方面,其在 GDPval-AA v2.1 取得 1846 分,高於 Fable 5.1 的 1735 分。寫作與溝通上,Opus 5.5 被調整為優先呈現關鍵信息、回答更簡潔;安全評估中,其嘗試突破隔離邊界的頻率較 Opus 5 或 Claude Mythos 5.1 降低約 85%,在 Gray Swan 提示詞注入測試中攻擊成功率與 Fable 5.1 並列最低。不過部分專業任務仍受限制——大多數網絡安全任務會被轉交 Opus 4.8 處理。Opus 5.
5 已上線 Claude 及亞馬遜雲科技、谷歌雲、微軟 Azure 等平臺,開發者可通過標識 claude-opus-5-5 調用,並繼續提供零數據保留選項。Claude Sonnet 5.5 與 Haiku 5.5 計劃在未來幾周推出。相關推薦福布斯美國最年輕 10 位億萬富豪:7 人靠 AI 上榜,4 人來自 Anthropic福布斯美國400富豪榜門檻升至44億美元創新高;40歲以下富豪從4人增至10人,其中7人財富來自AI熱潮且多為創始人。這7人中有4位來自成立僅五年的AI公司Anthropic,該公司二級市場估值達1.5萬億美元,其7位聯合創始人此前承諾捐出個人財富的80%用於慈善。
Sep 22, 2026146.2kAnthropic與字節扎堆AI製藥,下一個Coding風口卡在了數據這道坎上AI製藥賽道升溫,圈外巨頭入局:Anthropic自建溼實驗室,與諾和諾德、百時美施貴寶合作並收購Coefficient Bio;字節跳動分拆的新生實驗室完成首輪融資。目前AI主要加速新藥早期研發,壓縮候選分子篩選和實驗迭代時間,但燒錢多、風險高的後續環節仍待突破。Sep 21, 2026191.1k法國興業銀行押注 AI:預計最多省下 6 億歐元成本法國興業銀行稱,AI應用擴大將帶來可觀降本空間,潛在規模約5億至6億歐元,其中已規劃到2029年實現約3.5億歐元降本。
該行與Anthropic戰略合作,分批部署Claude模型。Sep 21, 2026187.3kClaude Opus 5.5 已在內測:連跳兩級直逼 GPT-6,價格還打骨折爆料稱Claude Opus 5.5(代號claude-wafer-eap)已開啟內測,或於本週二突然發佈,版本跳過5.2。其定價為每百萬Token輸入4美元、輸出20美元,低於現役Opus 5的5/25美元,被視為直接對標GPT-6。Sep 21, 2026234.3kClaude Opus 5.5 疑遭內測洩露:跳級直衝GPT-6,百萬Token價格腰斬至 4 美元Anthropic或跳過Opus5.
2,被曝內測代號claude-wafer-eap的Opus5.5,最快本週二發佈;定價每百萬Token輸入4美元、輸出20美元,直指GPT-6,性能傳超Astra。另有Claude Fable5.2暗中籌備,IPO前動作密集。Sep 21, 2026215.4k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰
AI資訊AI新聞資訊正文DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰發佈於AI新聞資訊發佈時間 :2026年9月23號 9:52閱讀 :1分鐘人工智能技術的快速發展正在從單純的產業競爭,加速上升至全球安全與地緣政治的核心議題。據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。與此同時,包括阿里巴巴支持的月之暗面等其他中國人工智能企業也正逐步走向國際舞臺,共同參與探討如何在全球範圍內應對通用人工智能帶來的長遠挑戰。隨著各大 AI 實驗室的技術迭代不斷刷新邊界,如何平衡技術創新與安全紅線已成為全球多邊治理機制的當務之急。此次 DeepSeek 赴聯合國安理會分享其對 AI 風險的研判與實踐,不僅為國際社會提供了來自中國科技企業的技術觀察視角,也標誌著全球 AI 治理正在加速向多邊協作與深度對話的全新階段邁進。相關推薦世衛組織發佈重磅報告,呼籲全面升級醫療 AI 研究倫理監管世衛組織2026年9月21日發佈《人工智能相關健康研究:倫理審查與監管》報告,指出AI正加速健康研究和醫療進步,但若缺乏倫理防線與監管,可能帶來新風險,危及人權、社會公平和公眾信任。報告對現有倫理審查機制發出警告,強調需加強倫理審查與監管。2026年9月23號 9:4652.5kGrok Bot 上線僅一個月,周活躍用戶數正式突破 40 萬大關馬斯克旗下SpaceX AI團隊推出的Grok Bot智能體上線約一個月,周活躍用戶已突破40萬。截至9月14日達41.8萬人,環比增長24%,顯示其市場熱度與

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026
Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026 本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。但這條路線撞上了天花板:預訓練的邊際收益肉眼可見地遞減;模型一旦部署到真實世界,漏洞百出。2026 年,“世界模型”接棒 Scaling Law,成了牌桌上最擁擠的籌碼。然而,這個詞本身,同時被四條技術路線認領,而它們對“理解世界”這件事,幾乎各說各話。第一條賭湧現:Sora、Genie 這類視頻生成路線相信,只要下一幀逼得夠真,物理規律就會自己從像素裡長出來。第二條賭幾何:李飛飛聯合創立的 World Labs,從底層表徵就鎖死三維一致性,直接生成可自由探索的虛擬世界。第三條賭仿真:英偉達 Cosmos、Omniverse,把顯式物理引擎當作機器人的練兵場。第四條路最孤峭,也最反常識:2018 年圖靈獎得主、深度學習三位“教父”之一 Yann LeCun,押注 JEPA(聯合嵌入預測架構),它不生成未來,只在抽象表徵的空間裡預測未來。四條路的根本分歧,本質上在於一個問題:機器要“懂”物理世界,究竟該去復刻它,還是去推理它?前三條都在不同程度上試圖讓機器“看見並重建”世界;JEPA 卻選擇另一條路——編碼器先丟掉那些根本不可預測的細節,只保留可預測、可規劃的結構,然後在抽象表徵空間裡預測未來。在 LeCun 眼裡,連“預測像素”這件事本身都是偽命題:你把攝像頭對準房間一角開始錄像,下一幀會拍到什麼,取決於鏡頭外有沒

樂享以太大模型,讓中國具身智能坐上定義席
樂享以太大模型,讓中國具身智能坐上定義席 本文作者: 叢末 2026-09-23 09:46 導語: 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 作者丨幸麗娟 編輯丨董子博 具身智能行業一直在等一個 ChatGPT 時刻。但這個時刻,未必長得像 ChatGPT。決定這個時刻的,不是機器人會聊天,也不是機器人學會了幾個動作,而是在不確定環境裡,機器人能不能自主思考、判斷和執行,在無序的事件中,持續完成任務。過去兩年,行業積累的幾乎全是“能力上限”的展示:選好場景、選好時機、反覆調試,再拍出一條完美的Demo。上限可以“被編輯”出來展示。真實效果如何,卻少有人敢公開測。但機器人真正進入現實世界,考驗的不只是最好時能做到什麼,更是環境不斷變化時,它還能不能把事情做下去。9 月 16 日傍晚。上海閔行一家燒烤店門口,樂享科技讓兩臺機器人擺起了燒烤攤。接下來近一個小時,它們要接單、烤串、上菜。這場直播的規則,測的正是機器人在這種真實環境裡的應變能力。沒有剪輯,沒有遙控,沒有預設腳本。更絕的是,觀眾可以實時幹預:隨機出題,自由改造場地佈局,隨手改道具擺放位置,臨時打斷正在進行的任務並追加需求。現場 3 桌、6 名顧客的主線任務,就是“幹擾”,看機器人能不能像人一樣自己“圓場子”。而就在不久前,這家公司剛剛站在了一場輿論風暴的中心。故事線是這樣的:7 月,樂享上線以太大模型官網並公開完整技術路線;8月26日,一段機器人協作收拾房間的10分鐘一鏡到底 Demo,在具身圈傳開。9 月 3 日,OpenAI 上線 GPT-6 Astra 官網;三天後,首席科學家 Jakub Pachocki 發表萬字長文《異星心智》。9 月 10 日,樂享創始人郭人傑發文,三問 OpenAI:技術理

OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦
AI資訊AI新聞資訊正文OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦發佈於AI新聞資訊發佈時間 :2026年9月23號 9:26閱讀 :1分鐘OpenAI 今日正式發佈了 GPT-6系列的最新成員 ——GPT-6Sol 與 GPT-6Luna。這兩款新模型採用了與 GPT-6Astra 類似的方法進行訓練,旨在將 Astra 在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,帶入速度更快、更經濟的小尺寸模型中。官方表示,雖然 GPT-6Astra 依然是追求最佳效果和無妥協體驗的首選,但 Sol 與 Luna 在大幅降低成本的同時,展現出了極其強悍的綜合競爭力。在價格方面,GPT-6Sol 和 Luna 模型的 API 價格相比 GPT-5.6的促銷價直接降低了50%。此外,OpenAI 還針對基於 GPT-6的開發者優化了提示緩存,默認提供更高的緩存命中率,幫助智能體重用更多上下文,從而實現更快的響應並進一步節省費用。在核心性能表現上:業務流程與智能體表現:在 AutomationBench 跨應用業務流程測試中,GPT-6Sol 在高強度下表現優於 Claude Opus5,且成本僅為其每任務成本的9%;在 Last Exam 智能體評估中,GPT-6Sol 的得分超越了 Claude Opus5的最高分,同時每任務成本降低60%。事實可靠性:在去標識化的真實世界對話中,GPT-6Sol 的錯誤率約為前代的一半,接近 Astra 級的可靠性,Luna 的事實可靠性也迎來了大幅提升。編程與軟件工程:兩款模型均針對 AI Coding Agent 工作負載進行了深度優化。在 DeepSWE v1.1軟件工程測試中,GPT-6Sol 取得68.8% 的成績,距離最高成績僅差1.1個百分點,單任務成本卻低約80%;

Anthropic深夜放大招:Claude Opus 5.5上線,任務成本大降40%
Opus 5、GPT-6 Astra和GPT-5.6 Sol。其中,Opus 5.5在三項編程測試中均取得最高分,但在業務流程和科研Agent測試中仍落後於GPT-6 Astra。在第三方評測機構Artificial Analysis的Intelligence榜單上,Claude Opus 5.

OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估
據相關報道,該公司計劃打破傳統的內部閉環測試模式,將第三方獨立機構正式引入 AI 模型開發週期的更早階段,對其進行系統性的安全風險評估。為了確保這一創新機制能夠真正發揮實質性作用,OpenAI 同時明確了此類外部評估得以有效開展的核心優先事項。