Claude Sonnet 5.5 配置標識符現身並開啟灰度測試,性能直逼 GPT-6 Astra
AI資訊AI新閒資訊正文Claude Sonnet 5.5 配置標識符現身並開啟灰度測試,性能直逼 GPT-6 Astra發布於AI新閒資訊時間 :Sep 28, 2026閱讀 :1分鐘在 Anthropic 剛剛發佈 Opus5.5不久,行業內便傳出重磅消息:多位開發者在 X 平臺爆料稱,Claude Sonnet5.5的專屬模型配置標識符「claude-sonnet-5-5」已在官方配置中現身,並且目前已在 Claude Code 中正式開啟灰度測試。從多位內測用戶的實測數據來看,Sonnet5.5的綜合表現極為驚豔。
在純前端 UI 動畫生成及日常編碼測試中,它展現出了超強的代碼直覺和自然的人機互動質感,其實測表現不僅全面超越了 OpenAI 近期發佈的 GPT-6Sol,甚至在部分高級編碼與智能體能力上直逼 OpenAI 的旗艦大杯 GPT-6Astra。在定價策略上,這款被稱為“性價比之王”的新模型同樣極具殺傷力。據爆料顯示,其百萬 token 輸入價格低至2美元,輸出為10美元,緩存讀取更是僅需0.20美元。這種將前沿能力下放至白菜價的策略,被業內普遍視作 Anthropic 針對 OpenAI 年度開發者大會(DevDay)的精準狙擊。
隨著 Anthropic 持續通過 AI 輔助研發的高效數據飛輪加速模型迭代,Sonnet5.5的全面落地預計將徹底重塑中端和日常開發市場。廣大開發者只需在 Claude Code 中進行特定指令測試,便有機會提前驗證自己是否已被成功路由至5.5版本。相關推薦OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦OpenAI正式發佈GPT-6系列新成員Sol與Luna,採用與GPT-6Astra相似訓練方法,旨在將Astra在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,下放至更快、更經濟的小尺寸模型。
官方稱Astra仍是無妥協首選,但Sol和Luna在大幅降本的同時展現強勁綜合競爭力。Sep 23, 2026179.0kOpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成OpenAI發佈GPT-6系列新成員Sol與Luna,採用與GPT-6 Astra相似的訓練方法,將Astra在專業工作、事實性、編碼、計算機使用和對齊等方面的頂尖性能帶入更快、更經濟的模型。OpenAI強調Astra仍是最強整體模型,追求無妥協體驗應首選。兩款API價格較GPT-5.6促銷價降低50%,成本最低不到競品一成。Sep 23, 2026168.
6kAnthropic上線Claude Opus 5.5 ,任務成本大降 40%Anthropic發佈Claude Opus 5.5,為Claude 5.5系列首款。官方稱多數任務表現與Fable 5.1相當,成本較上代Opus 5降40%、速度提升超30%,9項測試中7項領先,編程表現突出。約兩小時後,OpenAI推出GPT-6 Sol和Luna,GPT-6“宇宙”擴容。Sep 23, 2026174.3k自信心暴漲但正確率暴跌?最新研究揭示AI輔助下的人類決策悖論最新五項實驗涉及3132人發現,引入GPT-5.5等大語言模型顯著削弱人類懸置判斷能力,幾乎喪失承認“我不知道”的意願。
在易引發幻覺的冷門問題上,無AI對照組放棄作答率為36%至44%,獲取AI建議後驟降至3%至6%,顯示人們過度依賴AI結論。Sep 28, 202663.6kOpenAI 助手為奪聯合國數據,數月內瘋狂轟炸網站超 1.6 萬次OpenAI智能體因數據抓取任務越界,在今年4至6月對聯合國貿發會議統計網站發起超1.6萬次密集掃描,引發對人工智能自主執行任務行為邊界的嚴峻審視。Sep 28, 202686.1k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

千問創作上線 7 天會員:200 積分 + 快速通道,瞄準旅行出片等即時創作
用戶購買後,可獲得 200 積分、專享快速生成通道,以及新模型與新功能的優先體驗權益。短週期降低嚐鮮門檻相較於包月訂閱,7 天會員以更短的使用週期,明顯降低了用戶的嘗試與決策門檻。對那些只想在一段旅行、一場活動或一輪社媒運營中集中用 AI 出圖、寫文案的用戶來說,不必為長期訂閱買單,也能解鎖快速生成與搶先體驗等核心權益。

千問APP支持中國移動算力套餐,用戶可在工作助理中啟用
已訂閱中國移動該服務的用戶,可在千問APP或PC端的「工作助理」中,使用中國移動賬戶中的Token額度完成複雜工作任務,相關Token將從本人對應賬戶中扣除。同時,雙方還推出了“千問X中國移動聯名版”,用戶辦理指定套餐,即可獲得千問會員權益。

從端側推理到物理AI,芯片行業正面臨新考題
Leo張ToB雜談2026.09.28 10:54 · 來自北京全文4241字00:00 / 12:35物理AI的時代,比拼的將是誰的落地更穩。過去兩年,幾乎所有關於AI的討論都圍繞一個詞展開:規模。更大的模型、更多的參數、更貴的訓練集群。

Muse 登頂、Meta 股價漲 11%,國內大模型卻擠在辦公內卷裡
ICT解讀者一老解2026.09.28 10:33 · 來自北京全文3748字00:00 / 10:50當所有玩家擠在辦公賽道內卷時,C 端場景仍有值得挖的空間。文 | ICT解讀者—老解9月8日,Meta 推出個人 AI 智能體 Muse。上線約 5 天,美國下載量突破73 萬次;上週五(9月18日)它把 ChatGPT 拉下馬,登頂美國 iOS 免費應用榜,並一直佔著第一。受此帶動,Meta 股價週一大漲超過11%,引領美股算力板塊集體走強。

Claude Sonnet 5.5 配置標識符現身並開啟灰度測試,性能直逼 GPT-6 Astra
從多位內測用戶的實測數據來看,Sonnet5.5的綜合表現極為驚豔。在純前端 UI 動畫生成及日常編碼測試中,它展現出了超強的代碼直覺和自然的人機互動質感,其實測表現不僅全面超越了 OpenAI 近期發佈的 GPT-6Sol,甚至在部分高級編碼與智能體能力上直逼 OpenAI 的旗艦大杯 GPT-6Astra。

自信心暴漲但正確率暴跌?最新研究揭示AI輔助下的人類決策悖論
研究團隊專門挑選了極易引發模型幻覺的精細冷門問題進行測試,結果顯示,在無AI輔助的對照組中,參與者對36%至44%的問題選擇放棄作答;而在獲取AI建議後,這一不作答比例驟降至3%至6%。更為矛盾的是,在AI輔助下,參與者的答題自信心從29.