OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成
AI資訊AI新閒資訊正文OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :2分鐘OpenAI 當日發佈 GPT-6 系列的最新成員——GPT-6 Sol 和 GPT-6 Luna。兩款模型採用與 GPT-6 Astra 類似的訓練方法,把 Astra 在專業工作、事實性、編碼、計算機使用和對齊等方面的最先進性能,帶入更快、更經濟的模型。OpenAI 也強調,GPT-6 Astra 仍是其整體最優秀的模型,追求無妥協體驗仍應首選它。
價格砍半,成本最低不到競品一成GPT-6 Sol 和 Luna 的 API 價格相比 GPT-5.6 促銷價降低 50%。更值得注意的是單任務成本:在 AutomationBench 跨應用業務流程測試中,GPT-6 Sol 在 xhigh 強度下表現優於 Claude Opus 5,成本卻僅為 Opus 5 每任務成本的 9%;同一測試 high 強度下,GPT-6 Luna 較前代提升 5.4%,每項任務成本降低 58%。評估智能體的 Last Exam 測試中,GPT-6 Sol 在 max effort 狀態下得分 56.
4%,高於 Claude Opus 5 在該評估中的最高分,每任務成本還降低 60%。事實可靠性同樣進步:GPT-6 Sol 的錯誤率約為前代的一半,接近 Astra 級可靠性且成本更低;Luna 的事實可靠性也大幅提升。性能逼近旗艦,長任務更省編程方面,兩款模型均針對 AI Coding Agent 工作負載優化。FrontierCode 1.1 Main 測試中,GPT-6 Sol 較 GPT-5.6 Sol 明顯提升,並以更低成本達到 Claude Fable 5.1 xhigh 相當水平。DeepSWE v1.
1 軟件工程測試裡,GPT-6 Sol 在 max effort 下取得 68.8%,距 Claude Fable 5 的最高成績 69.9% 僅差 1.1 個百分點,單任務成本卻低約 80%;GPT-6 Luna 在 max effort 下為 66.6%,表現接近 Opus 5 與 Fable 5 的 medium effort,單任務成本分別低約 93% 和 96%。計算機操作上,Astra 仍是 OpenAI 最強,但 Sol 和 Luna 能以更低成本完成相關任務。OSWorld 2.0 offline 測試中,GPT-6 Sol 在 xhigh effort 下取得 60.
5%,與 Claude Opus 5 medium effort 的 60.3% 接近,單任務成本低約 80%;Luna 的 max effort 超過 GPT-5.6 Sol medium effort,成本約為後者十分之一。OpenAI 還將 Astra 改進後的溝通風格帶到 Sol 和 Luna,稱新模型在技術與編程對話中更清晰、用更少術語與奇怪措辭、壓縮低價值細節且不失實質。同時,官方改進了 GPT-6 提示緩存,默認提供更高緩存命中率,幫助智能體重用更多上下文、加快響應;價值對齊上,兩款模型較 GPT-5.6 有所改進,編碼工作的誤導性聲明發生率降低。
自今日起,GPT-6 Sol 和 Luna 已在 ChatGPT Work 與 Codex 中向所有 Plus、Pro、Business、Enterprise 和 Edu 用戶開放,免費及 Go 用戶可在桌面應用使用 Luna;API 中分別以 gpt-6-sol 與 gpt-6-luna 提供,目前尚未在 Chat 中上線。相關推薦Anthropic發佈Claude Opus5.5:任務成本降40%、輸出提速30%,9項測試7項領先GPT-6AstraAnthropic於9月23日發佈Claude5.5系列首款模型Opus5.5,官方稱多數任務表現與Fable5.
1相當,典型任務成本較上代Opus5降低40%,輸出速度提升超30%,已上線Claude及亞馬遜雲、谷歌雲、微軟Azure。9項測試中7項領先Fable5.1、Opus5及GPT-6 Astra、GPT-5.6 Sol,三項編程測試均獲最高分。Sep 23, 202685.2kAnthropic上線Claude Opus 5.5 ,任務成本大降 40%Anthropic發佈Claude Opus 5.5,為Claude 5.5系列首款。官方稱多數任務表現與Fable 5.1相當,成本較上代Opus 5降40%、速度提升超30%,9項測試中7項領先,編程表現突出。
約兩小時後,OpenAI推出GPT-6 Sol和Luna,GPT-6“宇宙”擴容。Sep 23, 202694.5k用《我的世界》測 GPT-6 Astra:141 小時直播,一隻苦力怕讓 AI 陷入“種土豆”循環AI評測機構Vals AI用《我的世界》對OpenAI最新模型GPT-6 Astra開展第三方獨立長時測試,Twitch直播141小時,觀察其封閉環境外表現。Astra展現出長週期規劃與執行能力,成功搭建半自動設施,但上百小時成果因一次爆炸清零。Sep 21, 2026198.
6k消息稱 Anthropic 擬在 IPO 前推出新模型,應對 GPT-6 Astra 衝擊據路透社援引消息人士稱,Anthropic 正考慮推出全新 AI 模型,以應對 OpenAI 發佈 GPT-6 Astra 後的競爭壓力。此事發生在公司籌備 IPO 前夕,而其 CEO 達裡奧·阿莫代伊此前曾呼籲行業放慢技術迭代節奏,此舉被指與公開表態相矛盾。Sep 20, 2026196.
8kGPT-6 Astra 聯手人類攻破重大進展級數學難題:AI 不再只是解題機,成了規律發現者在頂級AI數學基準FrontierMath上,懸置九年的開放難題“批准式委員會選舉中核是否為空”被GPT-6Astra與三位研究員聯手攻克。原本要找“核為空”的反例,模型卻證明反例不存在,即絕對公平的委員會在任何情況下都必定存在,並順帶提出新方法。Sep 20, 2026220.1k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

OpenRouter發佈 2026 嵌入模型選型指南:實測 19 款、 37 個目錄條目,按場景把最佳候選擺上桌
正因如此,選哪個模型永遠是RAG、多語言檔案庫、代碼倉庫和圖文集合各自不同的考題。OpenRouter在9月11日核實了自家嵌入模型目錄,共37個條目,並通過embeddings API向19個模型發了批量請求、跑了28項檢查,用一份實測指南把選型邏輯攤開。

AI變天,Kimi怎麼補齊“月之暗面”?
光錐智能2026.09.23 10:15 · 來自廣西全文7430字00:00 / 20:20模型強只是入場券,月之暗面還需要補更多課文 | 光錐智能,作者|魏琳華,編輯|劉俊宏AI圈的規則就是用來打破的,市場變化之快,讓公司們經常猝不及防。

DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰
據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026
本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻!只靠語言和 token,AI 永遠跨不過物理世界這道門檻!作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。

OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦
這兩款新模型採用了與 GPT-6Astra 類似的方法進行訓練,旨在將 Astra 在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,帶入速度更快、更經濟的小尺寸模型中。官方表示,雖然 GPT-6Astra 依然是追求最佳效果和無妥協體驗的首選,但 Sol 與 Luna 在大幅降低成本的同時,展現出了極其強悍的綜合競爭力。

Anthropic深夜放大招:Claude Opus 5.5上線,任務成本大降40%
Opus 5、GPT-6 Astra和GPT-5.6 Sol。其中,Opus 5.5在三項編程測試中均取得最高分,但在業務流程和科研Agent測試中仍落後於GPT-6 Astra。在第三方評測機構Artificial Analysis的Intelligence榜單上,Claude Opus 5.