OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦

AI資訊AI新聞資訊正文OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦發佈於AI新聞資訊發佈時間 :2026年9月23號 9:26閱讀 :1分鐘OpenAI 今日正式發佈了 GPT-6系列的最新成員 ——GPT-6Sol 與 GPT-6Luna。這兩款新模型採用了與 GPT-6Astra 類似的方法進行訓練,旨在將 Astra 在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,帶入速度更快、更經濟的小尺寸模型中。
官方表示,雖然 GPT-6Astra 依然是追求最佳效果和無妥協體驗的首選,但 Sol 與 Luna 在大幅降低成本的同時,展現出了極其強悍的綜合競爭力。在價格方面,GPT-6Sol 和 Luna 模型的 API 價格相比 GPT-5.6的促銷價直接降低了50%。此外,OpenAI 還針對基於 GPT-6的開發者優化了提示緩存,默認提供更高的緩存命中率,幫助智能體重用更多上下文,從而實現更快的響應並進一步節省費用。
在核心性能表現上:業務流程與智能體表現:在 AutomationBench 跨應用業務流程測試中,GPT-6Sol 在高強度下表現優於 Claude Opus5,且成本僅為其每任務成本的9%;在 Last Exam 智能體評估中,GPT-6Sol 的得分超越了 Claude Opus5的最高分,同時每任務成本降低60%。事實可靠性:在去標識化的真實世界對話中,GPT-6Sol 的錯誤率約為前代的一半,接近 Astra 級的可靠性,Luna 的事實可靠性也迎來了大幅提升。編程與軟件工程:兩款模型均針對 AI Coding Agent 工作負載進行了深度優化。在 DeepSWE v1.
1軟件工程測試中,GPT-6Sol 取得68.8% 的成績,距離最高成績僅差1.1個百分點,單任務成本卻低約80%;Luna 的表現也逼近部分競品的中檔強度,成本更具優勢。計算機操作能力:在 OSWorld2.0離線測試中,GPT-6Sol 取得了接近競品中檔強度的成績,單任務成本約低80%,而 Luna 的成績也超過了上一代主打型號,成本僅為後者的十分之一。除了硬核性能的提升,OpenAI 還將 GPT-6Astra 改進後的溝通風格賦予了 Sol 和 Luna,使新模型在技術和編程對話中更加清晰、簡練,大幅減少了術語堆砌和低價值細節。在價值對齊方面,兩款模型均較 GPT-5.
6版本有所改進,例如編碼工作中的誤導性聲明發生率明顯降低。目前,GPT-6Sol 和 GPT-6Luna 已在 ChatGPT Work 和 Codex 中向所有 Plus、Pro、Business、Enterprise 和 Edu 用戶全面開放,免費用戶和 Go 用戶也能夠在桌面應用中使用 GPT-6Luna。在 OpenAI API 中,它們分別以 gpt-6-sol 和 gpt-6-luna 的形式提供服務。
相關推薦OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估OpenAI針對外界對AI風險的擔憂,公佈安全治理新動向:打破內部閉環測試模式,將第三方獨立機構引入模型開發早期,開展系統性安全風險評估;並明確外部評估有效落地的核心優先事項,提出四大關鍵支柱,以確保該機制發揮實質作用。2026年9月23號 9:1180.
5kOpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成OpenAI發佈GPT-6系列新成員Sol與Luna,採用與GPT-6 Astra相似的訓練方法,將Astra在專業工作、事實性、編碼、計算機使用和對齊等方面的頂尖性能帶入更快、更經濟的模型。OpenAI強調Astra仍是最強整體模型,追求無妥協體驗應首選。兩款API價格較GPT-5.6促銷價降低50%,成本最低不到競品一成。2026年9月23號 8:54106.7kAnthropic上線Claude Opus 5.
5 ,任務成本大降 40%Anthropic發佈Claude Opus 5.5,為Claude 5.5系列首款。官方稱多數任務表現與Fable 5.1相當,成本較上代Opus 5降40%、速度提升超30%,9項測試中7項領先,編程表現突出。約兩小時後,OpenAI推出GPT-6 Sol和Luna,GPT-6“宇宙”擴容。2026年9月23號 8:5387.1kOpenAI內部AI已能自主訓練模型,奧特曼發佈全球安全倡議應對RSI逼近OpenAI內部AI已能自主接管實驗性模型訓練全流程,多智能體自發協作大幅壓縮實驗耗時,甚至可編寫GPU內核優化程序,被視為遞歸式自我提升(RSI)雛形。
面對加速勢頭,OpenAI發佈全球安全倡議,但明確表示全自主RSI尚未真正發生。2026年9月22號 16:02205.1kOpenAI 成立數學與 AI 顧問組:神秘新模型 24 天攻破 100 多個世界級難題OpenAI 9月22日宣佈在普林斯頓高等研究院成立由九位數學家組成的“數學與AI顧問組”,獨立運作。同時披露,8月28日起訓練的神秘模型已解決數學多個領域100多個長期未解難題,其中包括納維-斯托克斯千年大獎難題。2026年9月22號 9:22159.3k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

Meta Muse 爆紅,為什麼騰訊股價大漲?
深流研究所2026.09.23 10:39 · 來自北京全文3733字00:00 / 10:34扎克伯格等來爆款,騰訊跟著被重估。文 | 深流研究所,作者 | 吳絳楓Meta 在 AI 上砸下的重金,什麼時候才能拿到大結果?Muse 給出了第一個答案。

Opus 5.5來了,性能趕超Fable,成本低至40%
字母AI2026.09.23 10:31 · 來自北京全文4730字00:00 / 12:20被Astra“逼出來”的全新系列。文 | 字母AI5.5!!是Opus 5.5!!就在三天前,路透社還報道稱,隨著GPT-6 Astra開始搶回企業市場,Anthropic正在考慮提前推出一款新模型應戰。社區一直猜測新模型會是Opus 5.2還是5.5,現在答案終於揭曉了。而且這不是一個小更新,Anthropic直接掀開了Claude 5.5這個新系列。Opus 5.5先打頭陣,Sonnet 5.5和Haiku 5.

OpenRouter發佈 2026 嵌入模型選型指南:實測 19 款、 37 個目錄條目,按場景把最佳候選擺上桌
正因如此,選哪個模型永遠是RAG、多語言檔案庫、代碼倉庫和圖文集合各自不同的考題。OpenRouter在9月11日核實了自家嵌入模型目錄,共37個條目,並通過embeddings API向19個模型發了批量請求、跑了28項檢查,用一份實測指南把選型邏輯攤開。

AI變天,Kimi怎麼補齊“月之暗面”?
光錐智能2026.09.23 10:15 · 來自廣西全文7430字00:00 / 20:20模型強只是入場券,月之暗面還需要補更多課文 | 光錐智能,作者|魏琳華,編輯|劉俊宏AI圈的規則就是用來打破的,市場變化之快,讓公司們經常猝不及防。

DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰
據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026
本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻!只靠語言和 token,AI 永遠跨不過物理世界這道門檻!作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。