OpenAI 發佈 GPT-6 Sol 和 Luna 模型,API 價格大降 50%

2026年9月22日 03:25
OpenAI 發佈 GPT-6 Sol 和 Luna 模型,API 價格大降 50%
站內 AI 整理稿

作者:汪淼 責編:汪淼 評論: 感謝網友 我家小妞很拽、蘭花是我、華南吳彥祖 的線索投遞!9 月 23 日消息,OpenAI 今日發佈 GPT-6 系列模型的最新成員 GPT-6 Sol 和 GPT-6 Luna。OpenAI 官方表示,兩款模型採用與 GPT-6 Astra 類似的方法進行訓練,將 Astra 在專業工作、事實性、編碼、計算機使用和對齊等方面最先進的性能帶入更快、更經濟的模型。GPT-6 Sol 和 Luna 模型的 API 價格相比 GPT-5.6 促銷價降低 50%。

不過 OpenAI 官方也表示,GPT-6 Astra 依然是其整體上最優秀的模型,如果你想要最佳效果和無妥協的體驗,還是建議選擇 GPT-6 Astra。性能方面,在 AutomationBench 的跨應用業務流程測試中,GPT-6 Sol 在 xhigh 強度下表現優於 Claude Opus 5,成本僅為 Opus 5 每任務成本的 9%。在 high 強度下,GPT-6 Luna 比前代提升了 5.4%,且每項任務成本降低了 58%。在評估智能體的 Last Exam 測試中,GPT-6 Sol 在 max effort 狀態下得分為 56.

4%,高於 Claude Opus 5 在評估中的最高分,每任務成本也降低 60%。在事實可靠性方面,GPT-6 Sol 和 Luna 模型也取得進展。在 OpenAI 基於去標識化的真實世界對話中,GPT-6 Sol 的錯誤率約為前代的一半,接近 Astra 級可靠性且成本更低。GPT-6 Luna 的事實可靠性也迎來大幅提升,同時成本更低。編程方面,GPT-6 Sol 和 Luna 均針對 AI Coding Agent 工作負載進行了優化。在 FrontierCode 1.1 Main 測試中,GPT-6 Sol 相比 GPT-5.

6 Sol 有明顯提升,並以更低成本達到與 Claude Fable 5.1 xhigh 相當的水平。在 DeepSWE v1.1 軟件工程測試中,GPT-6 Sol 在 max effort 下取得 68.8% 的成績,距離 Claude Fable 5 的最高成績 69.9% 僅差 1.1 個百分點,而單任務成本低約 80%。GPT-6 Luna 在 max effort 下取得 66.6%,表現接近 Opus 5 和 Fable 5 的 medium effort,同時單任務成本分別低約 93% 和 96%。

計算機操作能力方面,OpenAI 表示 GPT-6 Astra 仍然是其在計算機操作方面最強的模型,但 Sol 和 Luna 相比上一代模型能夠以更低成本完成相關任務。在 OSWorld 2.0 offline 測試中,GPT-6 Sol 在 xhigh effort 下取得 60.5% 的成績,與 Claude Opus 5 medium effort 的 60.3% 接近,而單任務成本約低 80%。GPT-6 Luna max effort 則超過 GPT-5.6 Sol medium effort,同時成本約為後者的十分之一。

OpenAI 還將 GPT-6 Astra 改進後的溝通風格帶到了 Sol 和 Luna。官方認為新模型在技術和編程對話中會更清晰、使用更少的術語、更少奇怪的措辭、更少的低價值細節,以及縮短整體回答,同時不會失去實質內容。除了價格降低,OpenAI 還幫助基於 GPT-6 的開發者在應用重複利用的上下文部分節省更多費用。官方改進了 GPT-6 的提示緩存,默認提供更高的緩存命中率,幫助智能體重用更多上下文,實現更快響應。此外,GPT-6 Sol 和 Luna 在價值對齊方面也有提升,在 OpenAI 官方的對齊評估中,Sol 和 Luna 都相較於 GPT-5.

6 版本有所改進,包括關於其編碼工作的誤導性聲明發生率降低。從 OpenAI 公告獲悉,GPT-6 Sol 和 GPT-6 Luna 自今日起已在 ChatGPT Work 和 Codex 中向所有 Plus、Pro、Business、Enterprise 和 Edu 用戶開放。免費用戶和 Go 用戶可以在桌面應用中使用 GPT-6 Luna。這些模型目前還沒有在 Chat 中提供。在 OpenAI API 中,它們以 gpt-6-sol 和 gpt-6-luna 的形式提供。

投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:GPT6 Sol,GPT6 Luna,OpenAIAI 也搞“同行評審”?曝 OpenAI 與 Anthropic 曾討論互測彼此模型OpenAI、Anthropic 喊話澳大利亞政府,希望放寬創意內容版權限制OpenAI 呼籲美國牽頭聯合其他國家為前沿 AI 制定全球性標準加拿大不列顛哥倫比亞省正式就涉 9 人死亡槍擊案不作為行為起訴 OpenAI美國最年輕 10 位億萬富豪出爐:7 人靠 AI 創業,4 人來自 AnthropicOpenAI 宣佈成立數學與 AI 顧問組,神秘新模型 24 天攻破 100+ 世界級難題

Related

相關文章

鈦媒體生成式AI

Meta Muse 爆紅,為什麼騰訊股價大漲?

Meta Muse 爆紅,為什麼騰訊股價大漲?深流研究所2026.09.23 10:39 · 來自北京全文3733字00:00 / 10:34扎克伯格等來爆款,騰訊跟著被重估。文 | 深流研究所,作者 | 吳絳楓Meta 在 AI 上砸下的重金,什麼時候才能拿到大結果?Muse 給出了第一個答案。9 月 8 日,Meta 推出個人 AI Agent Muse。上線不到兩週,Muse 登頂美國蘋果應用商店免費應用榜,排名超過 ChatGPT、Gemini 和 Claude。扎克伯格終於等來了一個消費級 AI 爆款。9 月 21 日,Meta 股價上漲 11.43%,創下 2025 年 4 月以來最大單日漲幅,市值一天增加約 1900 億美元。Muse 點燃的不只是 Meta。市場開始押注,個人 Agent 的普及會帶來更大的推理和計算需求。於是,Arm 上漲 17.2%,英特爾上漲 12.1%,AMD 上漲近 10%,市值首次突破 1 萬億美元。這輪行情很快傳到中國。9 月 22 日,騰訊控股盤中一度上漲 7.77%,股價升至 463.4 港元。在當天普遍上漲的港股科技股中,騰訊表現最突出。Muse 有什麼特別之處?它為什麼能讓華爾街重新相信扎克伯格,又為什麼讓遠在中國的騰訊獲得重估?為什麼說Muse是“社交+Agent”?從產品體驗看,Muse 完成表格填寫、日程整理、預訂餐廳、規劃旅行及購物等一系列任務。接到任務後,它會將目標拆解為多個步驟,再調用用戶已經授權的賬戶和服務。涉及發送郵件、提交訂單和付款等敏感操作時,Muse 會暫停執行,等待用戶再次確認。說實話,這些能力本身並不新鮮。OpenAI、Google、Anthropic,以及一批創業公司都有嘗試。Muse 的不同之處在於,Meta 第一次把個人 Agent 放進一個成熟的社交體系,嘗試藉助 Instagram、F

剛剛
鈦媒體生成式AI

Opus 5.5來了,性能趕超Fable,成本低至40%

Opus 5.5來了,性能趕超Fable,成本低至40%字母AI2026.09.23 10:31 · 來自北京全文4730字00:00 / 12:20被Astra“逼出來”的全新系列。文 | 字母AI5.5!!是Opus 5.5!!就在三天前,路透社還報道稱,隨著GPT-6 Astra開始搶回企業市場,Anthropic正在考慮提前推出一款新模型應戰。社區一直猜測新模型會是Opus 5.2還是5.5,現在答案終於揭曉了。而且這不是一個小更新,Anthropic直接掀開了Claude 5.5這個新系列。Opus 5.5先打頭陣,Sonnet 5.5和Haiku 5.5也已經排在後面,將在幾周後推出。某種意義上,Astra這腳油門踩下去,Anthropic連換代速度都被一起帶快了。和新模型同時到來的還有一個重置,正好方便用戶體驗。 Fable的定位有點尷尬了 既然被認為是衝著Astra來的,那就把它和Astra放在一起看。先說價格,Opus 5.5的API輸入價格是每百萬Token 4美元,輸出20美元;Astra則分別是10美元和50美元。也就是說,Opus 5.5的Token單價只有Astra的40%。兩款模型的上下文沒太大差別,Opus 5.5是100萬Token,Astra是105萬;最大輸出也都是128K Token。Astra的知識截止日期是2026年4月30日,Opus 5.5則更新到了2026年6月。兩款模型均支持low到max五檔推理強度。而且Opus 5.5相比自家上一代Opus 5也降價了。Opus 5原本是每百萬Token 5美元輸入、25美元輸出,新模型兩邊都降了20%;Anthropic稱,再加上Token使用效率提升,完成一項典型任務的實際成本能比Opus 5低約40%,輸出速度則提高了30%以上。便宜歸便宜,Opus 5.5在跑分上倒是一點沒客氣

剛剛
鈦媒體生成式AI

AI變天,Kimi怎麼補齊“月之暗面”?

光錐智能2026.09.23 10:15 · 來自廣西全文7430字00:00 / 20:20模型強只是入場券,月之暗面還需要補更多課文 | 光錐智能,作者|魏琳華,編輯|劉俊宏AI圈的規則就是用來打破的,市場變化之快,讓公司們經常猝不及防。

剛剛

​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰

據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。

剛剛
雷峰網生成式AI

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026

本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻!只靠語言和 token,AI 永遠跨不過物理世界這道門檻!作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。

剛剛