OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成

2026年9月23日 09:13
OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成
站內 AI 整理稿

AI資訊AI新聞資訊正文OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成發佈於AI新聞資訊發佈時間 :2026年9月23號 8:54閱讀 :2分鐘OpenAI 當日發佈 GPT-6 系列的最新成員——GPT-6 Sol 和 GPT-6 Luna。兩款模型採用與 GPT-6 Astra 類似的訓練方法,把 Astra 在專業工作、事實性、編碼、計算機使用和對齊等方面的最先進性能,帶入更快、更經濟的模型。OpenAI 也強調,GPT-6 Astra 仍是其整體最優秀的模型,追求無妥協體驗仍應首選它。

價格砍半,成本最低不到競品一成GPT-6 Sol 和 Luna 的 API 價格相比 GPT-5.6 促銷價降低 50%。更值得注意的是單任務成本:在 AutomationBench 跨應用業務流程測試中,GPT-6 Sol 在 xhigh 強度下表現優於 Claude Opus 5,成本卻僅為 Opus 5 每任務成本的 9%;同一測試 high 強度下,GPT-6 Luna 較前代提升 5.4%,每項任務成本降低 58%。評估智能體的 Last Exam 測試中,GPT-6 Sol 在 max effort 狀態下得分 56.

4%,高於 Claude Opus 5 在該評估中的最高分,每任務成本還降低 60%。事實可靠性同樣進步:GPT-6 Sol 的錯誤率約為前代的一半,接近 Astra 級可靠性且成本更低;Luna 的事實可靠性也大幅提升。性能逼近旗艦,長任務更省編程方面,兩款模型均針對 AI Coding Agent 工作負載優化。FrontierCode 1.1 Main 測試中,GPT-6 Sol 較 GPT-5.6 Sol 明顯提升,並以更低成本達到 Claude Fable 5.1 xhigh 相當水平。DeepSWE v1.

1 軟件工程測試裡,GPT-6 Sol 在 max effort 下取得 68.8%,距 Claude Fable 5 的最高成績 69.9% 僅差 1.1 個百分點,單任務成本卻低約 80%;GPT-6 Luna 在 max effort 下為 66.6%,表現接近 Opus 5 與 Fable 5 的 medium effort,單任務成本分別低約 93% 和 96%。計算機操作上,Astra 仍是 OpenAI 最強,但 Sol 和 Luna 能以更低成本完成相關任務。OSWorld 2.0 offline 測試中,GPT-6 Sol 在 xhigh effort 下取得 60.

5%,與 Claude Opus 5 medium effort 的 60.3% 接近,單任務成本低約 80%;Luna 的 max effort 超過 GPT-5.6 Sol medium effort,成本約為後者十分之一。OpenAI 還將 Astra 改進後的溝通風格帶到 Sol 和 Luna,稱新模型在技術與編程對話中更清晰、用更少術語與奇怪措辭、壓縮低價值細節且不失實質。同時,官方改進了 GPT-6 提示緩存,默認提供更高緩存命中率,幫助智能體重用更多上下文、加快響應;價值對齊上,兩款模型較 GPT-5.6 有所改進,編碼工作的誤導性聲明發生率降低。

自今日起,GPT-6 Sol 和 Luna 已在 ChatGPT Work 與 Codex 中向所有 Plus、Pro、Business、Enterprise 和 Edu 用戶開放,免費及 Go 用戶可在桌面應用使用 Luna;API 中分別以 gpt-6-sol 與 gpt-6-luna 提供,目前尚未在 Chat 中上線。相關推薦Anthropic發佈Claude Opus5.5:任務成本降40%、輸出提速30%,9項測試7項領先GPT-6AstraAnthropic於9月23日發佈Claude5.5系列首款模型Opus5.5,官方稱多數任務表現與Fable5.

1相當,典型任務成本較上代Opus5降低40%,輸出速度提升超30%,已上線Claude及亞馬遜雲、谷歌雲、微軟Azure。9項測試中7項領先Fable5.1、Opus5及GPT-6 Astra、GPT-5.6 Sol,三項編程測試均獲最高分。2026年9月23號 9:1985.2kAnthropic上線Claude Opus 5.5 ,任務成本大降 40%Anthropic發佈Claude Opus 5.5,為Claude 5.5系列首款。官方稱多數任務表現與Fable 5.1相當,成本較上代Opus 5降40%、速度提升超30%,9項測試中7項領先,編程表現突出。

約兩小時後,OpenAI推出GPT-6 Sol和Luna,GPT-6“宇宙”擴容。2026年9月23號 8:5394.5k用《我的世界》測 GPT-6 Astra:141 小時直播,一隻苦力怕讓 AI 陷入“種土豆”循環AI評測機構Vals AI用《我的世界》對OpenAI最新模型GPT-6 Astra開展第三方獨立長時測試,Twitch直播141小時,觀察其封閉環境外表現。Astra展現出長週期規劃與執行能力,成功搭建半自動設施,但上百小時成果因一次爆炸清零。2026年9月21號 9:48198.

6k消息稱 Anthropic 擬在 IPO 前推出新模型,應對 GPT-6 Astra 衝擊據路透社援引消息人士稱,Anthropic 正考慮推出全新 AI 模型,以應對 OpenAI 發佈 GPT-6 Astra 後的競爭壓力。此事發生在公司籌備 IPO 前夕,而其 CEO 達里奧·阿莫代伊此前曾呼籲行業放慢技術迭代節奏,此舉被指與公開表態相矛盾。2026年9月20號 15:37196.

8kGPT-6 Astra 聯手人類攻破重大進展級數學難題:AI 不再只是解題機,成了規律發現者在頂級AI數學基準FrontierMath上,懸置九年的開放難題“批准式委員會選舉中核是否為空”被GPT-6Astra與三位研究員聯手攻克。原本要找“核為空”的反例,模型卻證明反例不存在,即絕對公平的委員會在任何情況下都必定存在,並順帶提出新方法。2026年9月20號 14:52220.1k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰

AI資訊AI新聞資訊正文​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰發佈於AI新聞資訊發佈時間 :2026年9月23號 9:52閱讀 :1分鐘人工智能技術的快速發展正在從單純的產業競爭,加速上升至全球安全與地緣政治的核心議題。據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。與此同時,包括阿里巴巴支持的月之暗面等其他中國人工智能企業也正逐步走向國際舞臺,共同參與探討如何在全球範圍內應對通用人工智能帶來的長遠挑戰。隨著各大 AI 實驗室的技術迭代不斷刷新邊界,如何平衡技術創新與安全紅線已成為全球多邊治理機制的當務之急。此次 DeepSeek 赴聯合國安理會分享其對 AI 風險的研判與實踐,不僅為國際社會提供了來自中國科技企業的技術觀察視角,也標誌著全球 AI 治理正在加速向多邊協作與深度對話的全新階段邁進。相關推薦世衛組織發佈重磅報告,呼籲全面升級醫療 AI 研究倫理監管世衛組織2026年9月21日發佈《人工智能相關健康研究:倫理審查與監管》報告,指出AI正加速健康研究和醫療進步,但若缺乏倫理防線與監管,可能帶來新風險,危及人權、社會公平和公眾信任。報告對現有倫理審查機制發出警告,強調需加強倫理審查與監管。2026年9月23號 9:4652.5kGrok Bot 上線僅一個月,周活躍用戶數正式突破 40 萬大關馬斯克旗下SpaceX AI團隊推出的Grok Bot智能體上線約一個月,周活躍用戶已突破40萬。截至9月14日達41.8萬人,環比增長24%,顯示其市場熱度與

剛剛
雷峰網生成式AI

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026 本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。但這條路線撞上了天花板:預訓練的邊際收益肉眼可見地遞減;模型一旦部署到真實世界,漏洞百出。2026 年,“世界模型”接棒 Scaling Law,成了牌桌上最擁擠的籌碼。然而,這個詞本身,同時被四條技術路線認領,而它們對“理解世界”這件事,幾乎各說各話。第一條賭湧現:Sora、Genie 這類視頻生成路線相信,只要下一幀逼得夠真,物理規律就會自己從像素裡長出來。第二條賭幾何:李飛飛聯合創立的 World Labs,從底層表徵就鎖死三維一致性,直接生成可自由探索的虛擬世界。第三條賭仿真:英偉達 Cosmos、Omniverse,把顯式物理引擎當作機器人的練兵場。第四條路最孤峭,也最反常識:2018 年圖靈獎得主、深度學習三位“教父”之一 Yann LeCun,押注 JEPA(聯合嵌入預測架構),它不生成未來,只在抽象表徵的空間裡預測未來。四條路的根本分歧,本質上在於一個問題:機器要“懂”物理世界,究竟該去復刻它,還是去推理它?前三條都在不同程度上試圖讓機器“看見並重建”世界;JEPA 卻選擇另一條路——編碼器先丟掉那些根本不可預測的細節,只保留可預測、可規劃的結構,然後在抽象表徵空間裡預測未來。在 LeCun 眼裡,連“預測像素”這件事本身都是偽命題:你把攝像頭對準房間一角開始錄像,下一幀會拍到什麼,取決於鏡頭外有沒

剛剛
雷峰網生成式AI

樂享以太大模型,讓中國具身智能坐上定義席

樂享以太大模型,讓中國具身智能坐上定義席 本文作者: 叢末 2026-09-23 09:46 導語: 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 作者丨幸麗娟 編輯丨董子博 具身智能行業一直在等一個 ChatGPT 時刻。但這個時刻,未必長得像 ChatGPT。決定這個時刻的,不是機器人會聊天,也不是機器人學會了幾個動作,而是在不確定環境裡,機器人能不能自主思考、判斷和執行,在無序的事件中,持續完成任務。過去兩年,行業積累的幾乎全是“能力上限”的展示:選好場景、選好時機、反覆調試,再拍出一條完美的Demo。上限可以“被編輯”出來展示。真實效果如何,卻少有人敢公開測。但機器人真正進入現實世界,考驗的不只是最好時能做到什麼,更是環境不斷變化時,它還能不能把事情做下去。9 月 16 日傍晚。上海閔行一家燒烤店門口,樂享科技讓兩臺機器人擺起了燒烤攤。接下來近一個小時,它們要接單、烤串、上菜。這場直播的規則,測的正是機器人在這種真實環境裡的應變能力。沒有剪輯,沒有遙控,沒有預設腳本。更絕的是,觀眾可以實時幹預:隨機出題,自由改造場地佈局,隨手改道具擺放位置,臨時打斷正在進行的任務並追加需求。現場 3 桌、6 名顧客的主線任務,就是“幹擾”,看機器人能不能像人一樣自己“圓場子”。而就在不久前,這家公司剛剛站在了一場輿論風暴的中心。故事線是這樣的:7 月,樂享上線以太大模型官網並公開完整技術路線;8月26日,一段機器人協作收拾房間的10分鐘一鏡到底 Demo,在具身圈傳開。9 月 3 日,OpenAI 上線 GPT-6 Astra 官網;三天後,首席科學家 Jakub Pachocki 發表萬字長文《異星心智》。9 月 10 日,樂享創始人郭人傑發文,三問 OpenAI:技術理

剛剛

OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦

AI資訊AI新聞資訊正文OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦發佈於AI新聞資訊發佈時間 :2026年9月23號 9:26閱讀 :1分鐘OpenAI 今日正式發佈了 GPT-6系列的最新成員 ——GPT-6Sol 與 GPT-6Luna。這兩款新模型採用了與 GPT-6Astra 類似的方法進行訓練,旨在將 Astra 在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,帶入速度更快、更經濟的小尺寸模型中。官方表示,雖然 GPT-6Astra 依然是追求最佳效果和無妥協體驗的首選,但 Sol 與 Luna 在大幅降低成本的同時,展現出了極其強悍的綜合競爭力。在價格方面,GPT-6Sol 和 Luna 模型的 API 價格相比 GPT-5.6的促銷價直接降低了50%。此外,OpenAI 還針對基於 GPT-6的開發者優化了提示緩存,默認提供更高的緩存命中率,幫助智能體重用更多上下文,從而實現更快的響應並進一步節省費用。在核心性能表現上:業務流程與智能體表現:在 AutomationBench 跨應用業務流程測試中,GPT-6Sol 在高強度下表現優於 Claude Opus5,且成本僅為其每任務成本的9%;在 Last Exam 智能體評估中,GPT-6Sol 的得分超越了 Claude Opus5的最高分,同時每任務成本降低60%。事實可靠性:在去標識化的真實世界對話中,GPT-6Sol 的錯誤率約為前代的一半,接近 Astra 級的可靠性,Luna 的事實可靠性也迎來了大幅提升。編程與軟件工程:兩款模型均針對 AI Coding Agent 工作負載進行了深度優化。在 DeepSWE v1.1軟件工程測試中,GPT-6Sol 取得68.8% 的成績,距離最高成績僅差1.1個百分點,單任務成本卻低約80%;

剛剛

OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估

據相關報道,該公司計劃打破傳統的內部閉環測試模式,將第三方獨立機構正式引入 AI 模型開發週期的更早階段,對其進行系統性的安全風險評估。為了確保這一創新機制能夠真正發揮實質性作用,OpenAI 同時明確了此類外部評估得以有效開展的核心優先事項。

剛剛