GPT-5.6全量放送,Codex正式併入ChatGPT

重點摘要
OpenAI 正式推出 GPT-5.6 系列模型,主打高性價比與快速回應,並將 Codex 整合進 ChatGPT 推出 ChatGPT Work 功能,使其成為能處理編碼、對話與辦公任務的超級入口。儘管 GPT-5.6 Sol 在極難任務上仍不如 Anthropic 的 Fable 5,但其更低的價格、更快的速度與可靠的日常表現,讓用戶更願意大量使用,消耗的 token 數量顯著增加。
美國時間7月9日,OpenAI正式全面推出GPT-5.6系列模型,同時也宣布將Codex直接整合進ChatGPT,不再是過去那種只開一個入口的方式,而是把Codex完全變成ChatGPT的一部分,連App圖標都改成ChatGPT風格,但使用者仍可選擇保留原圖標。這項更新最受關注的焦點之一,就是ChatGPT Work的登場——簡單來說,就是把Codex的能力放進了ChatGPT,成為一個可以跨應用與檔案採取行動的代理人,必要時能跟著一個項目連續工作數小時,並把目標直接變成完成品。OpenAI在直播中由執行長奧特曼親自介紹,強調ChatGPT Work是「真正的大件事」。
從功能設計來看,ChatGPT現在有三個主要入口:Chat負責一般對話、Codex繼續服務開發者與技術人員、Work則負責通用辦公任務。Codex本身依舊存在,但它的核心能力——接任務、讀上下文、調用工具、分步驟執行、最終交付結果——被抽象出來,放進了ChatGPT Work。如此一來,ChatGPT往「超級入口」又邁進了一步。GPT-5.6系列分為Sol、Terra、Luna三個版本,官方明確定位:Sol負責複雜任務,Terra處理日常任務,Luna則適合高頻、輕量、容易驗證的工作。API定價方面,每100萬token計費,Sol輸入5美元、輸出30美元;Terra輸入2.
5美元、輸出15美元;Luna輸入1美元、輸出6美元。對比之下,Sol的輸入價格只有Claude Fable 5的一半,輸出價格低40%。OpenAI還提到,GPT-5.6支援更可預測的prompt caching,緩存讀取享有90%折扣,進一步降低長上下文任務的實際成本。速度方面也是亮點。官方指出Sol最高可達每秒750個token,換算成中文約每秒500到700個漢字,能大幅壓縮模型思考與生成的時間,帶來明顯的「秒回」感。這樣的表現讓許多用戶願意將大量日常任務、細節檢查、上下文判斷交給它處理。在官方評測方面,OpenAI在正式上線時一併公布了更完整的結果。
在Agents' Last Exam這個評估長時間專業工作流的測試中,GPT-5.6 Sol拿到53.6分,比Claude Fable 5高出13.1分;即便只開啟中等推理強度,也能以約四分之一估算成本超越Fable 5。OpenAI還強調,Terra與Luna甚至能在大約十六分之一的成本下超越Fable 5。這清楚說明了OpenAI這次的敘事重點:不再只比誰最強,而是比誰能以更低成本完成更多任務。不過,除了官方數據,更多使用者回饋已經在社群平台上流傳。許多獲得早期訪問權限的網友分享了自己的實際體驗,普遍認為GPT-5.
6 Sol在極限攻堅上仍不如Claude Fable 5,但在日常協作上卻更受信賴。有人形容Sol像一位「有魅力、高效、有才華的同事」,而Fable則像「有點擰巴的天才,在自己執著的問題上極其出色,但不適合日常相處」。也有網友指出,自己的團隊在使用模型時向來保守,但GPT-5.6卻讓他們的token消耗量暴增五倍,原因是團隊更願意將更多細節交給模型處理,反覆檢查決策、處理邊緣情況,提升既有工作的品質。代碼能力方面,Vercel的Next.js技術負責人Tim Neutkens測試Sol超過兩個月,表示Sol能理解架構取捨,在調查複雜的Next.
js專案時幾乎不需太多指導,並已參與伺服器端的大型重構,只需給出高層次方向就能端到端實現。但也有早期用戶認為,GPT-5.6 Sol並未帶來如Fable那樣的巨大變化或全新架構,更像是在GPT-5.5基礎上充分打磨的升級版,考慮到價格與5.5相同,能力確實有提升,但仍稱不上突破性進展。值得注意的是,有網友透露GPT-5.6將是5.x系列的最後一批模型,GPT-6可能在本月下旬或下個月發布。這項消息也讓這次更新被視為一個過渡版本,而非標準意義上的大代際躍遷。與此同時,其他AI公司也在近期推出主打性價比的模型。xAI的Grok 4.
5每100萬token輸入2美元、輸出6美元,並強調約2倍的token利用率;Meta的Muse Spark 1.1更便宜,輸入1.25美元、輸出4.25美元。這反映出整個產業正從過去「比誰馬力大」的跑車競賽,轉向「比誰省油耐用」的商用車思維。OpenAI、xAI、Meta都在往這個方向靠,把足夠強的模型做得更便宜、更快、更適合規模化調用。然而,Anthropic選擇了另一條路。它同樣在發展工作流程,但更強調協作品質與人的判斷,而非單純的規模化調用。例如凌晨推出的「Reflect with Claude」功能,讓用戶回顧過去使用Claude的模式,思考哪些事適合交給AI、哪些仍應自己完成。
Anthropic的主流模型氣質與OpenAI不同,而從市場估值與用戶迴響來看,擁有頂級模型Fable(Mythos)的Anthropic似乎暫時佔了上風。不過,OpenAI這次更新顯然也帶來了壓力——Anthropic不僅將Fable 5的使用限制延長到7月12日,還為所有用戶重置了限額。有競爭,才會有動力。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。