鈦媒體生成式AI

GPT-5.6開放,跑分之外的隱憂:Anthropic反超、微軟去OpenAI化

2026年7月11日 08:01
GPT-5.6開放,跑分之外的隱憂:Anthropic反超、微軟去OpenAI化

重點摘要

GPT-5.6開放,跑分之外的隱憂:Anthropic反超、微軟去OpenAI化硅谷Tech news2026.07.11 08:00 · 來自北京全文4229字00:00 / 10:48GPT-5.6被稱作“實用智能”,但OpenAI的麻煩才剛剛開始。貼上“實用智能”標籤的同時,OpenAI在競品、生態和監管三條線上同時承壓。北京時間7月10日凌晨,OpenAI正式宣佈GPT-5.

站內 AI 整理稿

# GPT-5.6全面開放,跑分之外的隱憂浮現:Anthropic逆襲、微軟「去OpenAI化」加速

北京時間7月10日凌晨,OpenAI正式宣佈GPT-5.6系列模型面向全球公眾全面開放。從6月底僅限約20家政府批准合作方的「限量預覽」,到如今的全球推送,這款被貼上「實用智能」標籤的模型系列走過了一條比任何前代產品都更曲折的發佈之路。然而,在技術亮眼的跑分成績單背後,OpenAI正面臨來自競爭對手、生態夥伴與監管部門的三重夾擊,一場更深層的商業與戰略危機正在醞釀。 ## 三款型號分層亮相,產品策略全面重構

GPT-5.6系列共包含三個型號——旗艦版Sol(太陽)、均衡版Terra(地球)與輕量版Luna(月亮)。這套命名體系本身就傳遞出明確信號:OpenAI正在放棄過去「一個模型打天下」的策略,轉而針對不同場景與預算提供分層選擇。定價方面,Sol定位高端複雜任務,輸入價格為每百萬Token 5美元、輸出30美元;Terra面向日常工作,定價2.5美元與15美元;Luna則主打性價比,分別為1美元與6美元。其中Terra以接近減半的成本提供了接近GPT-5.5的性能表現,顯然是瞄準了企業客戶對成本效益的敏感需求。同步亮相的還有企業級智能體產品ChatGPT Work,以及GPT-5.

6成為Microsoft 365 Copilot「首選模型」的消息。ChatGPT Work專為多步驟、長週期的複雜項目設計,用戶只需輸入終極目標,系統便能自動拆解任務並持續數小時跟進,整合了聊天、工作與Codex代碼執行能力,將ChatGPT從「問答工具」升級為「執行引擎」。OpenAI還為GPT-5.6引入了「max」與「ultra」兩種新運行模式,前者給予模型更多推理時間,後者則默認協調4個並行子智能體,API最高可配至16個。內部數據顯示,agentic token使用量增長約22倍,智能體方向已成為OpenAI的核心戰略重心。## Anthropic逆襲:企業市場份額首度超越

一個月前,Anthropic接連發布Claude Fable 5與Mythos 5,Google也放出了Gemini 3.1 Pro Preview,AI大模型領域的「三國殺」格局已然成型。從技術跑分來看,GPT-5.6 Sol在智能體綜合能力、網絡安全、生命科學等領域建立了顯著優勢,但Claude Fable 5在編程與數學推理上仍保持領先。在SWE-Bench Pro編程評測中,Fable 5以80%的成績領先於Sol的64.6%;在FrontierMath高難度數學測試中,Fable 5達到87.8%,Sol則為83%。頭部模型的競爭已進入「各有擅長」的階段。

但真正令OpenAI警惕的並非技術指標的此消彼長,而是市場份額的實質性變化。Ramp於2026年5月發布的AI指數顯示,Anthropic在企業API市場份額上首次反超OpenAI,分別為34.4%與32.3%。從宏觀格局來看,全球大模型市場呈現「四巨頭」態勢:OpenAI約35%、Anthropic約25%、Google約20%、Meta約10%。OpenAI雖仍是最大玩家,但領先優勢正在以肉眼可見的速度收窄。Anthropic能夠在編程與數學這兩個開發者核心場景建立優勢並非偶然。

其安全對齊路線在企業客戶中積累了更強的合規口碑,而OpenAI接連卷入監管風波,導致部分企業客戶在採購決策上產生了遲疑。對於依賴開發者生態與企業訂閱的AI公司而言,信任危機往往比技術落後更具殺傷力。## 微軟「去OpenAI化」:從獨佔到首選的微妙轉變

如果說Anthropic的逆襲是來自外部的競爭壓力,那麼微軟的戰略調整則來自生態內部,影響更為深遠。GPT-5.6發佈當天,OpenAI宣佈該模型成為Microsoft 365 Copilot的「首選模型」。然而,「首選」並非「獨佔」,這個措辭的微妙差異背後,是微軟正在悄然推進的「去OpenAI化」戰略。發佈前兩天,彭博社報道微軟已在Excel與Outlook中使用自研MAI系列模型替代OpenAI產品,每週數萬個AI請求完全由MAI處理。在微軟Build 2026開發者大會上,該公司發佈了7款自研MAI模型,號稱成本效率較GPT-5.5提升十倍。從商業邏輯來看,這是供應鏈安全的必然選擇。

微軟與OpenAI的獨家協議已於2025年重新談判,當前協議有效期至2032年,但屬於非獨家技術授權。GPT-5.6成為「首選」而非「獨選」,印證了合作仍在、但依賴正在減少。更深層的原因在於,微軟不希望核心生產力工具長期建立在第三方模型之上。成本可控性與戰略自主性,才是「去OpenAI化」的真正驅動力。這一趨勢若持續加速,將迫使OpenAI加快獨立商業化步伐,而ChatGPT Work正是這一戰略轉向的關鍵落子。從「賣模型」到「賣服務」,OpenAI正在努力證明自己不僅僅是微軟生態中的一個模型供應商,而是能夠獨立構建企業級應用的能力平台。## 版權訴訟升級,17家媒體聯合申請制裁

GPT-5.6發佈當天,《紐約時報》、《紐約每日新聞》等17家媒體機構聯合向聯邦法官申請對OpenAI實施「嚴重製裁」,指控其隱瞞和銷燬使用版權新聞內容訓練模型的證據。這場始於2023年底的訴訟,《紐約時報》已投入超過2800萬美元,成為AI行業最具標誌性的版權案件。在版權問題上,行業呈現出截然不同的兩種路線。Anthropic已就類似訴訟向圖書作者支付15億美元和解金,選擇了「花錢消災」的方式。而OpenAI則堅持「合理使用」立場,拒絕和解。這一選擇背後是戰略判斷:一旦和解,等於承認「未經許可使用版權內容訓練模型」不合法,將從根本上動搖整個AI行業的數據獲取模式。

但代價是,訴訟結果將直接影響OpenAI商業模式的法律根基,一旦敗訴,其訓練數據來源與模型合法性都將面臨顛覆性挑戰。## 監管審查制度化,安全合規成本陡增

第三個不確定性來自監管層面。6月26日OpenAI首次預覽GPT-5.6 Sol時,特朗普政府以「潛在安全風險」為由,要求僅向經政府批准的約20家合作方開放。這是美國政府首次將AI安全審查落地為具體限制措施。該行政令的背景是6月簽署的AI安全指令,要求主要開發商在發佈高能力模型前自願提交安全評估。同期,Anthropic的Mythos與Fable模型也曾被白宮限制出口,直至6月30日才獲放行。此後兩週,OpenAI與美國商務部、財政部進行了密集磋商。Sam Altman表示公司在溝通期間對模型做出了「許多調整」。7月8日,商務部完成審查後未提出異議,GPT-5.6獲准全面發佈。

據《華盛頓郵報》報道,白宮最初試圖給GPT-5.6「套上韁繩」,反映出對前沿AI在生物安全、網絡安全和地緣政治風險方面的深層焦慮。OpenAI發佈的System Card顯示,公司在安全測試上投入了超過70萬GPU小時的計算資源,並推出了Trusted Access計劃,要求用戶驗證身份才能使用網絡安全功能。這一模式可能成為未來AI大模型發佈的「新常態」:政府不再是旁觀者,而成為實質性的審查參與者。對於OpenAI而言,獲得政府批准本身也成為向企業客戶證明安全性的重要籌碼,但每代新模型都將面臨更長的審批週期與更高的合規成本。## 從跑分競賽到商業閉環,AI競爭進入下半場

GPT-5.6的發佈已在資本市場激起漣漪,港股科技板塊隨之上漲。但市場對「AI敘事」的定價正趨於理性,投資者更加關注模型的實際商業化落地能力。OpenAI最新私人估值為8520億美元,IPO目標估值傳聞達1萬億美元,年營收約250億美元。但Sam Altman在被問及今年是否會IPO時回答「不知道」——非營利組織起家的治理結構與上市公司透明度要求之間存在根本性張力。即便不考慮治理問題,版權訴訟的懸而未決也讓潛在投資者難以給出合理定價。從產業競爭的角度來看,GPT-5.6面臨的真正考驗不在跑分榜上。

監管審查的制度化意味著每代模型都將面臨更嚴格的合規成本;企業端份額的鬆動表明技術領先不自動轉化為市場領先;與微軟關係的微妙變化要求OpenAI加快獨立商業化步伐;版權訴訟的懸而未決則可能動搖其商業模式的根基。技術領先固然重要,但誰能率先構建起「技術—產品—商業—合規」的完整閉環,誰才能在AI這場持久戰中走得更遠。OpenAI將GPT-5.6定義為「實用智能」,不再追逐AGI的宏大敘事,而是聚焦於嵌入企業工作流、解決具體問題。從Sol到Terra再到Luna,從太陽到地球到月亮,覆蓋從高端到普惠的完整光譜。

這套產品矩陣的設計邏輯清晰,但能否真正奏效,取決於企業客戶是否願意為「智能體」而非「模型」付費,以及Anthropic與Google在企業端的追趕速度。當AI從被動回答問題轉向主動完成任務,企業採購AI的決策邏輯也將隨之改變——不再是「哪個模型更強」,而是「哪個平台能真正解決我的業務流程」。這場競賽,才剛剛開始。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

3 小時前