OpenAI 最強 AI 模型:GPT-5.6 系列正式上線,納德拉稱微軟 Copilot 同步接入

重點摘要
首頁 > 智能時代>人工智能 OpenAI 最強 AI 模型:GPT-5.6 系列正式上線,納德拉稱微軟 Copilot 同步接入 2026/7/10 6:46:08 來源:IT之家 作者:故淵 責編:故淵 評論: 感謝IT之家網友 華南吳彥祖、木木人工、南琴梨、Nuc_F、軟媒用戶1053564、對的時間點、改名只需三秒 的線索投遞!
OpenAI 公司於 7 月 10 日正式宣布,旗下新一代大型語言模型 GPT-5.6 系列已在 ChatGPT、Codex 以及 API 平台上線。這一系列模型不僅在能力上再度突破,更針對不同使用場景與預算需求,推出三種規格供開發者與企業選用。OpenAI 在官方公告中指出,GPT-5.6 系列代表了目前公司在語言模型領域的最新成果,涵蓋從旗艦效能到高性價比的多層次選項。本次推出的三款模型分別以太陽系天體命名:旗艦版本「Sol(太陽)」定位為最強效能,每 100 萬 Tokens 輸入收費 5 美元(約合新台幣 110 元),輸出則為 30 美元(約合新台幣 660 元)。
均衡版本「Terra(地球)」主打效能與成本的平衡,每 100 萬 Tokens 輸入 2.5 美元(約合新台幣 55 元),輸出 15 美元(約合新台幣 330 元)。主打速度與低成本的是「Luna(月亮)」,每 100 萬 Tokens 輸入僅需 1 美元(約合新台幣 22 元),輸出 6 美元(約合新台幣 132 元)。這樣的定價策略讓不同規模的團隊都能找到合適的選擇,尤其 Luna 版本對於需要大量調用 API 的應用場景極具吸引力。在模型能力方面,GPT-5.6 Sol 被 OpenAI 稱為有史以來最強的模型。
它不僅繼承了前代的推理優勢,更引入全新的「Max 推理強度」機制,讓模型在處理高度複雜的問題時能投入更多運算資源,以換取更精準的答案。此外,Sol 還支援「Ultra 模式」,該模式能透過調用子智能體來加速處理多步驟、多面向的複雜任務,大幅提升效率。這項新能力的實際成效在程式碼生成領域獲得驗證。OpenAI 表示,在 Terminal-Bench 2.1 評測基準中,GPT-5.6 Sol 在標準模式下取得了 88.8% 的得分,一舉超越競爭對手 Anthropic 的 Claude Mythos 5(此前最佳成績為 88.0%)。
更令人矚目的是,當開啟 Ultra 模式後,Sol 的得分進一步躍升至 91.9%,再度刷新業界紀錄。這意味著在實際的編程輔助、終端指令生成等應用中,開發者可以獲得更高的正確率與更流暢的互動體驗。除了 OpenAI 自身的平台,微軟也迅速跟進。微軟執行長薩蒂亞·納德拉(Satya Nadella)同日在 X 平台發文宣布,GPT-5.6 系列模型已同步整合至微軟 Copilot 生態系統中。具體涵蓋 Copilot Chat、Cowork、M365 應用程式、GitHub 以及 Foundry 等服務。
這項整合讓廣大的微軟用戶無需額外設定,即可在熟悉的生產力工具中體驗最新一代 AI 模型帶來的效能提升。納德拉的宣布凸顯了 OpenAI 與微軟之間緊密的合作關係。自 OpenAI 成立以來,微軟已累計投入超過 1000 億美元,並在 Azure 雲端平台上獨家提供 OpenAI 模型服務。此次 GPT-5.6 系列在第一時間登陸 Copilot 家族,不僅強化了微軟在 AI 辦公領域的競爭力,也讓企業客戶能更快導入最新技術,從日常文書處理到程式開發都能獲得即時幫助。值得注意的是,GPT-5.6 系列中的 Codex 模型也朝向更通用的 AI Agent 方向發展。
Codex 原本專注於程式碼生成,如今 OpenAI 將其定位為具備通用任務處理能力的智能代理,能理解並執行更廣泛的指令。這項轉變意味著未來開發者可能不僅用它來寫程式,還能透過自然語言指派諸如數據分析、系統管理、自動化流程等複雜工作。對於開發者社群而言,GPT-5.6 系列的上線提供了更多選擇。API 用戶可根據任務的困難度與預算靈活切換 Sol、Terra 或 Luna 三種模型,無需綁定單一方案。例如,需要高品質長篇內容生成或科研級推理時可選 Sol;日常客服機器人、翻譯等中階任務可選 Terra;而大量低延遲的簡單問答則可交給 Luna,以最低成本獲得最佳吞吐量。
OpenAI 在公告中並未詳細說明 GPT-5.6 系列在其他領域(如多模態、安全性)的改進細節,但強調 Sol 在邏輯推理、數學、科學問答等多項內部測試中均達到領先水準。隨著模型正式開放,外界預期將有更多第三方評測與實戰應用報告出爐,進一步驗證其真正實力。目前 GPT-5.6 系列已陸續向全球用戶推送,ChatGPT 付費訂閱用戶與 API 使用者均可立即試用。微軟 Copilot 用戶則可透過更新後的使用者介面直接呼叫新模型,享受更流暢、更聰明的協作體驗。業界分析認為,OpenAI 與微軟聯手加速迭代,將持續推動 AI 應用從實驗階段邁向大規模生產部署。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。