剛剛,高通2nm雙旗艦來了,為智能體AI重造架構,手機能跑300億參數大模型

2026年9月22日 23:17
站內 AI 整理稿

作者 | ZeR0 編輯 | 漠影 剛剛,高通最強手機芯片來了!夏威夷毛伊島9月22日現場報道,在驍龍峰會2026上,高通一口氣推出兩款採用2nm製程的旗艦芯片——第六代驍龍8超級至尊版和第六代驍龍8至尊版。這是高通首次在旗艦產品線同時推出兩款驍龍8至尊版平臺,也是驍龍平臺首次採用2nm製程。下一代AI智能體設備會是什麼樣子?高通展示了榮耀Robot Phone、阿里原生智能體電腦Qwen Book、努比亞NaviX Ultra上的豆包手機助手等全球最早一批智能體設備,使用驍龍移動平臺實現的全新智能體體驗。

高通總裁兼CEO安蒙在演講中說,我們剛剛進入智能體時代的開端,智能體需要全新系統架構,而驍龍正是為這個時代打造的平臺。連高通為數據中心AI芯片設計的全新計算引擎HBC(高帶寬計算)技術也被縮放到手機,以顯著提升效率。HBC將作為驍龍平臺的協處理器,把內存和AI處理單元放得更近,提供下一代AI智能手機所需要的速度、能效和性能。高通還會將這個技術帶入整個邊緣計算體系,包括筆記本電腦、智能眼鏡和汽車。全新第六代驍龍8超級至尊版圍繞智能體,將CPU、GPU、NPU、ISP和整個系統架構全面優化,使更多智能在更靠近處理器側運行,性能、能效、AI能力和影響表現都顯著增強。

尤其在讓內存更靠近處理器這件事上,高通做了多重優化,包括CPU的可擴展先進緩存架構FlexCache、GPU的高性能內存(HPM)和NPU的大容量共享內存。面向模型及智能體推理,第六代驍龍8超級至尊版端側可支持300億參數級別的MoE混合專家模型,並配備Element Accelerator來改善Transformer工作負載。面向遊戲體驗,該處理器搭載Adreno Neural Fusion,配合Matrix Cores,支持AI幀生成、AI超分、在圖形管線內部直接進行神經引擎運算。

面向攝影,第六代驍龍8超級至尊版通過智能像素控制、支持3DLUT的Elite Color Engine、智能防抖和Motion Intelligence等提升移動影像體驗。面向專業內容創作,其支持影視級視頻能力,包括APV、8K 60fps視頻拍攝、4K 240fps超高清超慢動作視頻拍攝,並支持新視頻編碼標準VVC。連接上,新移動平臺搭載全球首款面向3GPP Release 19就緒的調製解調器及射頻系統——高通X105 5G調製解調器及射頻系統,為6G奠定基礎。小米集團高級副總裁兼國際業務部總裁曾學忠現場宣佈,今天,小米將首發搭載第六代驍龍8雙旗艦平臺的新機。

小米澎湃OS 4和高通第六代驍龍至尊版在整體任務調度、內存管理、運行時等系統層面聯合優化,進一步改善IPC性能、緩存命中率及系統能效,並在一個高負載開放世界手遊中實現單幀功耗大降38%。搭載第六代驍龍8超級至尊版的小米18 Pro Max,進一步追求峰值性能,帶來更強AI性能和散熱系統。新一輪安卓旗艦大戰,總算正式開打。一、第六代驍龍8超級至尊版:移動CPU衝到5GHz,GPU首搭AI專用核 第六代驍龍8超級至尊版是高通迄今性能最強的移動平臺,不僅面向智能體重新設計整個架構,而且將AI、通用計算、遊戲、影像性能全面升級。

高通給CPU、GPU、NPU通通改造,通過縮短數據傳輸路徑及多種創新技術,實現更低的時延、更高的能效、更穩定持久的智能體、遊戲和攝影體驗。1、Oryon CPU:8核,5GHz,引入新緩存架構 CPU搭載高通定製Oryon CPU內核,採用8核架構(2個超級內核、6個性能內核),主頻最高達到5GHz,性能內核主頻最高達到4GHz。這是業界首個主頻突破5GHz的移動CPU。當然,僅僅有高主頻是不夠的,先進指令集、IPC優化、Oryon架構和FlexCache緩存架構缺一不可。先進指令集和更高的IPC協同能更快完成計算任務;Oryon CPU架構採用異構設計,使不同內核能高效訪問數據。

高通還引入了全新緩存架構FlexCache,可動態分配緩存池,讓所有內核可訪問一個共享L2緩存池,並根據不同核心的實際需求動態分配資源,實現更高效的任務切換。智能體通常會頻繁遷移線程,調用跑在不同核心上的工具。這種設計則可以讓智能體在運行高負載任務時,不會降低響應速度。不止是AI,對於遊戲、視頻編輯、多任務處理及各種短時性能爆發場景,FlexCache也能帶來更好的表現。2、傳感器中樞:讓智能體持續感知 全新高通傳感器中樞使系統保持持續感知,無需喚醒主應用處理器,以超低功耗處理語音、活動及個人上下文信息。

其搭載新一代雙Micro NPU架構,性能提升高達85%,能效提升20%,可支持擁有2億參數的模型,並升級了個人記錄功能。個人記錄有助於從用戶選擇保留的信息、參與的對話和關注的重要內容中不斷學習,持續積累私密安全的個人知識庫,為智能體提供越來越豐富的上下文。3、Hexagon NPU:300億參數模型跑在手機上 NPU有兩大關鍵創新。一是全新Element Accelerator,專為Transformer工作負載打造,結合向量計算單元和標量計算單元,支持最高32k token上下文窗口,可加速大模型運算,幫助智能體更快地響應、更高效地推理。

二是將共享內存擴容50%,能大幅減少訪問外部DDR的次數,將更多上下文和KV cache數據保留在NPU內部,降低時延,省出更多寶貴的內存帶寬。在部分模型上,新一代NPU的預填充性能最高提升80%。高通聯手階躍、無量火與江波龍,基於第六代驍龍8超級至尊版,率先將階躍StepEdgeOmni 300億參數級混合專家(MoE)模型完整部署於端側,打造具備全鏈路智能體AI能力的端側智能助手,可在不犧牲推理精度的情況下,將內存需求降低超過50%。通用閃存存儲UFS 5.0支持從閃存中動態流式加載模型參數,讓設備能夠使用更大的AI模型,突破傳統移動設備內存容量的限制。

4、Adreno GPU:第一次引入AI專用核心 Adreno GPU實現了44%的性能提升和14%的能效提升,有四大亮點: (1)圖形性能和能效均實現代際提升,基於三切片架構,將每個切片的頻率提升了250MHz。(2)搭配18MB第二代Adreno高性能內存(HPM),讓內存更靠近IP模塊,減少DDR數據讀取,實現功耗降低12%,支持開發者按需分配內存資源。(3)首次引入GPU專用核心Matrix Cores,該核心是專用用於AI的GPU核心,將AI工作負載保留在圖形管線裡,可降低功耗、延遲並增強圖形體驗。至此,高通NPU、CPU、GPU核心引擎均已加持矩陣加速能力。

(4)部署Matrix Cores的直接成果是Adreno Neural Fusion,將AI超分、AI幀生成、神經網絡處理結合到一起,能實現AI和圖形處理之間更緊密地結合,神經網絡計算無需離開圖形渲染管線即可完成,改變移動遊戲渲染方式,實現更流暢的遊戲體驗、更高的圖像質量及更好的能效。這些技術協同運作,支撐智能體AI絲滑運行:傳感器中樞始終保持環境語音感知,CPU負責指揮、編排、調度整個工作流程,NPU和GPU可共同支持AI推理。5、Spectra ISP:給AI提供“視覺上下文” ISP可幫助智能體構建記憶和個性化能力。

Spectra ISP已成為一個多模態引擎,能理解攝像頭看到的內容,並把圖像和視頻轉化成有意義的上下文信息。第二代AI ISP與NPU協同,在拍攝的同時做智能處理,由此將視頻吞吐量提升至2倍,使用戶首次能在商用終端上拍攝8K 60fps的視頻;超級慢動作視頻的分辨率進一步提升,支持4K 240fps拍攝。新一代ISP引入智能像素控制,能為每個像素分配16位AI數據,信息精細度是前代的256倍。因此,Spectra ISP能更好地理解場景中的每個細節。每個像素能夠讀取和保存更多數據,意味著能跨幀持續追蹤一個拍攝對象,或者獲得更豐富的語義分割內容。

6、連接:5G基帶及射頻+WiFi 8 新平臺搭載高通X105 5G調製解調器及射頻系統和FastConnect 8800芯片,為蜂窩網絡和無線連接提供AI增強能力,助力邁向6G。高通X105 5G調製解調器及射頻系統支持5G衛星(NR-NTN),採用6nm射頻收發器,是全球首款面向3GPP Release 19標準就緒的調製解調器。FastConnect 8800是高通推出的Wi-Fi 8解決方案。這款4合1集成芯片支持最新Thread,是首款採用4×4 Wi-Fi射頻配置的移動解決方案,支持超寬帶及長距離覆蓋,讓用戶的手機能夠成為智能家庭中樞。這種系統級設計思路也延伸到芯片的物理封裝。

高通在超級至尊版中開發了一種新的散熱設計方法Offset Package-on-Package,重新設計了內存與芯片在封裝內部的排列方式,可形成一條效率更高的散熱路徑,更快將熱量從處理器中到處,還支持更高集成度的設備設計。這種設計能幫助設備進一步擴大可用的散熱空間和熱設計餘量,也能給OEM廠商更大的設計靈活性,使其能優化整機設計並探索新的產品形態。最終其在高工作負載下,峰值性能的持續時間可達到此前的2倍以上。

二、第六代驍龍8至尊版:把新架構帶到更廣泛的旗艦手機 第六代驍龍8超級至尊版專為最先進的AI工作負載和定義智能體時代的全新體驗而設計,旨在打造覆蓋AI、遊戲、視頻、影像等各項技術領域的頂尖旗艦體驗。而第六代驍龍8至尊版旨在面向更廣泛的終端打造旗艦體驗,在性能和智能之間實現平衡。AI:通過高通Hexagon NPU的升級,在旗艦智能手機上實現智能、靈敏且高效的AI體驗。性能:高通定製Oryon CPU可提供快速、靈敏的旗艦級性能,兼顧高端性能、智能能力與能效。遊戲:實現先進圖形能力、靈敏流暢的遊戲操控和持續穩定的性能,帶來旗艦級移動遊戲體驗。

影像:通過智能像素控制、Elite Color Engine增強、智能防抖和Motion Intelligence等功能,為旗艦智能手機帶來先進的拍攝與視頻能力。連接:搭載高通X105 5G調製解調器及射頻系統和 FastConnect 8800,提供AI增強的蜂窩網絡與無線連接能力。三、手機成個人智能體起點,需要全新系統架構設計 在驍龍峰會2026上,高通總裁兼CEO安蒙發表演講,談到我們正從以手機為中心的模式過渡到以智能體為中心的新體驗模式,智能體將成為整個體驗的中心,這將改變思考智能手機角色的方式。“我認為,我們終於走到了一個可以看清楚「AI智能手機究竟是什麼」的階段。

”安蒙說,“我們正在從app和助手,走向智能體。” AI進步飛速,混合專家模型(MoE)、編排器、新模型、MCP協議等快速發展,智能體開始長出各種“技能(skill)”。這些技術共同推動手機向AI智能手機轉型。安蒙分享了三大重要觀點: 其一,AI正從“應用驅動”轉向“意圖驅動”。過去二十年裡,從智能手機誕生之初開始,整個智能手機體驗一直都是圍繞app組織起來的。而在智能體時代,智能體是通過理解你的意圖,替你完成各種事情。這種特性與手機高度個性化和定製、持續在線、多模態感知的能力天然適配。這是“屬於你的智能體”,所以權限和控制權會變得非常重要,這些權力必須掌握在用戶手中。

其二,智能手機是個人智能體時代的起點。智能手機是個人智能體首要載體,是最瞭解你的設備,始終伴你左右,並能夠感知你所處情境。未來的體驗會越來越少地圍繞“打開和操作app”展開,而會越來越多地圍繞“替你完成任務”展開,智能體將要求設備承擔遠遠超過“執行命令”的工作。個人智能體不止在手機,而會伴隨用戶在手機、PC、汽車、智能手錶、智能眼鏡、智能吊墜、智能胸針及其他設備間流轉,整個體驗無縫,且能持續跨設備延續。而手機將成為整個個人AI系統的計算、記憶與連接樞紐。工作負載會根據每項任務的具體需求,在雲端及所有可用的計算資源之間進行分配。其三,智能體需要一套全新系統架構。

智能體必須能感知正在發生什麼,理解你的意圖和上下文,進行推理、規劃和記憶,並代表你採取行動。手機上會開始出現一些全新功能,比如訪問你的個人知識,安全地獲得你願意授予的權限,以及智能體代表你採取行動的能力。這創造了系統級設計新機會,涉及混合AI、跨設備智能、任務編排與異構計算。無論智能體直接運行在設備上,還是被集成到操作系統中,它都必須在模型、app、服務和數據之間完成大量協同,才能提供這些體驗所需要的性能、能效和響應速度。

因此,需要重新思考計算引擎應該如何設計:智能體編排需要更高的CPU性能,NPU加速器能夠提供高能效的AI推理能力,GPU則會負責AI中並行計算任務,在完成這些AI工作的同時,還需保持全天候的電池續航。結語:個人智能體競賽開場,高通先把基礎設施鋪好了 圍繞智能體工作方式,高通重新設計旗艦手機芯片,從系統層面處理智能體的AI、計算、連接、內存、感知、安全和功耗效率協同運作。通過優化CPU緩存架構、在GPU中加入AI專用核心和搭配獨立高速顯存、在NPU增加Transformer加速器和擴容內存、傳感器中樞裡的低功耗感知,新一代驍龍雙旗艦移動平臺,讓手機在有限的功耗預算內能夠完成更復雜的連續智能任務。

個人智能體的競賽才剛剛開始。高通從底層帶來適應未來個人智能體發展的基礎設施。接下來,就看終端廠商與軟件開發者們如何發揮創意,藉助隨時在線的個人智能體和更快、更無縫、更流暢的移動體驗,將AI更好地轉換成用戶每天使用的生產力。

Related

相關文章

智東西生成式AI

Anthropic深夜放大招:Claude Opus 5.5上線,任務成本大降40%

智東西(公眾號:zhidxcom) 編譯 | 楊京麗 編輯 | 李水青 智東西9月23日消息,今天凌晨,Anthropic發佈Claude Opus 5.5,這是Claude 5.5系列的首款模型。Anthropic稱,新模型在多數任務上的表現與Claude Fable 5.1相當,默認設置下的典型任務成本較上一代Opus 5降低40%,輸出速度提升超過30%。 在官方公佈的9項測試中,Opus 5.5有7項成績領先Fable 5.1、Opus 5、GPT-6 Astra和GPT-5.6 Sol。其中,Opus 5.5在三項編程測試中均取得最高分,但在業務流程和科研Agent測試中仍落後於GPT-6 Astra。 在第三方評測機構Artificial Analysis的Intelligence榜單上,Claude Opus 5.5以58分位列第一,領先Claude Fable 5.1和GPT-6 Astra的53分。 具體任務中,Anthropic披露,Opus 5.5用9.5小時完成了將負載均衡軟件HAProxy從C語言改寫為Rust的任務,成本比Fable 5.1低51%;在要求逐一核對數字和引語的財報研究測試中,其生成的18份報告有16份達標,Fable 5.1和Opus 5則均未通過。此外,一名早期測試者使用Opus 5.5,不到一天完成了涉及68萬行代碼的遷移。 價格方面,Opus 5.5每百萬輸入、輸出Token分別收費4美元(約合人民幣26.8元)和20美元(約合人民幣134元),較Opus 5下調20%;緩存讀取價格較Opus 5下降60%。與此同時,Anthropic提高了多個付費套餐的五小時使用額度,並向訂閱用戶提供一次可自行選擇使用時間的額度重置機會。 Opus 5.5已上線Claude及亞馬遜雲科技、谷歌雲、微軟Azure等平臺。不過,部分專業任務仍

剛剛

OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估

AI資訊AI新聞資訊正文OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估發佈於AI新聞資訊發佈時間 :2026年9月23號 9:11閱讀 :1分鐘面對外界持續增長的對人工智能潛在風險的擔憂,OpenAI 近期公佈了最新的安全治理動向。據相關報道,該公司計劃打破傳統的內部閉環測試模式,將第三方獨立機構正式引入 AI 模型開發週期的更早階段,對其進行系統性的安全風險評估。為了確保這一創新機制能夠真正發揮實質性作用,OpenAI 同時明確了此類外部評估得以有效開展的核心優先事項。具體包括四大關鍵支柱:必須具備強有力的獨立運作機制、嚴格遵循科學的嚴謹性、落實穩健的日常安全實踐,以及在各方之間劃分清晰明確的安全責任。這一舉措表明,隨著前沿人工智能模型的迭代速度不斷加快,行業頭部企業正在進一步主動向外部開放,通過引入客觀公正的第三方力量來共同構築安全防線,從而回應公眾與監管機構對技術可控性的長遠審視。相關推薦被指“OpenClaw換皮”後,Meta罕見承認:產品設計確實深受其影響Meta超級智能實驗室產品負責人Nat Friedman回應稱,AI代理Muse設計確受OpenClaw影響,但系從零創建。此前AI應用聯合創始人Ansh Nanda發帖稱Muse是面向普通用戶的OpenClaw,並曬對話顯示AI自認系統文件相似非巧合而是匹配。社區還發現Muse存在更多相似之處。2026年9月23號 9:1297.3kAI 基建遭反噬:Q2 美國 680 億美元數據中心項目因公眾反對受阻AI驅動數據中心建設在美國遇公眾強烈反對。研究顯示,今年二季度約680億美元項目延期或受阻,一季度達1300億,反對已覆蓋半數項目。Data Center Watch稱二季度共45個數據中心開發項目遭阻撓或延。2026年9月23號 8:5673.0kOpenAI 推出 GPT-6 Sol 和

剛剛

被指“OpenClaw換皮”後,Meta罕見承認:產品設計確實深受其影響

AI資訊AI新聞資訊正文被指“OpenClaw換皮”後,Meta罕見承認:產品設計確實深受其影響發佈於AI新聞資訊發佈時間 :2026年9月23號 9:12閱讀 :1分鐘Meta超級智能實驗室(MSL)產品負責人Nat Friedman日前在X上回應稱,旗下AI代理產品Muse“在產品設計上確實深受OpenClaw的影響”,但Muse本身“從零開始創建”。此番回應源於AI應用聯合創始人Ansh Nanda的一篇瘋傳帖子,後者稱“Muse簡直就是面向普通用戶的OpenClaw”,並曬出與Muse的對話,其中AI代理自認其系統文件與OpenClaw的相似性並非“巧合”而是“匹配”。社區隨後發現:Muse同樣包含一個SOUL.md文件——以Markdown編寫的純文本配置文件,用於定義AI代理的個性、溝通風格、價值觀、行為邊界與專業領域,且其內容與OpenClaw的文件幾乎完全相同。面對追問,Friedman未予否認,僅回覆“我們認為Peter(Steinberger,OpenClaw創建者)把這些都做得完全正確”。Friedman為前GitHub CEO,去年與Meta首席AI官Alexandr Wang一同加入Meta。他透露,今年一月試用OpenClaw後,曾為MSL團隊購買數百臺Mac mini,許多人由此愛上OpenClaw等個人代理軟件;開發Muse的目標是打造類似OpenClaw的產品,使其安全可靠、易於使用,並能擴展至數十億用戶。OpenClaw為開源項目,Meta借鑑其設計並不意外;OpenAI今年早些時候已挖走其創始人。這也延續Meta一貫策略:吸納有潛力的產品並複製其最佳功能,最著名的案例是對Snapchat Stories功能的借鑑。Muse目前反響熱烈,近期登頂美國App Store排行榜;若直接比較平臺與市場覆蓋範圍,其發展速度已超過ChatGPT。M

剛剛

OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成

AI資訊AI新聞資訊正文OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成發佈於AI新聞資訊發佈時間 :2026年9月23號 8:54閱讀 :2分鐘OpenAI 當日發佈 GPT-6 系列的最新成員——GPT-6 Sol 和 GPT-6 Luna。兩款模型採用與 GPT-6 Astra 類似的訓練方法,把 Astra 在專業工作、事實性、編碼、計算機使用和對齊等方面的最先進性能,帶入更快、更經濟的模型。OpenAI 也強調,GPT-6 Astra 仍是其整體最優秀的模型,追求無妥協體驗仍應首選它。價格砍半,成本最低不到競品一成GPT-6 Sol 和 Luna 的 API 價格相比 GPT-5.6 促銷價降低 50%。更值得注意的是單任務成本:在 AutomationBench 跨應用業務流程測試中,GPT-6 Sol 在 xhigh 強度下表現優於 Claude Opus 5,成本卻僅為 Opus 5 每任務成本的 9%;同一測試 high 強度下,GPT-6 Luna 較前代提升 5.4%,每項任務成本降低 58%。評估智能體的 Last Exam 測試中,GPT-6 Sol 在 max effort 狀態下得分 56.4%,高於 Claude Opus 5 在該評估中的最高分,每任務成本還降低 60%。事實可靠性同樣進步:GPT-6 Sol 的錯誤率約為前代的一半,接近 Astra 級可靠性且成本更低;Luna 的事實可靠性也大幅提升。性能逼近旗艦,長任務更省編程方面,兩款模型均針對 AI Coding Agent 工作負載優化。FrontierCode 1.1 Main 測試中,GPT-6 Sol 較 GPT-5.6 Sol 明顯提升,並以更低成本達到 Claude Fable 5.1 xhigh 相當水平。De

剛剛

Anthropic上線Claude Opus 5.5 ,任務成本大降 40%

AI資訊AI新聞資訊正文Anthropic上線Claude Opus 5.5 ,任務成本大降 40%發佈於AI新聞資訊發佈時間 :2026年9月23號 8:53閱讀 :3分鐘Anthropic 發佈 Claude Opus 5.5,這是 Claude 5.5 系列的首款模型。Anthropic 稱,新模型在多數任務上的表現與 Claude Fable 5.1 相當,但默認設置下的典型任務成本較上一代 Opus 5 降低 40%,輸出速度提升超過 30%。發佈約兩小時後,OpenAI 也推出了 GPT-6 Sol 和 GPT-6 Luna,GPT-6“宇宙”再添新成員。成本降四成、速度提三成,編程測試領跑在官方公佈的 9 項測試中,Opus 5.5 有 7 項成績領先 Fable 5.1、Opus 5、GPT-6 Astra 和 GPT-5.6 Sol。其中三項編程測試(Terminal-Bench 4.0、FrontierCode v1.1、CursorBench 4.0)均拿下最高分,分別為 66.4%、54.4% 和 57.8%;但在業務流程和科研 Agent 測試上仍落後於 GPT-6 Astra。第三方機構 Artificial Analysis 的 Intelligence 榜單上,Opus 5.5 以 58 分位列第一,領先 Fable 5.1 與 GPT-6 Astra 的 53 分。價格方面,Opus 5.5 每百萬輸入、輸出 Token 分別收費 4 美元(約 26.8 元)和 20 美元(約 134 元),較 Opus 5 下調 20%,緩存讀取價格下降 60%。Claude Code 與 Claude Platform 還提供快速模式,速度最高達普通模式 2.5 倍,相應收費為輸入 8 美元、輸出 40 美元每百萬 Token。Anthropic 同時

剛剛

OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成

AI資訊AI新閒資訊正文OpenAI 推出 GPT-6 Sol 和 Luna:API 價格大降 50%,單任務成本最低不到競品一成發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :2分鐘OpenAI 當日發佈 GPT-6 系列的最新成員——GPT-6 Sol 和 GPT-6 Luna。兩款模型採用與 GPT-6 Astra 類似的訓練方法,把 Astra 在專業工作、事實性、編碼、計算機使用和對齊等方面的最先進性能,帶入更快、更經濟的模型。OpenAI 也強調,GPT-6 Astra 仍是其整體最優秀的模型,追求無妥協體驗仍應首選它。價格砍半,成本最低不到競品一成GPT-6 Sol 和 Luna 的 API 價格相比 GPT-5.6 促銷價降低 50%。更值得注意的是單任務成本:在 AutomationBench 跨應用業務流程測試中,GPT-6 Sol 在 xhigh 強度下表現優於 Claude Opus 5,成本卻僅為 Opus 5 每任務成本的 9%;同一測試 high 強度下,GPT-6 Luna 較前代提升 5.4%,每項任務成本降低 58%。評估智能體的 Last Exam 測試中,GPT-6 Sol 在 max effort 狀態下得分 56.4%,高於 Claude Opus 5 在該評估中的最高分,每任務成本還降低 60%。事實可靠性同樣進步:GPT-6 Sol 的錯誤率約為前代的一半,接近 Astra 級可靠性且成本更低;Luna 的事實可靠性也大幅提升。性能逼近旗艦,長任務更省編程方面,兩款模型均針對 AI Coding Agent 工作負載優化。FrontierCode 1.1 Main 測試中,GPT-6 Sol 較 GPT-5.6 Sol 明顯提升,並以更低成本達到 Claude Fable 5.1 xhigh 相當水平。DeepSWE

1 分鐘前5700