剛剛,高通2nm雙旗艦來了,為智能體AI重造架構,手機能跑300億參數大模型

2026年9月22日 23:17
站內 AI 整理稿

作者 | ZeR0 編輯 | 漠影 剛剛,高通最強手機芯片來了!夏威夷毛伊島9月22日現場報道,在驍龍峰會2026上,高通一口氣推出兩款採用2nm製程的旗艦芯片——第六代驍龍8超級至尊版和第六代驍龍8至尊版。這是高通首次在旗艦產品線同時推出兩款驍龍8至尊版平臺,也是驍龍平臺首次採用2nm製程。下一代AI智能體設備會是什麼樣子?高通展示了榮耀Robot Phone、阿里原生智能體電腦Qwen Book、努比亞NaviX Ultra上的豆包手機助手等全球最早一批智能體設備,使用驍龍移動平臺實現的全新智能體體驗。

高通總裁兼CEO安蒙在演講中說,我們剛剛進入智能體時代的開端,智能體需要全新系統架構,而驍龍正是為這個時代打造的平臺。連高通為數據中心AI芯片設計的全新計算引擎HBC(高帶寬計算)技術也被縮放到手機,以顯著提升效率。HBC將作為驍龍平臺的協處理器,把內存和AI處理單元放得更近,提供下一代AI智能手機所需要的速度、能效和性能。高通還會將這個技術帶入整個邊緣計算體系,包括筆記本電腦、智能眼鏡和汽車。全新第六代驍龍8超級至尊版圍繞智能體,將CPU、GPU、NPU、ISP和整個系統架構全面優化,使更多智能在更靠近處理器側運行,性能、能效、AI能力和影響表現都顯著增強。

尤其在讓內存更靠近處理器這件事上,高通做了多重優化,包括CPU的可擴展先進緩存架構FlexCache、GPU的高性能內存(HPM)和NPU的大容量共享內存。面向模型及智能體推理,第六代驍龍8超級至尊版端側可支持300億參數級別的MoE混合專家模型,並配備Element Accelerator來改善Transformer工作負載。面向遊戲體驗,該處理器搭載Adreno Neural Fusion,配合Matrix Cores,支持AI幀生成、AI超分、在圖形管線內部直接進行神經引擎運算。

面向攝影,第六代驍龍8超級至尊版通過智能像素控制、支持3DLUT的Elite Color Engine、智能防抖和Motion Intelligence等提升移動影像體驗。面向專業內容創作,其支持影視級視頻能力,包括APV、8K 60fps視頻拍攝、4K 240fps超高清超慢動作視頻拍攝,並支持新視頻編碼標準VVC。連接上,新移動平臺搭載全球首款面向3GPP Release 19就緒的調製解調器及射頻系統——高通X105 5G調製解調器及射頻系統,為6G奠定基礎。小米集團高級副總裁兼國際業務部總裁曾學忠現場宣佈,今天,小米將首發搭載第六代驍龍8雙旗艦平臺的新機。

小米澎湃OS 4和高通第六代驍龍至尊版在整體任務調度、內存管理、運行時等系統層面聯合優化,進一步改善IPC性能、緩存命中率及系統能效,並在一個高負載開放世界手遊中實現單幀功耗大降38%。搭載第六代驍龍8超級至尊版的小米18 Pro Max,進一步追求峰值性能,帶來更強AI性能和散熱系統。新一輪安卓旗艦大戰,總算正式開打。一、第六代驍龍8超級至尊版:移動CPU衝到5GHz,GPU首搭AI專用核 第六代驍龍8超級至尊版是高通迄今性能最強的移動平臺,不僅面向智能體重新設計整個架構,而且將AI、通用計算、遊戲、影像性能全面升級。

高通給CPU、GPU、NPU通通改造,通過縮短數據傳輸路徑及多種創新技術,實現更低的時延、更高的能效、更穩定持久的智能體、遊戲和攝影體驗。1、Oryon CPU:8核,5GHz,引入新緩存架構 CPU搭載高通定製Oryon CPU內核,採用8核架構(2個超級內核、6個性能內核),主頻最高達到5GHz,性能內核主頻最高達到4GHz。這是業界首個主頻突破5GHz的移動CPU。當然,僅僅有高主頻是不夠的,先進指令集、IPC優化、Oryon架構和FlexCache緩存架構缺一不可。先進指令集和更高的IPC協同能更快完成計算任務;Oryon CPU架構採用異構設計,使不同內核能高效訪問數據。

高通還引入了全新緩存架構FlexCache,可動態分配緩存池,讓所有內核可訪問一個共享L2緩存池,並根據不同核心的實際需求動態分配資源,實現更高效的任務切換。智能體通常會頻繁遷移線程,調用跑在不同核心上的工具。這種設計則可以讓智能體在運行高負載任務時,不會降低響應速度。不止是AI,對於遊戲、視頻編輯、多任務處理及各種短時性能爆發場景,FlexCache也能帶來更好的表現。2、傳感器中樞:讓智能體持續感知 全新高通傳感器中樞使系統保持持續感知,無需喚醒主應用處理器,以超低功耗處理語音、活動及個人上下文信息。

其搭載新一代雙Micro NPU架構,性能提升高達85%,能效提升20%,可支持擁有2億參數的模型,並升級了個人記錄功能。個人記錄有助於從用戶選擇保留的信息、參與的對話和關注的重要內容中不斷學習,持續積累私密安全的個人知識庫,為智能體提供越來越豐富的上下文。3、Hexagon NPU:300億參數模型跑在手機上 NPU有兩大關鍵創新。一是全新Element Accelerator,專為Transformer工作負載打造,結合向量計算單元和標量計算單元,支持最高32k token上下文窗口,可加速大模型運算,幫助智能體更快地響應、更高效地推理。

二是將共享內存擴容50%,能大幅減少訪問外部DDR的次數,將更多上下文和KV cache數據保留在NPU內部,降低時延,省出更多寶貴的內存帶寬。在部分模型上,新一代NPU的預填充性能最高提升80%。高通聯手階躍、無量火與江波龍,基於第六代驍龍8超級至尊版,率先將階躍StepEdgeOmni 300億參數級混合專家(MoE)模型完整部署於端側,打造具備全鏈路智能體AI能力的端側智能助手,可在不犧牲推理精度的情況下,將內存需求降低超過50%。通用閃存存儲UFS 5.0支持從閃存中動態流式加載模型參數,讓設備能夠使用更大的AI模型,突破傳統移動設備內存容量的限制。

4、Adreno GPU:第一次引入AI專用核心 Adreno GPU實現了44%的性能提升和14%的能效提升,有四大亮點: (1)圖形性能和能效均實現代際提升,基於三切片架構,將每個切片的頻率提升了250MHz。(2)搭配18MB第二代Adreno高性能內存(HPM),讓內存更靠近IP模塊,減少DDR數據讀取,實現功耗降低12%,支持開發者按需分配內存資源。(3)首次引入GPU專用核心Matrix Cores,該核心是專用用於AI的GPU核心,將AI工作負載保留在圖形管線裡,可降低功耗、延遲並增強圖形體驗。至此,高通NPU、CPU、GPU核心引擎均已加持矩陣加速能力。

(4)部署Matrix Cores的直接成果是Adreno Neural Fusion,將AI超分、AI幀生成、神經網絡處理結合到一起,能實現AI和圖形處理之間更緊密地結合,神經網絡計算無需離開圖形渲染管線即可完成,改變移動遊戲渲染方式,實現更流暢的遊戲體驗、更高的圖像質量及更好的能效。這些技術協同運作,支撐智能體AI絲滑運行:傳感器中樞始終保持環境語音感知,CPU負責指揮、編排、調度整個工作流程,NPU和GPU可共同支持AI推理。5、Spectra ISP:給AI提供“視覺上下文” ISP可幫助智能體構建記憶和個性化能力。

Spectra ISP已成為一個多模態引擎,能理解攝像頭看到的內容,並把圖像和視頻轉化成有意義的上下文信息。第二代AI ISP與NPU協同,在拍攝的同時做智能處理,由此將視頻吞吐量提升至2倍,使用戶首次能在商用終端上拍攝8K 60fps的視頻;超級慢動作視頻的分辨率進一步提升,支持4K 240fps拍攝。新一代ISP引入智能像素控制,能為每個像素分配16位AI數據,信息精細度是前代的256倍。因此,Spectra ISP能更好地理解場景中的每個細節。每個像素能夠讀取和保存更多數據,意味著能跨幀持續追蹤一個拍攝對象,或者獲得更豐富的語義分割內容。

6、連接:5G基帶及射頻+WiFi 8 新平臺搭載高通X105 5G調製解調器及射頻系統和FastConnect 8800芯片,為蜂窩網絡和無線連接提供AI增強能力,助力邁向6G。高通X105 5G調製解調器及射頻系統支持5G衛星(NR-NTN),採用6nm射頻收發器,是全球首款面向3GPP Release 19標準就緒的調製解調器。FastConnect 8800是高通推出的Wi-Fi 8解決方案。這款4合1集成芯片支持最新Thread,是首款採用4×4 Wi-Fi射頻配置的移動解決方案,支持超寬帶及長距離覆蓋,讓用戶的手機能夠成為智能家庭中樞。這種系統級設計思路也延伸到芯片的物理封裝。

高通在超級至尊版中開發了一種新的散熱設計方法Offset Package-on-Package,重新設計了內存與芯片在封裝內部的排列方式,可形成一條效率更高的散熱路徑,更快將熱量從處理器中到處,還支持更高集成度的設備設計。這種設計能幫助設備進一步擴大可用的散熱空間和熱設計餘量,也能給OEM廠商更大的設計靈活性,使其能優化整機設計並探索新的產品形態。最終其在高工作負載下,峰值性能的持續時間可達到此前的2倍以上。

二、第六代驍龍8至尊版:把新架構帶到更廣泛的旗艦手機 第六代驍龍8超級至尊版專為最先進的AI工作負載和定義智能體時代的全新體驗而設計,旨在打造覆蓋AI、遊戲、視頻、影像等各項技術領域的頂尖旗艦體驗。而第六代驍龍8至尊版旨在面向更廣泛的終端打造旗艦體驗,在性能和智能之間實現平衡。AI:通過高通Hexagon NPU的升級,在旗艦智能手機上實現智能、靈敏且高效的AI體驗。性能:高通定製Oryon CPU可提供快速、靈敏的旗艦級性能,兼顧高端性能、智能能力與能效。遊戲:實現先進圖形能力、靈敏流暢的遊戲操控和持續穩定的性能,帶來旗艦級移動遊戲體驗。

影像:通過智能像素控制、Elite Color Engine增強、智能防抖和Motion Intelligence等功能,為旗艦智能手機帶來先進的拍攝與視頻能力。連接:搭載高通X105 5G調製解調器及射頻系統和 FastConnect 8800,提供AI增強的蜂窩網絡與無線連接能力。三、手機成個人智能體起點,需要全新系統架構設計 在驍龍峰會2026上,高通總裁兼CEO安蒙發表演講,談到我們正從以手機為中心的模式過渡到以智能體為中心的新體驗模式,智能體將成為整個體驗的中心,這將改變思考智能手機角色的方式。“我認為,我們終於走到了一個可以看清楚「AI智能手機究竟是什麼」的階段。

”安蒙說,“我們正在從app和助手,走向智能體。” AI進步飛速,混合專家模型(MoE)、編排器、新模型、MCP協議等快速發展,智能體開始長出各種“技能(skill)”。這些技術共同推動手機向AI智能手機轉型。安蒙分享了三大重要觀點: 其一,AI正從“應用驅動”轉向“意圖驅動”。過去二十年裡,從智能手機誕生之初開始,整個智能手機體驗一直都是圍繞app組織起來的。而在智能體時代,智能體是通過理解你的意圖,替你完成各種事情。這種特性與手機高度個性化和定製、持續在線、多模態感知的能力天然適配。這是“屬於你的智能體”,所以權限和控制權會變得非常重要,這些權力必須掌握在用戶手中。

其二,智能手機是個人智能體時代的起點。智能手機是個人智能體首要載體,是最瞭解你的設備,始終伴你左右,並能夠感知你所處情境。未來的體驗會越來越少地圍繞“打開和操作app”展開,而會越來越多地圍繞“替你完成任務”展開,智能體將要求設備承擔遠遠超過“執行命令”的工作。個人智能體不止在手機,而會伴隨用戶在手機、PC、汽車、智能手錶、智能眼鏡、智能吊墜、智能胸針及其他設備間流轉,整個體驗無縫,且能持續跨設備延續。而手機將成為整個個人AI系統的計算、記憶與連接樞紐。工作負載會根據每項任務的具體需求,在雲端及所有可用的計算資源之間進行分配。其三,智能體需要一套全新系統架構。

智能體必須能感知正在發生什麼,理解你的意圖和上下文,進行推理、規劃和記憶,並代表你採取行動。手機上會開始出現一些全新功能,比如訪問你的個人知識,安全地獲得你願意授予的權限,以及智能體代表你採取行動的能力。這創造了系統級設計新機會,涉及混合AI、跨設備智能、任務編排與異構計算。無論智能體直接運行在設備上,還是被集成到操作系統中,它都必須在模型、app、服務和數據之間完成大量協同,才能提供這些體驗所需要的性能、能效和響應速度。

因此,需要重新思考計算引擎應該如何設計:智能體編排需要更高的CPU性能,NPU加速器能夠提供高能效的AI推理能力,GPU則會負責AI中並行計算任務,在完成這些AI工作的同時,還需保持全天候的電池續航。結語:個人智能體競賽開場,高通先把基礎設施鋪好了 圍繞智能體工作方式,高通重新設計旗艦手機芯片,從系統層面處理智能體的AI、計算、連接、內存、感知、安全和功耗效率協同運作。通過優化CPU緩存架構、在GPU中加入AI專用核心和搭配獨立高速顯存、在NPU增加Transformer加速器和擴容內存、傳感器中樞裡的低功耗感知,新一代驍龍雙旗艦移動平臺,讓手機在有限的功耗預算內能夠完成更復雜的連續智能任務。

個人智能體的競賽才剛剛開始。高通從底層帶來適應未來個人智能體發展的基礎設施。接下來,就看終端廠商與軟件開發者們如何發揮創意,藉助隨時在線的個人智能體和更快、更無縫、更流暢的移動體驗,將AI更好地轉換成用戶每天使用的生產力。

Related

相關文章

​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰

AI資訊AI新聞資訊正文​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰發佈於AI新聞資訊發佈時間 :2026年9月23號 9:52閱讀 :1分鐘人工智能技術的快速發展正在從單純的產業競爭,加速上升至全球安全與地緣政治的核心議題。據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。與此同時,包括阿里巴巴支持的月之暗面等其他中國人工智能企業也正逐步走向國際舞臺,共同參與探討如何在全球範圍內應對通用人工智能帶來的長遠挑戰。隨著各大 AI 實驗室的技術迭代不斷刷新邊界,如何平衡技術創新與安全紅線已成為全球多邊治理機制的當務之急。此次 DeepSeek 赴聯合國安理會分享其對 AI 風險的研判與實踐,不僅為國際社會提供了來自中國科技企業的技術觀察視角,也標誌著全球 AI 治理正在加速向多邊協作與深度對話的全新階段邁進。相關推薦世衛組織發佈重磅報告,呼籲全面升級醫療 AI 研究倫理監管世衛組織2026年9月21日發佈《人工智能相關健康研究:倫理審查與監管》報告,指出AI正加速健康研究和醫療進步,但若缺乏倫理防線與監管,可能帶來新風險,危及人權、社會公平和公眾信任。報告對現有倫理審查機制發出警告,強調需加強倫理審查與監管。2026年9月23號 9:4652.5kGrok Bot 上線僅一個月,周活躍用戶數正式突破 40 萬大關馬斯克旗下SpaceX AI團隊推出的Grok Bot智能體上線約一個月,周活躍用戶已突破40萬。截至9月14日達41.8萬人,環比增長24%,顯示其市場熱度與

剛剛
雷峰網生成式AI

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026 本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 只靠語言和 token,AI 永遠跨不過物理世界這道門檻! 作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。但這條路線撞上了天花板:預訓練的邊際收益肉眼可見地遞減;模型一旦部署到真實世界,漏洞百出。2026 年,“世界模型”接棒 Scaling Law,成了牌桌上最擁擠的籌碼。然而,這個詞本身,同時被四條技術路線認領,而它們對“理解世界”這件事,幾乎各說各話。第一條賭湧現:Sora、Genie 這類視頻生成路線相信,只要下一幀逼得夠真,物理規律就會自己從像素裡長出來。第二條賭幾何:李飛飛聯合創立的 World Labs,從底層表徵就鎖死三維一致性,直接生成可自由探索的虛擬世界。第三條賭仿真:英偉達 Cosmos、Omniverse,把顯式物理引擎當作機器人的練兵場。第四條路最孤峭,也最反常識:2018 年圖靈獎得主、深度學習三位“教父”之一 Yann LeCun,押注 JEPA(聯合嵌入預測架構),它不生成未來,只在抽象表徵的空間裡預測未來。四條路的根本分歧,本質上在於一個問題:機器要“懂”物理世界,究竟該去復刻它,還是去推理它?前三條都在不同程度上試圖讓機器“看見並重建”世界;JEPA 卻選擇另一條路——編碼器先丟掉那些根本不可預測的細節,只保留可預測、可規劃的結構,然後在抽象表徵空間裡預測未來。在 LeCun 眼裡,連“預測像素”這件事本身都是偽命題:你把攝像頭對準房間一角開始錄像,下一幀會拍到什麼,取決於鏡頭外有沒

剛剛
雷峰網生成式AI

樂享以太大模型,讓中國具身智能坐上定義席

樂享以太大模型,讓中國具身智能坐上定義席 本文作者: 叢末 2026-09-23 09:46 導語: 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 從“預測”到“求解”:樂享以太大模型重塑 Physical AI 解題範式。 作者丨幸麗娟 編輯丨董子博 具身智能行業一直在等一個 ChatGPT 時刻。但這個時刻,未必長得像 ChatGPT。決定這個時刻的,不是機器人會聊天,也不是機器人學會了幾個動作,而是在不確定環境裡,機器人能不能自主思考、判斷和執行,在無序的事件中,持續完成任務。過去兩年,行業積累的幾乎全是“能力上限”的展示:選好場景、選好時機、反覆調試,再拍出一條完美的Demo。上限可以“被編輯”出來展示。真實效果如何,卻少有人敢公開測。但機器人真正進入現實世界,考驗的不只是最好時能做到什麼,更是環境不斷變化時,它還能不能把事情做下去。9 月 16 日傍晚。上海閔行一家燒烤店門口,樂享科技讓兩臺機器人擺起了燒烤攤。接下來近一個小時,它們要接單、烤串、上菜。這場直播的規則,測的正是機器人在這種真實環境裡的應變能力。沒有剪輯,沒有遙控,沒有預設腳本。更絕的是,觀眾可以實時幹預:隨機出題,自由改造場地佈局,隨手改道具擺放位置,臨時打斷正在進行的任務並追加需求。現場 3 桌、6 名顧客的主線任務,就是“幹擾”,看機器人能不能像人一樣自己“圓場子”。而就在不久前,這家公司剛剛站在了一場輿論風暴的中心。故事線是這樣的:7 月,樂享上線以太大模型官網並公開完整技術路線;8月26日,一段機器人協作收拾房間的10分鐘一鏡到底 Demo,在具身圈傳開。9 月 3 日,OpenAI 上線 GPT-6 Astra 官網;三天後,首席科學家 Jakub Pachocki 發表萬字長文《異星心智》。9 月 10 日,樂享創始人郭人傑發文,三問 OpenAI:技術理

剛剛

OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦

AI資訊AI新聞資訊正文OpenAI 重磅發佈 GPT-6 Sol 與 Luna 模型:API 價格腰斬,性能直逼頂級旗艦發佈於AI新聞資訊發佈時間 :2026年9月23號 9:26閱讀 :1分鐘OpenAI 今日正式發佈了 GPT-6系列的最新成員 ——GPT-6Sol 與 GPT-6Luna。這兩款新模型採用了與 GPT-6Astra 類似的方法進行訓練,旨在將 Astra 在專業工作、事實性、編程、計算機使用及對齊等方面的頂尖性能,帶入速度更快、更經濟的小尺寸模型中。官方表示,雖然 GPT-6Astra 依然是追求最佳效果和無妥協體驗的首選,但 Sol 與 Luna 在大幅降低成本的同時,展現出了極其強悍的綜合競爭力。在價格方面,GPT-6Sol 和 Luna 模型的 API 價格相比 GPT-5.6的促銷價直接降低了50%。此外,OpenAI 還針對基於 GPT-6的開發者優化了提示緩存,默認提供更高的緩存命中率,幫助智能體重用更多上下文,從而實現更快的響應並進一步節省費用。在核心性能表現上:業務流程與智能體表現:在 AutomationBench 跨應用業務流程測試中,GPT-6Sol 在高強度下表現優於 Claude Opus5,且成本僅為其每任務成本的9%;在 Last Exam 智能體評估中,GPT-6Sol 的得分超越了 Claude Opus5的最高分,同時每任務成本降低60%。事實可靠性:在去標識化的真實世界對話中,GPT-6Sol 的錯誤率約為前代的一半,接近 Astra 級的可靠性,Luna 的事實可靠性也迎來了大幅提升。編程與軟件工程:兩款模型均針對 AI Coding Agent 工作負載進行了深度優化。在 DeepSWE v1.1軟件工程測試中,GPT-6Sol 取得68.8% 的成績,距離最高成績僅差1.1個百分點,單任務成本卻低約80%;

剛剛

OpenAI 宣佈將在 AI 模型開發早期階段引入第三方獨立安全評估

據相關報道,該公司計劃打破傳統的內部閉環測試模式,將第三方獨立機構正式引入 AI 模型開發週期的更早階段,對其進行系統性的安全風險評估。為了確保這一創新機制能夠真正發揮實質性作用,OpenAI 同時明確了此類外部評估得以有效開展的核心優先事項。

剛剛