預填充吞吐超 330 Token/s:高通攜手階躍等為第六代驍龍 8 超級至尊版端側適配 300 億參數 AI 模型

2026年9月22日 04:40
預填充吞吐超 330 Token/s:高通攜手階躍等為第六代驍龍 8 超級至尊版端側適配 300 億參數 AI 模型
站內 AI 整理稿

作者:故淵 責編:故淵 評論: 9 月 23 日消息,夏威夷時間 9 月 22 日 9 點(北京時間 9 月 23 日 3 點)召開的 2026 驍龍峰會上,高通宣佈攜手階躍、無量火及江波龍,基於第六代驍龍 8 超級至尊版移動平臺,端側適配與推理優化階躍 StepEdge-Omni 30B-MoE 模型,並現場演示相關智能體助手。該模型擁有 300 億參數,依託混合專家架構,僅根據任務需要激活部分專家模塊,以降低計算量和內存帶寬需求。合作方通過推理引擎、異構調度及存儲方案優化,讓模型運行內存需求較行業常規方案降低超過 50%,並支持在智能手機上穩定運行。

高通表示,該方案無需調用雲端服務,可以在本地完成郵件理解、行程規劃、日曆同步、航班及酒店推薦、行程分享和郵件草擬等任務。測試數據顯示,模型預填充吞吐性能超過每秒 330 個 Token,解碼吞吐性能超過每秒 28 個 Token。注:“模型預填充吞吐性能是指大語言模型在推理的預填充(prefill)階段,每秒能夠處理的輸入詞元(token)數量,是衡量系統處理長提示詞(prompt)和批量請求能力的關鍵指標。業內人士認為,大參數 MoE 模型在手機端的部署,有助於推動低時延和隱私保護型智能體應用發展。不過,實際規模化應用仍取決於終端成本、功耗、模型可靠性及用戶接受度等因素。

2026 驍龍峰會專題 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:2026 驍龍峰會,驍龍峰會,高通,階躍vivo 宣佈 iQOO 16、iQOO Pad Ultra 首批搭載高通第六代驍龍 8 超級至尊版處理器小米曾學忠在 2026 高通驍龍峰會首秀小米 18 Pro 真機小米 18 Pro 系列手機官宣全球首發高通第六代驍龍 8 超級至尊版和第六代驍龍 8 至尊版處理器全球最快移動 CPU:高通發佈第六代驍龍 8 超級至尊版芯片,CPU 行業首超 5GHz、GPU 性能提升 44%高通驍龍芯片將整合 HBC 架構:手機本地運行 AI 更快、更省電阿里千問平板 Qwen Book 現身 2026 驍龍峰會,定位原生 AI 智能體電腦

Related

相關文章

鈦媒體生成式AI

Meta Muse 爆紅,為什麼騰訊股價大漲?

Meta Muse 爆紅,為什麼騰訊股價大漲?深流研究所2026.09.23 10:39 · 來自北京全文3733字00:00 / 10:34扎克伯格等來爆款,騰訊跟著被重估。文 | 深流研究所,作者 | 吳絳楓Meta 在 AI 上砸下的重金,什麼時候才能拿到大結果?Muse 給出了第一個答案。9 月 8 日,Meta 推出個人 AI Agent Muse。上線不到兩週,Muse 登頂美國蘋果應用商店免費應用榜,排名超過 ChatGPT、Gemini 和 Claude。扎克伯格終於等來了一個消費級 AI 爆款。9 月 21 日,Meta 股價上漲 11.43%,創下 2025 年 4 月以來最大單日漲幅,市值一天增加約 1900 億美元。Muse 點燃的不只是 Meta。市場開始押注,個人 Agent 的普及會帶來更大的推理和計算需求。於是,Arm 上漲 17.2%,英特爾上漲 12.1%,AMD 上漲近 10%,市值首次突破 1 萬億美元。這輪行情很快傳到中國。9 月 22 日,騰訊控股盤中一度上漲 7.77%,股價升至 463.4 港元。在當天普遍上漲的港股科技股中,騰訊表現最突出。Muse 有什麼特別之處?它為什麼能讓華爾街重新相信扎克伯格,又為什麼讓遠在中國的騰訊獲得重估?為什麼說Muse是“社交+Agent”?從產品體驗看,Muse 完成表格填寫、日程整理、預訂餐廳、規劃旅行及購物等一系列任務。接到任務後,它會將目標拆解為多個步驟,再調用用戶已經授權的賬戶和服務。涉及發送郵件、提交訂單和付款等敏感操作時,Muse 會暫停執行,等待用戶再次確認。說實話,這些能力本身並不新鮮。OpenAI、Google、Anthropic,以及一批創業公司都有嘗試。Muse 的不同之處在於,Meta 第一次把個人 Agent 放進一個成熟的社交體系,嘗試藉助 Instagram、F

剛剛
鈦媒體生成式AI

Opus 5.5來了,性能趕超Fable,成本低至40%

Opus 5.5來了,性能趕超Fable,成本低至40%字母AI2026.09.23 10:31 · 來自北京全文4730字00:00 / 12:20被Astra“逼出來”的全新系列。文 | 字母AI5.5!!是Opus 5.5!!就在三天前,路透社還報道稱,隨著GPT-6 Astra開始搶回企業市場,Anthropic正在考慮提前推出一款新模型應戰。社區一直猜測新模型會是Opus 5.2還是5.5,現在答案終於揭曉了。而且這不是一個小更新,Anthropic直接掀開了Claude 5.5這個新系列。Opus 5.5先打頭陣,Sonnet 5.5和Haiku 5.5也已經排在後面,將在幾周後推出。某種意義上,Astra這腳油門踩下去,Anthropic連換代速度都被一起帶快了。和新模型同時到來的還有一個重置,正好方便用戶體驗。 Fable的定位有點尷尬了 既然被認為是衝著Astra來的,那就把它和Astra放在一起看。先說價格,Opus 5.5的API輸入價格是每百萬Token 4美元,輸出20美元;Astra則分別是10美元和50美元。也就是說,Opus 5.5的Token單價只有Astra的40%。兩款模型的上下文沒太大差別,Opus 5.5是100萬Token,Astra是105萬;最大輸出也都是128K Token。Astra的知識截止日期是2026年4月30日,Opus 5.5則更新到了2026年6月。兩款模型均支持low到max五檔推理強度。而且Opus 5.5相比自家上一代Opus 5也降價了。Opus 5原本是每百萬Token 5美元輸入、25美元輸出,新模型兩邊都降了20%;Anthropic稱,再加上Token使用效率提升,完成一項典型任務的實際成本能比Opus 5低約40%,輸出速度則提高了30%以上。便宜歸便宜,Opus 5.5在跑分上倒是一點沒客氣

剛剛
鈦媒體生成式AI

AI變天,Kimi怎麼補齊“月之暗面”?

光錐智能2026.09.23 10:15 · 來自廣西全文7430字00:00 / 20:20模型強只是入場券,月之暗面還需要補更多課文 | 光錐智能,作者|魏琳華,編輯|劉俊宏AI圈的規則就是用來打破的,市場變化之快,讓公司們經常猝不及防。

剛剛

​DeepSeek 傳將向聯合國安理會閉門通報 AI 潛在風險與安全挑戰

據路透社援引知情人士消息報道,中國人工智能初創企業 DeepSeek 預計將於本週向聯合國安理會就人工智能所帶來的潛在風險與安全挑戰進行專題通報。作為全球矚目的前沿 AI 力量,此次 DeepSeek 受邀參與聯合國安理會的安全通報,折射出國際社會對中國大模型企業在技術治理、風險防控以及全球 AI 安全框架建設中發揮實質性作用的重視。

剛剛
雷峰網生成式AI

Yann LeCun 萬字演講:「預測像素」是偽命題,JEPA 也並非憑空而來 | ECCV 2026

本文作者: 叢末 2026-09-23 09:49 導語:只靠語言和 token,AI 永遠跨不過物理世界這道門檻!只靠語言和 token,AI 永遠跨不過物理世界這道門檻!作者丨幸麗娟 編輯丨岑 峰 AI 行業的主敘事,曾被 Scaling Law 壟斷:更大的模型、更多的 token,更強的文本推理,彷彿只要把語言模型繼續堆大,通用人工智能就會自動到來。

剛剛