蘋果 MacBook Pro 外接 iPhone 17 Pro Max 運行 AI 模型,預填充性能最高提升 44%

作者:遠洋 責編:遠洋 評論: 10 月 4 日消息,Qwen3.8‑27B 是一款性能不錯的人工智能模型,但前提是設備擁有足夠的顯存與系統內存。搭載 M4 Pro 芯片的 MacBook Pro 僅有 24GB 統一內存,在運行該 AI 模型時,預填充速度會因此受到限制。據 Wccftech 報道,有一名用戶通過 USB‑C 接口將 iPhone 17 Pro Max 外接至這臺便攜 Mac 電腦上,並藉助自制軟件,使得該 AI 模型的預填充性能最高提升了 44%。
注意到,為突破這臺 Mac 24GB 統一內存的上限,Reddit 用戶“u/StayLameBro”採用兩種方式,把運算任務拆分交給 Mac 本機和 iPhone 17 Pro Max 協同處理。針對預填充加速,MacBook Pro 負責處理每一批 256 個 token 當中的第 1 至 40 層,再將激活值數據流傳輸到手機端;與此同時,iPhone 利用 A19 Pro 的 GPU 運行第 41 至 64 層,而 Mac 這邊則已經開始處理下一批數據。依靠 GPU 運算,手機端的運行速度相比不使用 GPU 時提升約 2.4 倍。整套方案裡,神經網絡引擎也沒有閒置。
每 16K 長度的舊上下文會被編譯為一套神經網絡引擎模型。在 140K 上下文長度下,相較於僅使用 A19 Pro 的 GPU,單 token 寫入耗時從 279 毫秒縮短至 176 毫秒。拿將一份 2000token 的文件預填充並保存會話這項任務來看性能表現:上下文設為 8K 時,僅靠 Mac 本機的速度是每秒 132 個 token;外接 iPhone 之後達到每秒 177 個 token,性能提升 35%。上下文設為 16K 時,速度從每秒 109 個 token 上漲至每秒 157 個 token,增幅高達 44%。
當上下文窗口設置為 32K 時,預填充速度從每秒 101 個 token 提升至每秒 130 個 token,性能改善 29%。把 iPhone 17 Pro Max 外接在 M4 Pro 版 MacBook Pro 上,使用這套自制軟件,按理可以得到十分出色的預填充速度。可惜正如這名 Reddit 用戶指出的,現實並沒有這麼美好,這套方案還存在若干侷限。舉例來說,在 64K 以內的場景,手機並不會加速文本生成,文本生成的工作依舊全部交由 Mac 完成。另外值得一提的是,驅動 iPhone 18 Pro 以及 iPhone 18 Pro Max 的 A20 Pro 芯片有望提供更大的性能餘量。
一方面它本身的整體性能更強;另一方面它配備雙 16 核神經網絡引擎。據稱,針對專門適配神經網絡處理器的任務,這款引擎的數據吞吐能力甚至超過該系統級芯片內置的 7 核 GPU。這套自制軟件目前已經開源,可以在 GitHub 上下載,項目名稱叫作“backburner”。即便僅僅作為一項實驗,也能夠看出預填充速度提升帶來的收益相當可觀。後續自然還有繼續挖掘性能潛力的空間;不過這或許也意味著,未來 iPhone 這類設備也有可能步入和內存、固態硬盤一樣的供貨緊缺階段。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:MacBook Pro,iPhone 17 Pro Max,AI模型亞馬遜推出 Strands Decider 2B 開源決策模型,支持本地部署古爾曼:蘋果最快本月發佈觸控 OLED 屏 MacBook Pro,配 M5 Pro / Max 芯片OpenAI 稱其遭遇有組織蒸餾,將矛頭指向月之暗面內部測試發現安全隱患,消息稱 OpenAI 取消發佈 AI 模型 GPT‑6.1 AstraAnthropic 發佈 Claude Sonnet 5.5:速度提升 30%,智能體編碼性能反超 Opus 5.
5月之暗面最強 AI 模型:Kimi K3.1 前端標識洩露,預計將在近期發佈
Related
相關文章

DeepSeek擴招!彈性計算團隊大量HC,尤其需要資深工程師
彈性計算團隊大量HC招人!尤其需要資深工程師。三週前不是剛招過一輪嗎?咋又缺人了。這次沒發崗位JD,直接甩了一篇DeepSeek技術分享: 《DeepSeek彈性計算(DSec):面向大規模Agent訓練的沙盒基礎設施》 現在DeepSeek的一套DSec擴展分片,大約有160臺服務器、3萬個CPU核心和250TB內存,每天要服務約300萬個沙盒。

OpenAI安全團隊持續地震!負責人離職,三名員工因洩密被開
OpenAI安全團隊再傳人事動盪,負責安全透明度的David Robinson已離職,OpenAI尚未公布繼任者。Robinson團隊主要負責撰寫模型「風險說明書」system card,對外解釋內部安全評估與部署決策。此外,另有三名員工因洩密遭到開除,顯示團隊內部問題持續延燒。
IBM Brings Bob to Self-Hosted and Air-Gapped Environments: Agentic Software Development Without Moving Your Code
IBM has made a self-hosted deployment option for IBM Bob generally available. Bob is IBM’s agentic software development platform. It covers the full lifecycle: understanding code, planning work, executing changes and validating results.

OpenAI 前安全部門員工:AI 模型迭代部署太激進,公司的文化已經崩壞
作者:遠洋 責編:遠洋 評論: 感謝網友 愚公騎馬 的線索投遞!10 月 4 日消息,據路透社報道,一名近期辭職的前 OpenAI 安全部門員工批評了該公司對待人工智能安全的做法,他認為一味追求快速開發的高壓企業文化會提高系統發生故障的風險。
Microsoft AI Releases MAI-Transcribe-2-Streaming: #1 Real-Time Speech-to-Text Model on Artificial Analysis
Microsoft AI has released MAI-Transcribe-2-Streaming, its first streaming speech-to-text (STT) model.It launched on October 1, 2026, alongside 2 text-to-speech models, MAI-Voice-2.

openJiuwen X-Router自演進模型路由技術首發,昇騰親和,Agent越跑越省,實測減少50+%Token消耗
openJiuwen推出X-Router自演進模型路由技術,首發強調與昇騰晶片高度親和。該技術能讓Agent依任務複雜度自動選擇合適模型,避免簡單任務誤用昂貴算力、複雜任務卻交給輕量模型的情況。實測顯示可減少逾50%的Token消耗,使Agent在運行上更省成本、更有效率。