蘋果聯手初創公司,力推 AI 模型壓縮技術,讓 iPhone 也能跑大型 AI!
重點摘要
AI資訊AI新閒資訊正文蘋果聯手初創公司,力推 AI 模型壓縮技術,讓 iPhone 也能跑大型 AI!發布於AI新閒資訊時間 :Jul 15, 2026閱讀 :1分鐘據報道,蘋果正在與硅谷的初創公司 PrismML 進行洽談,致力於研發一項革命性的 AI 模型壓縮技術。這項技術的目標是將原本龐大的 AI 模型壓縮到能夠在 iPhone 上本地運行的程度。
### 蘋果聯手 PrismML 攻堅 AI 模型壓縮技術,將大型語言模型塞進 iPhone 的夢想成真
隨著大型語言模型(LLM)的參數量持續暴增,如何在資源受限的行動裝置上運行這些需要龐大算力的 AI,已成為整個科技業界亟欲突破的關鍵瓶頸。如今,這道難題似乎迎來了曙光。據 AI 資訊平台 AIBase 報導,科技巨頭蘋果正與矽谷 AI 初創公司 PrismML 進行深度洽談,目標是共同研發一項革命性的 AI 模型壓縮技術。這項技術旨在將原本需要雲端資料中心支撐的巨型模型,大幅縮小至能在 iPhone 上順暢本地運行的規模,此舉不僅將徹底改變行動 AI 的版圖,更有望為蘋果長期以來進展緩慢的虛擬助手 Siri,注入一股強大的競爭動力。 ### PrismML 的「黑科技」:將54GB巨無霸模型壓縮至不足4G
這項合作的核心,在於 PrismML 所擁有的原創性 1-bit 模型壓縮技術。傳統的模型量化往往會伴隨著顯著的性能損失,但 PrismML 的方案展示了驚人的效能平衡。報導中指出,PrismML 已成功地將阿里巴巴開源模型 Qwen 進行壓縮,最令人矚目的是,原始模型的大小從約 54GB 被急遽縮小至不到 4GB。這意味著,擁有高達 270 億個參數的複雜模型,現在已經能夠在 iPhone 15 及後續更新型號的裝置上順利運行。這種超越業界水準的壓縮比,幾乎是將模型的體積縮減至原本的十四分之一,同時還能維持可接受的推論準確度。
從技術層面來看,PrismML 的壓縮方案帶來了極具衝擊力的硬體效益。原本需要 8 顆 GPU 協同運算才能驅動的雲端模型,經過 PrismML 的處理後,竟能縮減至僅需單一 GPU 就能運作;而原本完全依賴資料中心的運算任務,現在也有了遷移至手機或筆記型電腦的可能性。這項技術有效降低了單一 AI 任務所需的記憶體頻寬與計算能耗,解決了將大型語言模型部署在終端裝置上最頭痛的硬體限制問題。### 蘋果的隱私戰略:讓 AI 在裝置內完成最後一哩路
蘋果一直以來都將用戶隱私視為其最重要的核心價值之一,而此次與 PrismML 的合作,正是這項理念在 AI 時代的具體延伸。將更多 AI 運算任務留在裝置本地端處理,對於蘋果而言具有多重戰略意義。首先,它能夠顯著降低響應延遲,因為資料不再需要往返於雲端伺服器,用戶與 Siri 的互動將變得毫秒級即時。其次,這能大幅削減蘋果每年在雲端運算上的巨額成本。更重要的是,即便處於沒有網路連線的環境,用戶依然可以完全呼叫裝置內的 AI 功能來處理敏感資訊。這種設計與蘋果強調的「隱私優先」原則完美契合。
Counterpoint 的分析師 Pathak 指出,當前 AI 發展的趨勢必然是雲端與設備端的深度融合。複雜且需要大量知識庫的任務可以交給雲端處理,而涉及個人通訊、健康資料或財務資訊等敏感任務,則完全在設備端完成隔離運算。PrismML 的技術,正是為蘋果補齊了裝置端 AI 性能不足的那塊關鍵拼圖。### Siri 的翻身之戰:從智慧助理升級為個人 AI 中樞
值得注意的是,蘋果與 PrismML 洽談的消息,恰逢蘋果正式推出 iOS 27 公測版僅僅一天之後。這個版本的 iOS 被視為蘋果 AI 戰略的轉捩點,因為它搭載了經過大幅改版的 Siri,首次大規模向公眾開放測試。新版 Siri 的目標非常明確:直接與 OpenAI 的 ChatGPT、Anthropic 的 Claude 以及 Google 的 Gemini 等頂尖 AI 助手展開正面競爭。然而,過去幾年 Siri 在功能演進上屢被外界批評為「反應遲緩」,背後的原因之一便是蘋果受限於隱私政策,導致其在資料收集與模型訓練上綁手綁腳。
如今,透過 PrismML 這類高效的裝置端運算技術,未來的 Siri 將不再只是一個簡單的語音命令執行器。它能夠在手機本地直接運行一個性能強大的模型,實現真正的上下文理解、複雜文件摘要、即時翻譯與智慧寫作等進階功能,從根本上提升用戶體驗。### 業界觀點:端側 AI 的突破,將改寫應用生態
這項技術突破的影響力,遠遠不止於 Siri 的升級。如果模型壓縮技術能夠成熟運用,它將徹底改寫整個應用商店的生態。開發者未來可以設計出更依賴本地 AI 推理的應用程式,例如即時的照片修圖、離線語音轉文字、以及不依賴伺服器的個人化推薦系統。這不僅能保障資料安全,還能為用戶提供更快、更私密的使用體驗。 不過,分析師也提醒,雖然壓縮技術能降低單一 AI 任務對硬體的需求,但並不代表整體的晶片需求會下降。相反地,隨著 AI 功能在裝置端的普及,用戶對於手機運算能力、記憶體大小以及電池續航力的要求只會更高。這意味著,未來的高階智慧型手機競爭,將從單純的硬體軍備競賽,轉向軟硬體深度整合的 AI 性能之爭。 ### 展望未來:從 iPhone 到整個蘋果生態系的擴散
PrismML 的技術目前已經通過了初步可行性評估,蘋果正在審慎地觀察其在真實場景下的穩定性與效能。這家最初孵化於加州理工學院、並獲得知名創投 Khosla Ventures 支持的初創公司,顯然已經抓住了科技巨頭的注意力。除了 Qwen 之外,PrismML 還計劃處理更多主流的開源大型模型,試圖將其壓縮技術打造成為終端 AI 部署的通用標準。對蘋果而言,如果能將這項技術成功整合進其產品線,其意義將不僅限於 iPhone。從 iPad、Mac 筆記型電腦,甚至到 Apple Vision Pro 等頭戴式裝置,都將能夠受益於這種高效率的本地 AI 運算能力。
當蘋果生態系中的所有裝置都能夠流暢運行自己的「小型大腦」,而未來的 Siri 也將不再只是一個問答工具,而是化身為無處不在、且永遠保護用戶隱私的個人 AI 中樞,那麼,蘋果或許真的有望在下一階段的 AI 競爭中,實現彎道超車。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。