將27B模型“塞進”手機,PrismML推動AI進化從規模轉向“智能密度”

2026年7月24日 18:34
將27B模型“塞進”手機,PrismML推動AI進化從規模轉向“智能密度”

重點摘要

PrismML 成功將 270 億參數的大型語言模型部署到智慧型手機上,透過模型壓縮、架構最佳化與量化技術,讓手機能在本地端流暢執行複雜運算。這項突破不僅解決了雲端運算的延遲與隱私問題,更標誌著 AI 產業從追求參數規模轉向強調「智慧密度」的競爭。

站內 AI 整理稿

人工智慧新創公司 PrismML 近日宣布一項重大技術突破:成功將一個擁有 270 億個參數的大型語言模型(LLM)直接部署到智慧型手機上,讓手機裝置得以在本地端流暢執行過去只能仰賴雲端伺服器運算的龐大模型。這項進展不僅展現了模型壓縮與架構最佳化的極限,更標誌著 AI 產業的發展重心正從一味追求「規模擴張」,轉向對「智慧密度」的深度競爭。傳統上,參數量達數十億甚至上百億的大型語言模型,必須依賴資料中心內的高效能 GPU 或 TPU 才能運作,終端裝置僅能透過網路連線將資料傳送至雲端,再接收運算結果。

這種模式不僅會受到網路延遲與頻寬限制,也讓即時性要求高的應用——例如語音助理、即時翻譯或影像分析——難以在離線或訊號不佳的環境中順暢使用。PrismML 的技術徹底顛覆了這個前提,讓手機晶片承載過去僅限於數據中心的運算負載,同時維持合理的功耗與反應速度。PrismML 的解決方案並非單純依賴硬體升級,而是從軟體與演算法層面著手。團隊透過模型壓縮技術,有效降低模型儲存體積與運算量;再透過架構最佳化,重新設計模型內部結構,使其更適合手機晶片的運算架構;同時運用量化技術,將模型參數從高精度浮點數轉換為低精度格式,大幅減少記憶體頻寬需求。

這三項技術的疊加,讓 270 億參數的模型能夠在手機晶片有限的記憶體與算力限制下,以接近即時的速度執行推論任務。這項成果背後,反映的是 AI 發展策略的關鍵轉折。過去數年,業界普遍認為模型參數規模越大,模型表現就越強,因此各家公司爭相推出千億甚至兆億參數的模型。然而,隨著模型規模持續成長,訓練與推理的成本急遽攀升,邊際效益卻開始遞減——參數增加帶來的能力提升逐漸趨緩,但能源消耗、硬體需求與部署難度卻呈指數級增長。PrismML 的技術路線正是在此背景下誕生:與其追求更大的模型,不如在有限的硬體資源內最大化模型效能,讓每一單位算力產出更高的智慧價值。「智慧密度」這個概念因此成為業界熱議焦點。

它指的是單位硬體資源所能承載的模型能力,而非單純的參數總數。PrismML 證明,透過精良的壓縮與最佳化,手機端也能擁有接近雲端等級的語言理解與生成能力,這讓邊緣運算真正從口號走向落地。過去邊緣運算常因裝置算力不足而僅能執行輕量級模型,導致應用場景受限;如今,手機就能承載大型語言模型,意味著開發者不再需要將使用者資料傳回雲端,就能在本地端完成複雜的推理任務。對終端使用者而言,最直接的感受來自於隱私保護與即時回應的提升。由於所有運算都在手機本地進行,個人對話、照片、位置等敏感資訊無需離開裝置,大幅降低資料外洩風險。

同時,因為不再依賴網路連線,即時語音助理、離線翻譯、即時影像辨識等應用可以在飛機、地鐵、偏遠山區等無網路環境下順暢運作。這也讓智慧型手機逐漸從單純的通訊工具,轉變為真正具備自主思考能力的個人 AI 助理。從開發者角度來看,PrismML 的技術降低了大型語言模型在終端部署的門檻。過去,開發者若要將 AI 功能整合到手機 App 中,通常只能使用數百萬到數億參數的小型模型,或必須忍受雲端延遲與頻寬成本。如今,270 億參數的模型可以直接內嵌於應用程式中,讓開發者能夠設計出更個人化、更即時的行動端服務,例如根據使用者本地資料進行個人化推薦、即時翻譯長篇對話、或在不聯網的環境下執行複雜的文件分析。

業界普遍認為,從「規模競賽」轉向「智慧密度」的競技,將是 AI 商業化普及的關鍵下一步。當模型不再需要龐大的雲端基礎設施支撐,終端裝置的普及率與便利性將使 AI 技術更貼近一般消費者。PrismML 的這項進展,不僅挑戰了「大模型必須在雲端執行」的既有認知,也為下一波行動端 AI 應用——包括離線語音助理、即時影像辨識、個人化推薦系統——提供了更高效且具隱私保護的解決方案。隨著智慧型手機持續演進,晶片效能不斷提升,PrismML 的技術未來還有更大的最佳化空間。

可以預見,在不久的將來,更多參數量更大、能力更強的模型將能以智慧密度的形式被壓縮至手機之中,讓 AI 真正成為每個人隨身攜帶、隨時可用的智慧夥伴。而這也將進一步推動整個 AI 產業從「參數軍備競賽」轉向「效率與實用性」的良性競爭,最終加速 AI 技術在消費市場的全面普及。

Related

相關文章

一年砸下110億美元,比紅杉還兇,白宮才是AI圈最猛投資人

美國白宮過去一年在AI領域投入110億美元,規模超越紅杉資本等傳統創投,顯示政府正以國家級資源全面押注AI產業。這筆資金分散於多個聯邦機構,涵蓋基礎模型訓練、醫療及氣候應用等關鍵環節,並強調負責任AI開發。此舉反映美國對維持全球AI領導地位的危機感,但也引發市場機制扭曲與技術商業化延緩的疑慮。

剛剛

一口氣發佈三款教育插件,OpenAI教育產品再升級

OpenAI 推出三款教育插件,分別為課程助手、作業輔導員與互動學習夥伴,旨在協助教師備課與學生自主學習。這些工具整合至教育版平台,強調引導式學習而非直接給答案,並內建防護機制避免學生過度依賴。OpenAI 計畫未來加強多語言支援與特殊教育需求,持續深化教育科技布局。

剛剛

騰訊、字節、阿里,搶著給打工人配「AI助理」

騰訊、字節跳動與阿里巴巴三大中國科技巨頭,近期紛紛推出或升級企業級AI助理,目標是提升白領工作效率。各家AI助理的競爭重點從回答問題轉向執行任務,並分別強調跨應用串聯、主動式智慧與企業級安全等不同特色。儘管面臨資料隱私與AI幻覺等挑戰,但市場調查顯示超過六成中國企業計劃在一年內導入AI辦公工具。

37 分鐘前

推行AI提效後,策劃們開始加班趕工期

當AI開始重寫小遊戲生產流程,真正的變化何時發生?這個問題在近期引發了業界廣泛討論。隨著人工智慧技術逐步滲透進創意與策劃領域,許多公司開始導入AI工具來提升工作效率,然而實際情況卻與預期有所出入。部分策劃人員反映,在推行AI提效後,他們不僅沒有減少工作量,反而因為系統調整與流程磨合,導致加班趕工期的現象頻繁出現。 這場變革的起點,源自於企業對AI生產力的高度期待。許多遊戲開發與內容製作公司,尤其是中小型團隊,紛紛導入AI輔助工具,試圖透過自動化生成文案、腳本、美術素材甚至程式碼,來縮短專案週期。

1 小時前

DeepSeek大漲價,Token價格戰終於要結束了?

DeepSeek大幅調漲API服務價格,引發市場對AI模型價格戰是否結束的討論。業界分析指出,漲價反映營運成本壓力與市場定位調整,可能代表中國AI產業從低價競爭轉向追求盈利與可持續發展。未來競爭焦點將從價格轉向模型效果與生態系統完整性,但漲價能否終結價格戰仍取決於市場供需與競爭對手反應。

1 小時前

狂攬130億!英偉達投的AI基建獨角獸又融資了

澳洲AI基礎設施獨角獸Firmus宣布完成20億美元(約136億人民幣)戰略股權融資,現有投資方英偉達與Coatue持續參投,並新增黑石旗下基金及Jane Street。該公司專注於設計、建設及營運AI工廠,核心產品HyperCube整合供電、液冷與伺服器機架,並提供GPU雲端算力服務。英偉達透過股權投資與技術合作,協助Firmus擴張亞太地區AI數據中心,同時擴大其晶片與計算架構的市場覆蓋。

1 小時前