MarkTechPost AI模型更新

Liquid AI Releases LFM2.5-2.6B: An On-Device Agentic Model With 128K Context, Tool Calling, And Open Weights

2026年8月7日 03:42

重點摘要

Liquid AI released LFM2.5-2.6B, an agentic model that runs entirely on-device. It plans, calls tools, and works through multi-step tasks on phones, laptops, PCs, and robots. The model has 2.

站內 AI 整理稿

Liquid AI 正式發布全新裝置端代理模型 LFM2.5-2.6B,這款模型專為在手機、筆電、個人電腦與機器人上直接執行所設計,具備規劃、工具呼叫與多步驟任務處理能力。模型總參數量為 26.9 億,支援 131,072 token 的上下文窗口與 128,000 token 的詞彙表,預訓練階段使用了約 34 兆 token 的資料。Liquid AI 同步釋出兩個檢查點版本,分別是供微調使用的 LFM2.5-2.6B-Base,以及針對代理任務最佳化的 LFM2.5-2.6B post-trained 版本。 由於推論過程完全在本地端進行,資料不會離開裝置,每次執行所產生的邊際成本也趨近於零。Liquid AI 表示,在工具使用與指令遵循的評測成績上,這款模型能與規模將近四倍的模型競爭,例如在 ToolSandbox 與 Multi-IF 等基準測試中表現突出。模型目前已在 Hugging Face 上以 lfm1.0 授權公開,提供原生、GGUF、MLX 與 ONNX 等多種格式,並在 llama.cpp、vLLM、SGLang 與 LM Studio 等框架中獲得首日支援。 在執行效能方面,LFM2.5-2.6B 在 Apple M5 Max 晶片上可達到每秒 220 token 的解碼速度,記憶體占用低於 2.5 GB;在手機上則約為每秒 30 token。對於中型團隊而言,可以透過單張 NVIDIA H100 SXM5 GPU 自行部署,每日約可處理 13 億 token。企業與 OEM 廠商則可透過 GGUF 與 ONNX 格式,將相同權重部署至大量終端裝置。微調部分支援透過 LoRA 搭配 TRL 與 Unsloth 進行。 Liquid AI 鎖定的應用領域包括汽車、消費性電子、工業機器人、醫療保健、金融服務、電子商務與國防等產業。尤其對受監管或需要隔離網路的環境最為有利,因為所有提示詞都不會送往第三方 API。官方建議的應用情境涵蓋代理任務、工具呼叫、資料擷取、檢索增強生成(RAG)與長上下文處理,實際案例包括裝置端助理、離線文件分類、表單與發票內容擷取、機器人指令解析,以及可持續在背景運作且不產生逐 token 費用的代理程式。不過 Liquid AI 明確表示,這款模型不適合用於代理式程式碼生成或知識密集型任務。 在模型架構上,LFM2.5-2.6B 擁有 26.9 億總參數與 30 層結構,由 22 個雙閘極短卷積區塊與 8 個分組查詢注意力區塊組成。詞彙表大小為 128,000,上下文長度達 131,072 token。預訓練使用了約 34 兆 token 的資料。Liquid AI 特別說明,團隊是在既有 tokenizer 基礎上直接擴充詞彙表至 128K,而非重新訓練,並透過專門的中段訓練階段將上下文延伸至 128K。模型支援 16 種語言,且僅處理文字輸入。 後訓練階段則分為四個步驟。首先進行兩輪連續的監督式微調,其 SFT 混合資料量約為 LFM2.5-8B-A1B 所用資料的七倍。接著進入教師專業化階段,每個領域配置一位專家,並以可驗證獎勵的強化學習進行訓練。第三步是多領域的 on-policy 蒸餾,學生模型在自己的策略下進行推論,每個提示詞會路由至對應領域的教師模型。最後則是在真實代理框架中,以 GRPO 進行代理強化學習,涵蓋 Hermes Agent 與 OpenClaw 等環境。 在基準測試表現上,Liquid AI 將 LFM2.5-2.6B 與 gemma-4-E2B-it(5.1B)、gemma-4-E4B-it(8B)、Qwen3.5-4B(4.7B)以及 Qwen3.5-9B(9.7B)進行比較。結果顯示,LFM2.5-2.6B 在 ToolSandbox 拿下 77.83 分,勝過 gemma-4-E4B-it 的 65.00 分,但略低於 Qwen3.5-9B 的 76.44 分;在 Multi-IF 上以 80.07 分領先所有對手;IFStruct 則為 85.49 分;IFBench 為 59.17 分;BFCLv4 為 56.88 分,僅落後 Qwen3.5-9B 的 60.13 分。在程式碼生成方面,大型模型仍保有優勢,LFM2.5-2.6B 在 LiveCodeBenchv6 的分數為 59.41 分,而 Qwen3.5-9B 達到 69.86 分。 整體而言,LFM2.5-2.6B 的定位相當明確,鎖定的是需要在終端裝置上執行代理任務、重視隱私與成本控制的場景。由於所有運算都在本地完成,對於不適合將資料送往雲端的企業與政府單位而言,這款模型提供了實際可行的部署選項。獨立開發者與新創團隊也能直接使用手上既有的硬體進行測試與產品原型開發。

Related

相關文章

鈦媒體模型更新

實測騰訊WorkBuddy:能力及格,但生態真香

實測騰訊WorkBuddy:能力及格,但生態真香光錐智能2026.08.07 11:36 · 來自北京全文4476字00:00 / 12:00暫時跑贏半個身位的WorkBuddy,能不能守住下半場文|光錐智能,作者 | 魏琳華 ,編輯|劉俊宏Work類產品是一場酣暢淋漓的生態融合。

剛剛
IT之家模型更新

阿里千問:推出定時任務、辦公助理、語音通話等多項新功能

首頁 > 智能時代>人工智能 阿里千問:推出定時任務、辦公助理、語音通話等多項新功能 2026/8/7 10:32:28 來源:IT之家 作者:浩渺 責編:浩渺 評論: 感謝IT之家網友 未央、山有扶蘇 的線索投遞! IT之家 8 月 7 日消息,千問 App 今日宣佈功能上新,推出思考研究、定時任務、辦公助理、語音通話、智能體廣場等多項新功能,同時支持最新旗艦模型 Qwen3.8-MAX。

剛剛
IT之家模型更新

消息稱阿里計劃向下一代千問 Qwen 開源模型大型商用用戶收取營收分成

首頁 > 智能時代>人工智能 消息稱阿里計劃向下一代千問 Qwen 開源模型大型商用用戶收取營收分成 2026/8/7 9:39:42 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 7 日消息,據路透社消息,兩位知情人士透露,阿里巴巴計劃向其下一代通義千問開源模型的大型商用用戶收取費用,要求從收益中抽取一定比例的分成。

剛剛

宇樹科技IPO戰略配售曝光:DeepSeek獲配93.3萬股,鎖定36個月

宇樹科技IPO戰略配售結果曝光,DeepSeek獲配93.33萬股,認購金額約1.41億元,鎖定期36個月;騰訊旗下公司亦獲配約90.33萬股。本次發行價150.8元,發行市值約609億元,募資總額約60.99億元,但市盈率與市銷率均高於同業平均,投資者需留意股價波動風險。

3 小時前4200
雷峰網模型更新

150.8元/股!宇樹科技超百名員工參與IPO「盛宴」,一批90後千萬富豪或將誕生;DeepSeek擬上調API服務定價;字節擬訓練超5萬億參數大模型

這篇消息聚焦「150.8元/股!宇樹科技超百名員工參與IPO「盛宴」,一批90後千萬富豪或將誕生;DeepSeek擬上調API服務定價;字節擬訓練超5萬億參數大模型」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

4 小時前