Artificial Analysis 聯手 Liquid AI 發手機端 AI 跑分:iPhone 17 Pro 跑 8GB 內模型座次出爐

2026年8月26日 08:326000 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文Artificial Analysis 聯手 Liquid AI 發手機端 AI 跑分:iPhone 17 Pro 跑 8GB 內模型座次出爐發布於AI新閒資訊時間 :Aug 26, 2026閱讀 :1分鐘AI 評測機構 Artificial Analysis 於 8 月 24 日發佈博文,攜手 Liquid AI 推出面向手機端的本地 AI 性能基準,重點關注模型在蘋果 iPhone 17 Pro 上的真實表現。

雙方分工明確:Artificial Analysis 負責智能水平測試,Liquid AI 負責推理性能測試,共選用函數調用、指令遵循、知識認知、高難問答與數學五類基準。小模型也能跑出高智能測試對象為 4 bit 量化後體積不超過 8GB、可在端側跑起來的模型,示例包括 Gemma 4 E2B 與 LFM2-2.6B-Exp。在上下文限制 16K tokens 時,平均得分最高的是南北閣實驗室的 Nanbeige4.2-3B 與 Liquid AI 的 LFM2.5-2.6B;若把響應時間卡在 1 分鐘內,LFM2.5-8B-A1B 則登頂,其後依次為 LFM2-2.

6B-Exp、Gemma 4 E4B 與 Granite 4.1 8B。Nanbeige4.2-3B 由 BOSS 直聘旗下實驗室推出,僅 30 億非嵌入參數卻借 Looped Transformer 架構循環複用層,在不增參數的前提下抬高有效計算深度,得分比肩對手。這套基準把"端側小模型"的智能上限擺上檯面,也說明手機本地 AI 的競賽,正從單純能跑轉向跑得快、答得準。相關推薦DeepSeek 前 7 月營收 4.75 億元激增 9 倍,5000 億估值二輪融資在途DeepSeek正推進第二輪融資。2026年前7個月營收約4.75億元,是2025全年十倍,淨虧損由9.35億收窄至7.15億。

開源模型帶來高毛利,業務增速顯著,為潛在IPO鋪路。6月完成首輪500億元融資後,隨即啟動第二輪,計劃募資500億元。Aug 26, 202696.4kStability AI 完成 7600 萬美元 B 輪:EA 與三大唱片巨頭齊押注Stability AI完成7600萬美元B輪融資,將用於創意產品開發、應用研究及專業服務。投資方包括EA、索尼音樂、環球音樂、華納音樂和AMD風投。CEO稱此舉印證生成式AI賦能製片人、音樂人與講述者的願景。Aug 26, 202687.

1k機器人初創公司 Generalist 完成新一輪融資,估值達30億美元機器人初創公司Generalist完成由8VC領投的近2億美元新增融資,估值升至30億美元。本輪是今年6月Radical Ventures領投、估值20億美元的4億美元B輪延續,使B輪總額達6億美元。公司由前DeepMind研究員Pete Florence、Andy Zeng及前波士頓動力工程師Andrew Barry於2024年創立。Aug 26, 202685.

2k星上智駕時代開啟:國產航天垂直大模型“華山”完成在軌實測驗證中科天塔自研航天大模型“華山”健康管理模塊隨“辰光一號”衛星入軌後,完成星上AI全流程在軌實戰驗證。該模塊專注商業航天智能化管理,賦予衛星遙測數據解析、異常檢測、趨勢預測與自主決策能力,標誌衛星在軌運維模式迎來技術變革。Aug 26, 2026151.6kClaude 記憶打通 Cowork 與聊天:背景一次說明,兩端共享Anthropic宣佈統一Claude Cowork與聊天功能的記憶機制,兩套系統打通管理。Cowork可複用聊天記憶,用戶無需反覆交代背景,工作銜接更順暢。

敏感信息默認不存儲,用戶可手動開啟雙向打通:Cowork執行任務時可讀取聊天記憶,其產生的新記憶也會迴流聊天使用。官方強調健康、個人等敏感數據保護。Aug 26, 2026137.7k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

HappyHorse與Wan3.0賽馬,誰是阿里版Seedance?

中國 AI 影片生成賽道的競爭進入新階段,阿里巴巴旗下的通義千問團隊近期動作頻頻,其影片生成模型「萬相」(Wan)持續迭代,而與此同時,市場上出現了一款名為 HappyHorse 的產品,憑藉其獨特的風格化表現與高品質輸出,迅速在創作者圈層中累積口碑。兩者之間的比較,尤其是「誰才是阿里版 Seedance」的討論,成為近期 AI 圈最熱門的話題之一。這不僅是兩款產品的對決,更折射出中國 AI 大模型公司在面對 OpenAI Sora 等國際對手時,如何走出差異化路線的戰略思考。

剛剛
量子位模型更新

宇樹智元共用一個大腦!神秘模型Demo炸場,10分鐘一鏡到底

一段長達10分鐘、一鏡到底的機器人實測影片曝光,畫面中宇樹與智元兩款硬體架構迥異的機器人,竟能共用同一個「大腦」並互相協作,完成擦窗、搬箱墊高、中斷後恢復等長程任務。影片全程無剪輯、無遙控、無人工指令,被視為全球罕見的跨本體通用大腦樣本,可能顛覆具身智慧產業的技術判斷與Scaling Law認知。

剛剛
鈦媒體模型更新

實測豆包工作:WorkBuddy迎來最強對手?

實測豆包工作:WorkBuddy迎來最強對手?AIX財經2026.08.26 10:00 · 來自福建全文4573字00:00 / 14:08一週補全能力,豆包工作好用嗎?文 | AIX財經,作者 | 雷晶,編輯 | 金璵璠8月25日,字節跳動正式發佈AI辦公Agent產品豆包工作。豆包工作的模型提供自動、豆包2.1 Pro和豆包2.1 Turbo三種選擇,用戶可以根據任務複雜度選擇不同能力。使用入口也比較多,既可以下載獨立App,也可以直接在豆包APP的工作任務區使用,還能從飛書內調用。相比市面上的同類Agent應用,豆包工作最大的特點在於與飛書深度打通,可以在權限範圍內調用企業協作場景中的文檔、聊天記錄、會議紀要等信息,讓Agent參與到日常辦公任務中。在正式發佈之前,豆包用一週時間連續更新了多項辦公Agent能力。8月17日,手機遠程控制電腦上線,用戶可以通過手機訪問電腦文件,直接調取和處理分散在不同設備中的資料。8月18日,Windows虛擬桌面上線,AI可以在獨立環境中執行任務,避免影響用戶自己的電腦環境。8月20日,側邊工作臺上線,將本地文件、飛書文檔、網頁和代碼等內容集中到同一個工作空間。8月21日,技能商店、連接器和工作夥伴功能推出,讓用戶可以將常用流程沉澱下來,後續重複調用。這一系列更新補充了Agent進入辦公場景所需要的幾個環節,既能操作電腦和調用資料,也能在獨立環境中執行任務,還開始嘗試把一次性的操作沉澱為可複用流程。此外,字節也在調整AI辦公業務佈局。8月24日,有媒體爆出TRAE、釦子(Coze)團隊併入豆包體系,其中TRAE Work、釦子將與豆包在工作場景的產品能力進行整合,TRAE IDE及CLI則作為豆包品牌下的編程產品線繼續發展。在這一背景下,作為字節面向AI辦公場景推出的Agent產品,豆包工作實際效果體驗如何呢?我們來一起看看。01.

剛剛