螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數

2026年8月8日 07:49
螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數
站內 AI 整理稿

作者:沁滄(實習) 責編:沁滄 評論: 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.0-flash 採用 124B 總參數、5.1B 激活參數的 MoE 架構。官方同步提供基礎版本以及 FP8、FP4、INT4 等多個版本,提供三種不同的落地選擇:API 調用:面向希望快速接入、無需自建推理服務的開發者,Ling-3.

0-flash 可通過雲端 API 直接調用;單機私有化:面向數據不能出域的企業和團隊,MXFP4 與 INT4 版本可在單臺 NVIDIA DGX Spark 上完成端到端推理;高性能部署:面向單請求時延敏感的高性能服務,在指定 GPU 測試配置下,平均輸出速率突破 1100 tokens/s。對於希望快速驗證產品、上線 Agent 應用的開發者和產品團隊,API 是門檻最低的接入方式。在 Artificial Analysis 榜單中,Ling-3.0-flash 輸出速度達到 353 tokens/s。在 AA Intelligence Index 榜單中,Ling-3.

0-flash 每項任務的加權平均調用成本約為 0.04 美元(現匯率約合 0.27 元人民幣),加權平均解碼時間約為 1.4 分鐘,同時進入“智能水平 — 任務成本”和“智能水平 — 任務耗時”的優勢區域。官方表示,2026 年 8 月 7 日 00:00 至 8 月 31 日 24:00,Ling-3.0-flash 在 Ling Studio 限時享受 2.5 折優惠;自 9 月 1 日 00:00 起恢復原價。附開源鏈接:Hugging Face:https://huggingface.co/inclusionAI/Ling-3.

0-flashModelScope:https://modelscope.cn/models/inclusionAI/Ling-3.0-flash相關閱讀:《螞蟻集團發佈百靈原生混合推理模型 Ling-3.0-flash:124B 總參數量,能力對標上一代旗艦 Ring-2.6-1T》廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:螞蟻集團,百靈,Ling3.

0flash,模型Meta 旗下 AI 模型測試時意外入侵第三方企業系統字節 Seedance 2.5 視頻模型 API 上線,原生支持 30 秒視頻直出華為官宣昇騰 0 Day 支持螞蟻百靈 Ling-3.0-flash 模型,全新算子編程框架 CANN PyPTO 首秀繼 OpenAI、Anthropic 之後,Meta AI 模型測試期間也發生“越界”事件Liquid AI 發佈 LFM2.5-2.6B 端側小模型,支持智能手機本地運行字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包

Related

相關文章