IT之家生成式AI

螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數

2026年8月8日 07:49
螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數

重點摘要

首頁 > 智能時代>人工智能 螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數 2026/8/8 7:49:46 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.

站內 AI 整理稿

首頁 > 智能時代>人工智能 螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數 2026/8/8 7:49:46 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.0-flash 採用 124B 總參數、5.1B 激活參數的 MoE 架構。官方同步提供基礎版本以及 FP8、FP4、INT4 等多個版本,提供三種不同的落地選擇:API 調用:面向希望快速接入、無需自建推理服務的開發者,Ling-3.

0-flash 可通過雲端 API 直接調用;單機私有化:面向數據不能出域的企業和團隊,MXFP4 與 INT4 版本可在單臺 NVIDIA DGX Spark 上完成端到端推理;高性能部署:面向單請求時延敏感的高性能服務,在指定 GPU 測試配置下,平均輸出速率突破 1100 tokens/s。對於希望快速驗證產品、上線 Agent 應用的開發者和產品團隊,API 是門檻最低的接入方式。在 Artificial Analysis 榜單中,Ling-3.0-flash 輸出速度達到 353 tokens/s。在 AA Intelligence Index 榜單中,Ling-3.

0-flash 每項任務的加權平均調用成本約為 0.04 美元(現匯率約合 0.27 元人民幣),加權平均解碼時間約為 1.4 分鐘,同時進入“智能水平 — 任務成本”和“智能水平 — 任務耗時”的優勢區域。官方表示,2026 年 8 月 7 日 00:00 至 8 月 31 日 24:00,Ling-3.0-flash 在 Ling Studio 限時享受 2.5 折優惠;自 9 月 1 日 00:00 起恢復原價。IT之家附開源鏈接:Hugging Face:https://huggingface.co/inclusionAI/Ling-3.

0-flashModelScope:https://modelscope.cn/models/inclusionAI/Ling-3.0-flash相關閱讀:《螞蟻集團發佈百靈原生混合推理模型 Ling-3.0-flash:124B 總參數量,能力對標上一代旗艦 Ring-2.6-1T》廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:螞蟻集團,百靈,Ling3.

0flash,模型Meta 旗下 AI 模型測試時意外入侵第三方企業系統字節 Seedance 2.5 視頻模型 API 上線,原生支持 30 秒視頻直出華為官宣昇騰 0 Day 支持螞蟻百靈 Ling-3.0-flash 模型,全新算子編程框架 CANN PyPTO 首秀繼 OpenAI、Anthropic 之後,Meta AI 模型測試期間也發生“越界”事件Liquid AI 發佈 LFM2.5-2.6B 端側小模型,支持智能手機本地運行字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包

Related

相關文章

鈦媒體生成式AI

Edge AI Daily 早報(8月8日)

OpenAI推出售價400美元的AI音箱,蘋果則計劃2026年推出整合HomeKit生態的安防攝像頭。國內跨境電商市場出現結構性調整,中金指底部反轉,品牌化與AI轉型業者受益。開源社群在低資源語言、推理引擎與氣象模型上取得進展,英偉達也開源cuFile以因應AI算力瓶頸。

剛剛
鈦媒體生成式AI

工業AI企業碩橙科技完成超億元D+輪融資,工業母機產業投資基金領投|首發

工業AI企業碩橙科技完成超億元D+輪融資,工業母機產業投資基金領投|首發飛向TAI空2026.08.08 08:00 · 來自北京全文1257字00:00 / 03:57工業AI的競爭已從模型性能的比拼轉向交付能力、規模化產業落地能力、系統級整合能力的較量。AI加速落地垂直行業,工業領域是“主戰場”之一,資本押注與場景實踐均呈加速之勢。

剛剛
MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

4 小時前