螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數

重點摘要
首頁 > 智能時代>人工智能 螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數 2026/8/8 7:49:46 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.
首頁 > 智能時代>人工智能 螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數 2026/8/8 7:49:46 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.0-flash 採用 124B 總參數、5.1B 激活參數的 MoE 架構。官方同步提供基礎版本以及 FP8、FP4、INT4 等多個版本,提供三種不同的落地選擇:API 調用:面向希望快速接入、無需自建推理服務的開發者,Ling-3.
0-flash 可通過雲端 API 直接調用;單機私有化:面向數據不能出域的企業和團隊,MXFP4 與 INT4 版本可在單臺 NVIDIA DGX Spark 上完成端到端推理;高性能部署:面向單請求時延敏感的高性能服務,在指定 GPU 測試配置下,平均輸出速率突破 1100 tokens/s。對於希望快速驗證產品、上線 Agent 應用的開發者和產品團隊,API 是門檻最低的接入方式。在 Artificial Analysis 榜單中,Ling-3.0-flash 輸出速度達到 353 tokens/s。在 AA Intelligence Index 榜單中,Ling-3.
0-flash 每項任務的加權平均調用成本約為 0.04 美元(現匯率約合 0.27 元人民幣),加權平均解碼時間約為 1.4 分鐘,同時進入“智能水平 — 任務成本”和“智能水平 — 任務耗時”的優勢區域。官方表示,2026 年 8 月 7 日 00:00 至 8 月 31 日 24:00,Ling-3.0-flash 在 Ling Studio 限時享受 2.5 折優惠;自 9 月 1 日 00:00 起恢復原價。IT之家附開源鏈接:Hugging Face:https://huggingface.co/inclusionAI/Ling-3.
0-flashModelScope:https://modelscope.cn/models/inclusionAI/Ling-3.0-flash相關閱讀:《螞蟻集團發佈百靈原生混合推理模型 Ling-3.0-flash:124B 總參數量,能力對標上一代旗艦 Ring-2.6-1T》廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:螞蟻集團,百靈,Ling3.
0flash,模型Meta 旗下 AI 模型測試時意外入侵第三方企業系統字節 Seedance 2.5 視頻模型 API 上線,原生支持 30 秒視頻直出華為官宣昇騰 0 Day 支持螞蟻百靈 Ling-3.0-flash 模型,全新算子編程框架 CANN PyPTO 首秀繼 OpenAI、Anthropic 之後,Meta AI 模型測試期間也發生“越界”事件Liquid AI 發佈 LFM2.5-2.6B 端側小模型,支持智能手機本地運行字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包
Related
相關文章

Edge AI Daily 早報(8月8日)
OpenAI推出售價400美元的AI音箱,蘋果則計劃2026年推出整合HomeKit生態的安防攝像頭。國內跨境電商市場出現結構性調整,中金指底部反轉,品牌化與AI轉型業者受益。開源社群在低資源語言、推理引擎與氣象模型上取得進展,英偉達也開源cuFile以因應AI算力瓶頸。

工業AI企業碩橙科技完成超億元D+輪融資,工業母機產業投資基金領投|首發
工業AI企業碩橙科技完成超億元D+輪融資,工業母機產業投資基金領投|首發飛向TAI空2026.08.08 08:00 · 來自北京全文1257字00:00 / 03:57工業AI的競爭已從模型性能的比拼轉向交付能力、規模化產業落地能力、系統級整合能力的較量。AI加速落地垂直行業,工業領域是“主戰場”之一,資本押注與場景實踐均呈加速之勢。

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
騰訊雲開源 TencentDB Agent Memory v2.0:專為 AI 編碼代理打造的團隊級記憶中樞
Tencent Cloud has open-sourced TencentDB Agent Memory v2.0, a team-level memory hub for AI agents. The idea is super simple: if project context was already explained once, a new session should not need it repeated.
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。