螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數

作者:沁滄(實習) 責編:沁滄 評論: 8 月 8 日消息,螞蟻集團旗下百靈大模型官方昨日宣佈,新一代原生混合推理模型 Ling-3.0-flash 現已正式開源。Ling-3.0-flash 採用 124B 總參數、5.1B 激活參數的 MoE 架構。官方同步提供基礎版本以及 FP8、FP4、INT4 等多個版本,提供三種不同的落地選擇:API 調用:面向希望快速接入、無需自建推理服務的開發者,Ling-3.
0-flash 可通過雲端 API 直接調用;單機私有化:面向數據不能出域的企業和團隊,MXFP4 與 INT4 版本可在單臺 NVIDIA DGX Spark 上完成端到端推理;高性能部署:面向單請求時延敏感的高性能服務,在指定 GPU 測試配置下,平均輸出速率突破 1100 tokens/s。對於希望快速驗證產品、上線 Agent 應用的開發者和產品團隊,API 是門檻最低的接入方式。在 Artificial Analysis 榜單中,Ling-3.0-flash 輸出速度達到 353 tokens/s。在 AA Intelligence Index 榜單中,Ling-3.
0-flash 每項任務的加權平均調用成本約為 0.04 美元(現匯率約合 0.27 元人民幣),加權平均解碼時間約為 1.4 分鐘,同時進入“智能水平 — 任務成本”和“智能水平 — 任務耗時”的優勢區域。官方表示,2026 年 8 月 7 日 00:00 至 8 月 31 日 24:00,Ling-3.0-flash 在 Ling Studio 限時享受 2.5 折優惠;自 9 月 1 日 00:00 起恢復原價。附開源鏈接:Hugging Face:https://huggingface.co/inclusionAI/Ling-3.
0-flashModelScope:https://modelscope.cn/models/inclusionAI/Ling-3.0-flash相關閱讀:《螞蟻集團發佈百靈原生混合推理模型 Ling-3.0-flash:124B 總參數量,能力對標上一代旗艦 Ring-2.6-1T》廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:螞蟻集團,百靈,Ling3.
0flash,模型Meta 旗下 AI 模型測試時意外入侵第三方企業系統字節 Seedance 2.5 視頻模型 API 上線,原生支持 30 秒視頻直出華為官宣昇騰 0 Day 支持螞蟻百靈 Ling-3.0-flash 模型,全新算子編程框架 CANN PyPTO 首秀繼 OpenAI、Anthropic 之後,Meta AI 模型測試期間也發生“越界”事件Liquid AI 發佈 LFM2.5-2.6B 端側小模型,支持智能手機本地運行字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包
Related
相關文章

阿里平頭哥發佈AI芯片真武V900,算力達M890三倍
基於真武V900構建的單一集群可擴展至50萬卡,可為前沿AI模型訓練與推理提供大規模算力支持。阿里表示,隨著平頭哥芯片產品線逐步成熟並獲得廣泛客戶應用,預計芯片年出貨量將大幅提升。阿里集團CEO吳泳銘透露,阿里自研M890AI超節點目前已具備支撐2萬億參數大模型推理的能力,並已於本季度規模化上架阿里雲數據中心。

騰訊混元圖像3.5來了:畫字更準、修圖更強、一張2K圖只要一毛五
新版本在畫質、排版、修圖等核心能力上全面升級,同時大幅降低使用成本,主打"便宜又好用"。據官方介紹,Hy Image3.5preview相比上一代能力提升了約30%。在畫字能力上,模型對文字內容的還原更加精準,不再出現"缺胳膊少腿"的尷尬;排版能力也顯著增強,可以更好地理解用戶對畫面佈局的要求;修圖方面,模型支持最多5張參考圖同時輸入,用戶可以根據多張圖片的風格或元素進行融合調整,最高支持2K分辨率輸出。

騰訊混元 Hy Image3.5 preview 發佈:支持文生圖與多輪對話創作,已上線元寶、ima 等應用
作者:問舟 責編:問舟 評論: 感謝網友 Domado 的線索投遞!9 月 22 日消息,騰訊混元團隊今日宣佈推出 Hy Image3.5 preview 模型。騰訊稱該模型面向專業級生圖創作,支持文生圖、圖生圖和多輪對話創作。騰訊稱,該模型經過內部數百名專業設計師 GSB 盲測,對比 Hy Image3.

阿里平頭哥將發佈最強國產 AI 芯片真武 V900,算力提升 2 倍
作者:汪淼 責編:汪淼 評論: 9 月 22 日消息,由阿里集團主辦的 2026 雲棲大會於 9 月 22 日至 24 日在杭州國際博覽中心舉行。從大會現場獲悉,本屆雲棲大會上,阿里平頭哥將發佈最強國產 AI 芯片真武 V900,算力提升至真武 M890 的 3 倍。
上海AI Lab與上交大拋出NCP預訓練新範式,8.9B隱空間模型用一半Token追平對手
他們提出全新預訓練任務下一個概念預測(NCP),並順勢推出全球首個8.9B規模的離散隱空間基座模型NCP-ArchPreview,把訓練效率的賬本重新算了一遍。這組數字相當刺眼。模型基於5.73T的Dolma- 3 語料預訓練,卻只用掉51.

從代碼生成到組織重構,AI Coding如何跨越生產力鴻溝 | 2026 ITValue Summit數字價值年會
飛向TAI空2026.09.22 10:38 · 來自北京全文5250字00:00 / 14:36AI Coding時代到來,軟件開發領域的生產力和生產關係都迎來全新變革。9月16日至17日,2026 ITValue Summit數字價值年會在三亞如期舉行。