螞蟻百靈開源 Ling-3.0-tiny 模型,支持英偉達 DGX Spark、蘋果 Mac mini 部署

2026年8月11日 17:57
螞蟻百靈開源 Ling-3.0-tiny 模型,支持英偉達 DGX Spark、蘋果 Mac mini 部署
站內 AI 整理稿

作者:潞源 責編:潞源 評論: 8 月 11 日消息,螞蟻百靈今天在 Hugging Face 平臺開源 Ling-3.0-tiny 模型,該模型為輕量級混合推理 MoE 架構,總參數 7.9B,每 Token 激活 1.3B 參數。官方提供 BF16、FP8 和 INT4 權重版本,適配不同平臺的部署需求。據介紹,Ling-3.0-tiny 主打低成本推理,採用高效混合線性架構,將 KDA(Kimi Delta Attention)和 MLA(Multi-Head Latent Attention,多頭潛在注意力)按照 3:1 比例交替堆疊。

採用包含 128 個路由專家(routed experts)的稀疏 MoE 前饋網絡(FFN),在上下文處理能力和計算成本間取得平衡。注意到,該模型支持快速響應模式和多步驟推理模式,專為本地部署設計,官方已在英偉達 DGX Spark、Apple Silicon MacBook 和 Mac mini 等電腦驗證。在 M4 Pro 的 MacBook 上可達到約 86-90 Token/s 的推理速度,8K 上下文長度下,峰值內存佔用約為 8.34 GiB。參考:inclusionAI/Ling-3.

0-tiny · Hugging Face廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Ling3.0tiny,螞蟻百靈,開源模型,大模型AI 大模型周榜:阿里 qwen3.8-max 衝進綜合榜 Top 6,國產多模型表現亮眼螞蟻集團百靈開源 Ling-3.0-flash 模型:124B 總參數、5.1B 激活參數華為官宣昇騰 0 Day 支持螞蟻百靈 Ling-3.

0-flash 模型,全新算子編程框架 CANN PyPTO 首秀字節跳動 SeedRealtime 音視頻全雙工大模型發佈:支持邊看、邊聽、邊說,已上線豆包視頻能“邊播邊改”:京東開源自研 JoyAI-Video-Edit 模型,各項指標全球領先英偉達 Alpamayo 2 Super AI 開放商用:為自動駕駛汽車帶來 360° 感知、高級駕駛決策

Related

相關文章

鈦媒體生成式AI

王興興“錯配”梁文鋒?

王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛