剛剛,阿里開源2.4萬億參數大模型!性能比肩Fable 5

2026年8月12日 22:05
站內 AI 整理稿

作者 | 程茜 編輯 | 心緣 8月13日報道,剛剛,阿里千問大模型團隊開放Qwen3.8-2.4T-A95B模型權重!Qwen3.8-Max是基於Qwen3.8-2.4T-A95B的官方版本,於8月3日發佈,擁有更多功能,例如視覺輸入功能、無需思考即可使用、默認支持1百萬上下文長度處理、內置官方工具等。▲Qwen3.8-2.4T-A95B開源主頁(圖源:Hugging Face) 魔搭社區模型下載地址: https://modelscope.cn/models/Qwen/Qwen3.8-2.4T-A95B Hugging Face模型下載地址: https://huggingface.

co/Qwen/Qwen3.8-2.4T-A95B 這也是阿里千問首次將Max級別的旗艦模型對外開放權重。根據魔搭社區的官方預告,更小杯Qwen3.8-27B已在路上。Qwen3.8-2.4T-A95B的模型總參數為2.4萬億,每個Token激活950億參數,原生支持262144 Token上下文,可擴展至101萬Token。該模型採用Qwen3.5的底層架構,在編程、辦公、科研工作、長週期智能體任務上實現性能提升。Qwen3.8-2.4T-A95B模型可以通過SGLang、vLLM和TokenSpeed推理引擎部署,正式部署時需要使用各框架針對Qwen3.

8的最新Recipe,並根據權重精度、GPU型號與數量選擇並行策略。Qwen3.8模型默認以思考模式運行,在生成最終回答前,模型會先生成由\n…\n\n標記的思考內容。Qwen3.8-2.4T-A95B不支持關閉思考模式。與此同時,開源AI項目團隊Unsloth AI靠動態1‑bit分層選擇性量化技術,將Qwen3.8‑2.4T‑A95B原始4.9TB的模型體積壓縮至397GB,存儲空間縮減91%。藉助Unsloth‑Desktop工具,設備內存+顯存總量達到410GB以上即可本地運行該模型。▲Unsloth AI壓縮Qwen3.8-2.4T-A95B(圖源:X) 預告Qwen3.

8發佈時,千問稱該模型“可能是除了Fable 5外最強大的模型”。基準測試結果顯示,在論文復現基準PaperBench中,Qwen3.8-Max取得93.0分,高於GPT-5.6 Sol、Fable 5和Claude Opus 4.8。在評估電腦操作能力的OSWorld-Verified中,Qwen3.8-Max以86.1分位居參評模型首位;在參數化CAD基準中,其91.5分同樣超過Fable 5、GPT-5.6 Sol和Gemini 3.1 Pro。不過,Qwen3.8-Max尚未在所有測試中取得領先。在TerminalBench 2.1中,其成績為86.6分,略低於GPT-5.

6 Sol的88.8分;在SWE-bench Pro中,Qwen3.8-Max獲得67.7分,落後於Fable 5的80.0分和Claude Opus 4.8的69.2分;在長視頻基準VideoMME v2中,其68.3分也低於GPT-5.6 Sol的71.1分。▲Qwen3.8-Max基準測試結果(圖源:阿里) Qwen3.8的重點是模型能否脫離人工持續陪伴,自己把一個跨度數小時、數天甚至數週的任務做完。千問團隊讓Qwen3.8-Max連續自主編程約16天、獨立復現並改進一篇研究論文、參加真實算法競賽,還讓它在超過2000輪交互中經營一家虛擬電商企業。

在連續自主編程16天的任務中,Qwen3.8-Max自主構建了自進化Harness,並持續完成社區需求收集、issue派發、代碼生成、驗證與自我修復。▲Qwen3.8-Max執行自主編程任務(圖源:阿里) API價格方面,Qwen3.8-Max國內每百萬Tokens輸入12元、輸出36元,隱式緩存命中1.5元;海外每百萬Tokens輸入2美元、輸出6美元,隱式緩存命中0.25美元。▲API價格對比表(製圖) 結語:全球三大頂流模型齊更新!Qwen3.8拉高開源天花板 一夜之間,三家大模型頂流輪番炸場:先是馬斯克甩出自家最強模型Grok 4.6,其中Grok 4.

6 high在其披露的多項智能體編程和知識工作基準測試中綜合性能與GPT-5.6 Sol Max、Claude Fable 5 Max相當;接著DeepSeek-V4-Pro正式版上線,綜合性能接近、部分指標超越Claude Fable 5;最後是Qwen3.8開放權重。可以看出,這三家公司都著重強化了模型多步驟長週期自主工作能力,開始比拼模型獨立承接完整項目、自主閉環幹活的智能體水平。此外,阿里千問團隊此次將2.4萬億參數頂級旗艦模型正式開放權重,是中國開源大模型佈局的關鍵落子。

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛
全天候科技生成式AI

企業AI最後一公里:三路人馬在此交鋒

鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。

剛剛