千問開源Qwen3.8-Flash-Next架構,輕量化多模態大模型實現效能突破
AI資訊AI新閒資訊正文千問開源Qwen3.8-Flash-Next架構,輕量化多模態大模型實現效能突破發布於AI新閒資訊時間 :Aug 27, 2026閱讀 :1分鐘近日,阿里千問團隊正式發佈多模態MoE模型Qwen3.8-Flash,並同步開源下一代底層架構Qwen3.8-Flash-Next,該架構也是全新一代Qwen4系列模型的雛形。Qwen3.8-Flash總參數量125B,額外搭載51B N-gram Embedding,但每token僅激活6B參數。模型原生支持26萬token上下文,藉助YaRN技術可擴展至100萬token。在成本上優勢顯著,訓練開銷僅為前代Qwen3.
7-Plus的九分之一,API定價每百萬Tokens輸入1元、輸出3元,目前已上線千問AI平臺,同步推出“千問辦公”功能。架構層面,團隊完成四大核心升級。注意力模塊採用GDN+QSA混合架構,GDN負責壓縮歷史信息,QSA篩選關鍵上下文,百萬token場景下Prefill、Decode最高分別加速7.6倍、4.
9倍;Gated Residual機制將殘差流拓展為4條並行分支,依靠動態門控優化跨層信息傳遞,提升訓練穩定性;N-gram Embedding利用局部上下文查表擴充模型容量,新增51B參數幾乎不增加計算負擔;訓練環節採用Muon與AdamW混合優化策略,重新擬合Scaling Law,省去批次預熱流程。多項基準測試顯示,依靠6B激活參數,基礎模型在14項評測中斬獲8項最優成績。微調版本在代碼、智能體、多模態任務上表現亮眼,SWE-bench Pro達到62.5分,CoWorkBench、Toolathlon等智能體榜單大幅領先同類模型。目前Qwen3.
8-Flash-Next權重已在Hugging Face、ModelScope開源,完整技術報告同步公開。千問團隊提前開放架構,希望藉助社區力量驗證創新方案,持續迭代技術,穩步推進Qwen4系列模型研發。相關推薦 原“阿里雲開發者”公眾號正式更名為“千問AI平臺”阿里雲將“阿里雲開發者”公眾號更名為“千問AI平臺”,定位“為Agent而生,驅動AI生產力”。此舉順應AI向智能體演進趨勢,聚焦大模型與Agent前沿技術,依託通義千問模型和阿里雲技術,開啟AI內容與開發者服務全面升級。Jul 23, 2026183.6k價格砍至四十分之一!智譜開源原生多模態大模型GLM-5.
3-Flash智譜開源原生多模態模型GLM-5.3-Flash(320B-A18B),以領先性能和極致定價推動AI普惠。該模型測評獲57分,與Claude Opus4.8持平,編程能力相當,綜合性能超越GLM-5.2。發佈前以匿名“Ox-Alpha”公開測試,登頂OpenCode、OpenRouter平臺調用。Aug 27, 202698.3k京東“超腦”3.0大模型亮相,打造物流全流程AI指揮官京東在第十八屆國際交通展發佈“超腦”大模型3.0,系物流行業首個全流程AI指揮工業級應用集成體,在核心技術與供應鏈協同上實現突破,展現強大計算效率,推動大模型從概念走向產業落地。
Aug 27, 202669.3kAnthropic 豪擲 450 億美元租 Nscale 算力,2027 年底啟用 Vera Rubin 芯片Anthropic 與英國 AI 基礎設施公司 Nscale 達成約 450 億美元算力租用協議,資源來自其美國西弗吉尼亞州旗艦數據中心,預計 2027 年底開始供能,合作期 6 年。Nscale 成立僅兩年,已與微軟等合作,此次將基於英偉達最新 Vera Rubin 芯片系統供貨。Aug 27, 202672.1k智譜確認開發Ox Alpha,開源模型權重即將發佈並加入GLM系列智譜確認引發開發者關注的匿名模型Ox Alpha為其GLM系列最新版本。
該模型此前以“Stealth”身份上線OpenRouter,在多項基準測試中表現突出。智譜稱其定位編碼、持續智能工作與生產環境推理,將於週三開放權重,供開發者二次開發。Aug 27, 2026114.3k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

DeepSeek調價之後,誰走出了斬殺線?
象先志2026.08.27 11:34 · 來自安徽全文3862字00:00 / 10:05一次調價,重新劃定了大模型的競爭邊界文 | 象先志不久前,Artificial Analysis那張散點圖傳遍行業,DeepSeek V4 Flash以0.027美元的單任務成本劃出了一條“斬殺線”——全球將近70%能力不及它、價格卻比它貴的模型,集體落在了這條線以內。一個月後,DeepSeek自己開始重畫斬殺線。上週價格落地,DeepSeek V4 Flash高峰時段單任務成本從0.027美元升至0.

工業Agent不是“套殼”大模型!西門子百年經驗灌進工業AI
西門子推出工業AI智慧體Eigen Engineering Agent,能在真實工程系統中獨立完成端到端任務,執行效率較手動工作流提升2至5倍。同時透過西門子Xcelerator平台,以產品組合、開發生態與商業入口三層架構,整合工業軟體、自動化與夥伴生態,推動工業AI規模化落地。目前該平台已匯集900餘款產品、超過60萬註冊用戶與600餘家生態夥伴。

燒錢與營收並進,DeepSeek被曝前七個月收入4.75億元,Minimax連夜披露ARR暴漲500%
TechHorizon2026.08.27 10:08 · 來自北京全文1339字00:00 / 04:00這些大模型廠商都在為營收做準備,尤其是推動B端API業務實現健康毛利率。8月26日晚間,MiniMax披露了最新財務數據,截至今年8月,公司ARR(年度經常性收入)已經超過8億美元,半年暴漲500%。

“額度想重置就重置”,Codex負責人Tibo談OpenAI幕後:產品沒做好就補償、ChatGPT與Codex合併、暫停部分前沿模型RL訓練
CSDN·2026年08月27日 09:46“只要我認為時機合適,隨時都可以按下那個「重置」按鈕。” “只要我認為時機合適,隨時都可以按下那個「重置」按鈕。” “我不太關注競爭對手,我真正看重的是我們能獨特地做好什麼,我們的價值觀是什麼,以及我們如何最大限度地向這些目標加速。

GLM-5.3-Flash發佈,多模態終於來了
Leo張ToB雜談2026.08.27 08:40 · 來自北京全文3897字00:00 / 10:34GLM-5.3-Flash是GLM-5系列的首個原生多模態模型。不久前,在OpenCode和OpenRouter上進行了出現了一個名為Ox-Alpha(中文社區稱作牛來)的模型,並迅速成為當週最受歡迎的模型。

Edge AI Daily 早報(8月27日)
Edge AI Daily2026.08.27 08:28 · 來自北京全文6559字00:00 / 17:38當日核心情報涵蓋AI基礎範式動搖(嬰兒學習效率挑戰Scaling Law)、OpenAI企業級產品擴張(ChatGPT Work登錄憑證、Admin插件)、微軟AI圖片永久標記隱私爭議、LAION最大開源視頻數據集、亞馬遜關停MTurk、蘋果M5 Ultra芯片突破本地AI算力、Anthropic記憶合併默認開啟。