華為開源5050億參數openPangu-2.0-Pro模型,權重與推理代碼同步開放
重點摘要
華為於7月31日正式開源openPangu-2.0-Pro大模型,總參數規模約5050億,並同步開放模型權重、推理代碼及技術報告。該模型為基於昇騰NPU訓練的MoE架構,支援512K上下文,並透過監督微調、強化學習與在線蒸餾提升效能。此次開源屬於openPangu2.0計畫,先前已開源92B的Flash模型,旨在完善昇騰原生AI生態。
華為7月31日正式宣布,旗下盤古AI模型品牌openPangu的旗艦級模型openPangu-2.0-Pro正式開源,同步開放模型權重、基礎推理代碼以及完整技術報告。此舉不僅是openPangu 2.0開源計劃中的關鍵一步,更被視為華為推進昇騰AI生態建設的重要里程碑,為開發者與企業提供一套基於昇騰原生訓練與推理技術的完整實踐範例。openPangu-2.0-Pro是一款完全基於昇騰NPU訓練的大規模混合專家(MoE)語言模型。
就規模而言,其總參數達到約505B,也就是5050億個參數,但得益於MoE架構的設計,每一Token實際激活的參數僅約18B,在維持強大模型能力的同時,也兼顧了推理階段的運算效率。此外,該模型支援長達512K的上下文長度,能夠處理更為龐大的資訊量;在訓練數據方面,則使用了約34T Tokens的大規模語料進行預訓練。在後訓練階段,openPangu-2.0-Pro的優化流程相當完整。團隊完成了快慢合一監督微調(SFT),並導入多專項強化學習(RL)機制,讓模型在特定任務上的表現更加精準。更進一步地,華為還透過在線蒸餾(OPD)技術,將不同能力來源進行有效融合,使模型在綜合性能上獲得顯著提升。
這些技術細節也一併收錄於本次開放的技術報告中,供外界研究與參考。這次開源行動是華為openPangu 2.0開源計劃的重要組成部分。回顧今年6月舉行的HDC 2026開發者大會,華為常務董事、產品投資評審委員會主任、終端BG董事長余承東親自宣布,自6月30日起,openPangu 2.0將分階段陸續釋出7大核心組件,涵蓋預訓練代碼、後訓練代碼、訓練算子等關鍵能力。在此之前,參數規模達92B的openPangu-2.0-Flash模型已經率先於6月30日開源,如今隨著Pro版本的接力開放,整體開源藍圖正一步步落實。針對openPangu-2.
0-Pro總參數規模高達505B的設計選擇,余承東先前曾對外說明,華為將大量AI算力資源投入支持國內產業生態的發展,自身可用的算力相對有限,加上當前AI訓練成本持續居高不下,因此華為在模型設計上投入更多心力於推理效率的優化,特別是在時延與吞吐率等關鍵指標上力求更好的表現,讓模型在實際應用場景中更具成本效益與落地可行性。分析認為,隨著openPangu 2.0持續開放核心模型與訓練能力,昇騰原生的AI開發生態有望進一步完善。
對國內大模型研發社群而言,這套具備完整實作細節的開源資源,提供了從訓練到推理端到端的參考基準,有助於降低企業投入大模型開發的門檻,也為國產大模型的技術演進提供更多元的開源養分。華為官方也同步揭露了Ascend Tribe開源社區的相關資訊,作為開發者交流與資源取得的集中入口,進一步串聯使用者與生態系之間的連結。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。