7月31日,華爲正式開源盤古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步開放模型權重、基礎推理代碼及技術報告,進一步推進昇騰AI生態建設,爲開發者和企業提供基於昇騰原生訓練與推理技術的最佳實踐。
據瞭解,openPangu-2.0-Pro是一款基於昇騰NPU訓練的大規模混合專家(MoE)語言模型,總參數規模約505B(5050億),每Token激活參數約18B,支持512K上下文長度,訓練數據規模約34T Tokens。在後訓練階段,模型完成了快慢合一監督微調(SFT)、多專項強化學習(RL),並通過在線蒸餾(OPD)實現能力融合,進一步提升綜合性能。

此次開源是華爲openPangu2.0開源計劃的重要組成部分。今年6月舉行的HDC2026開發者大會上,華爲常務董事、產品投資評審委員會主任、終端BG董事長餘承東宣佈,openPangu2.0將自6月30日起陸續開源7大組件,包括預訓練代碼、後訓練代碼和訓練算子等核心能力。此前,92B參數的openPangu-2.0-Flash模型已於6月30日率先開源。
針對openPangu-2.0-Pro總參數規模爲505B,餘承東曾表示,華爲將大量AI算力資源支持國內產業生態,自身可用算力相對有限,同時AI訓練成本持續高企,因此華爲更注重模型在時延、吞吐率等推理效率上的優化。隨着openPangu2.0持續開放核心模型與訓練能力,昇騰原生AI開發生態有望進一步完善,併爲國產大模型研發提供更多開源參考。
Ascend Tribe開源社區:https://www.huaweicloud.com/product/modelarts/studio
