7月31日,华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重、基础推理代码及技术报告,进一步推进昇腾AI生态建设,为开发者和企业提供基于昇腾原生训练与推理技术的最佳实践。
据了解,openPangu-2.0-Pro是一款基于昇腾NPU训练的大规模混合专家(MoE)语言模型,总参数规模约505B(5050亿),每Token激活参数约18B,支持512K上下文长度,训练数据规模约34T Tokens。在后训练阶段,模型完成了快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,进一步提升综合性能。

此次开源是华为openPangu2.0开源计划的重要组成部分。今年6月举行的HDC2026开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东宣布,openPangu2.0将自6月30日起陆续开源7大组件,包括预训练代码、后训练代码和训练算子等核心能力。此前,92B参数的openPangu-2.0-Flash模型已于6月30日率先开源。
针对openPangu-2.0-Pro总参数规模为505B,余承东曾表示,华为将大量AI算力资源支持国内产业生态,自身可用算力相对有限,同时AI训练成本持续高企,因此华为更注重模型在时延、吞吐率等推理效率上的优化。随着openPangu2.0持续开放核心模型与训练能力,昇腾原生AI开发生态有望进一步完善,并为国产大模型研发提供更多开源参考。
Ascend Tribe开源社区:https://www.huaweicloud.com/product/modelarts/studio
.png)
发评论,每天都得现金奖励!超多礼品等你来拿
登录 在评论区留言并审核通过后,即可获得现金奖励,奖励规则可见: 查看奖励规则