7月31日,华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重、基础推理代码及技术报告,进一步推进昇腾AI生态建设,为开发者和企业提供基于昇腾原生训练与推理技术的最佳实践。
据了解,openPangu-2.0-Pro是一款基于昇腾NPU训练的大规模混合专家(MoE)语言模型,总参数规模约505B(5050亿),每Token激活参数约18B,支持512K上下文长度,训练数据规模约34T Tokens。在后训练阶段,模型完成了快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线蒸馏(OPD)实现能力融合,进一步提升综合性能。
此次开源是华为openPangu2.0开源计划的重要组成部分。今年6月举行的HDC2026开发者大会上,华为常务董事、产品投资评审委员会主任、终端BG董事长余承东宣布,openPangu2.0将自6月30日起陆续开源7大组件,包括预训练代码、后训练代码和训练算子等核心能力。此前,92B参数的openPangu-2.0-Flash模型已于6月30日率先开源。
针对openPangu-2.0-Pro总参数规模为505B,余承东曾表示,华为将大量AI算力资源支持国内产业生态,自身可用算力相对有限,同时AI训练成本持续高企,因此华为更注重模型在时延、吞吐率等推理效率上的优化。随着openPangu2.0持续开放核心模型与训练能力,昇腾原生AI开发生态有望进一步完善,并为国产大模型研发提供更多开源参考。数智化转型网www.szhzxw.cn
Ascend Tribe开源社区:https://www.huaweicloud.com/product/modelarts/studio
若您对人工智能感兴趣或为人工智能创始人,可添加数智化转型网小助手思思微信加入人工智能交流群。若您在寻找人工智能供应商,可联系数智化转型网小助手思思(17757154048,微信同号)

若您为人工智能服务商,可添加数智化转型网小助手Jasper,加入人工智能行业交流群。

声明:本文来自数智化转型网,版权归作者所有。文章内容仅代表作者独立观点,不代表数智化转型网立场,转载目的在于传递更多信息。如有侵权,请联系我们。

本文由数智化转型网(www.szhzxw.cn)转载,编辑/翻译:数智化转型网(Professionalism Achieves Leadership 专业造就领导者)白龙
