华为盘古2.0,全栈开源

华为盘古2.0,全栈开源
2026年09月28日 17:53 智东西

华为把盘古2.0训练代码开源了,基于昇腾集群。

作者 |  李水青

编辑 |  心缘

智东西9月28日报道,今日,华为宣布盘古大模型2.0开源版openPangu-2.0的预训练、SFT(监督微调)代码以及后训练RL(强化学习)代码正式开源上线。

开源地址:

https://gitcode.com/ascend-tribe

openPangu Training Framework是面向大规模基础模型训练的统一训练框架,支持大语言模型、视觉语言模型以及多模态模型的训练与开发。框架提供从大规模预训练、监督微调到模型持续优化的一体化训练能力,支持多维分布式并行、高效数据流水线、混合精度训练、自定义算子优化以及高可用训练等能力。

该仓库主要提供以下训练能力包括:预训练方面,支持基于大规模无监督语料从头训练基础模型,支持基于已有Checkpoint的持续训练,支持大规模分布式训练和长上下文训练。

监督微调方面,支持基于预训练模型进行指令对齐和能力增强,支持指令数据、多轮对话数据以及领域数据微调,支持参数高效微调和多任务训练。

openPangu-2.0-RL是面向华为昇腾的强化学习加速框架,以强化学习开源框架VERL为训练编排内核,通过运行时补丁与昇腾亲和优化,在昇腾集群上完成Actor(策略模型)/Rollout(样本生成)/Reward(奖励模型)协同训练。

面向openPangu的GSPO(组序列策略优化)/GRPO(组相对策略优化)后训练,典型使用场景包括数学推理的单轮Rollout,以及面向推理的代码生成的多轮Rollout(ReAct,推理行动框架)。

此前,6月12日,华为常务董事、终端BG董事长余承东在华为开发者大会首次对外发布openPangu-2.0,并在会上提出“做全世界最好的盘古大模型”。

而后6月30日,总参数92B、激活参数6B的openPangu-2.0-Flash开源;7月31日,总参数505B、激活参数18B的openPangu-2.0-Pro开源。

根据其技术报告,openPangu-2.0系列融合自研硬件内核、整机系统架构、训推一体化智能体强化学习算法,专门为长上下文智能体任务打造。同时,盘古模型重点针对昇腾算力进行了优化,昇腾原生训练的训练效率提升了30%。

AtomGit的数据显示,截至今日,本地离线模型openPangu-2.0-Pro在该托管平台上下载量为8834次,openPangu-2.0-Flash下载量达到22068次。

盘古大模型是华为打造“智能世界硅基黑土地”的重要战略分支。此前9月17日,在华为2026年全联接大会上,华为副董事长、轮值董事长汪涛宣布,华为AI战略的核心是算力,坚持硬件变现;构建开源开放的算力生态,支持主流大模型原生训练、积极拥抱“百模千态”;同时,将盘古大模型用于华为产品智能化,增强自身产品竞争力。

今日,华为进一步放出openPangu-2.0完整训练栈,是openPangu-2.0项目开源收官的关键一步。

海量资讯、精准解读,尽在新浪财经APP

VIP课程推荐

加载中...

APP专享直播

1/10

热门推荐

收起
新浪财经公众号
新浪财经公众号

24小时滚动播报最新的财经资讯和视频,更多粉丝福利扫描二维码关注(sinafinance)

股市直播

  • 图文直播间
  • 视频直播间

7X24小时

  • 10-09 通则康威 301718 --
  • 09-28 联亚药业 301569 7
  • 09-28 南方乳业 920196 14.21
  • 09-24 粤芯半导体 301660 12.01
  • 09-23 莫森泰克 920162 17.37
  • 新浪首页 语音播报 相关新闻 返回顶部