9月28日,华为宣布开源盘古 openPangu-2.0 的预训练、SFT 代码和后训练 RL 代码,正式开源上线。
这次放出的不是模型权重,而是训练流程里的三段核心代码:预训练、SFT(监督微调)、后训练 RL(强化学习)。对想自己跑一遍大模型训练的人来说,这三段基本覆盖了从底座到对齐的完整链路。
打开网易新闻 查看精彩图片
开源的是哪一部分
开源盘古 openPangu 是华为的开源 AI 模型品牌,定位是通过昇腾原生训练与推理技术,为业界用好昇腾提供最佳实践参考。
openPangu-2.0 模型相关组件已陆续上线开源平台。
为什么值得看一眼
预训练、SFT、RL 三段代码同时开源,意味着这套流程不是只给你一个结果,而是把怎么训出来的路径也摆了出来。配合昇腾原生训练与推理的定位,这套代码更像是给昇腾生态的一份操作参考。
热门跟贴