6月30日,华为正式宣布开源盘古70亿参数的稠密模型、盘古Pro MoE 720亿参数的混合专家模型和基于昇腾的模型推理技术。这是华为首次将盘古大模型的核心能力对外开源。

此举是华为践行昇腾生态战略的又一关键举措,将推动大模型技术的研究与创新发展,加速推进人工智能在千行百业的应用与价值创造。
华为表示,720亿参数的盘古Pro MoE模型在昇腾800I A2上实现单卡1148 tokens/s的推理吞吐性能,通过投机加速技术可进一步提升至1528 tokens/s,显著优于同等规模的稠密模型。

据了解,盘古Pro MoE 72B模型权重、基础推理代码,已正式上线开源平台。基于昇腾的超大规模MoE模型推理代码,已正式上线开源平台。盘古7B相关模型权重与推理代码将于近期上线开源平台。
此次开源正值国产大模型开源浪潮兴起之际。继DeepSeek-R1成功后,MiniMax、阿里巴巴、月之暗面等头部厂商陆续升级开源模型,推动大模型价格下探60%-80%,加速应用普及。
近日,华为正式宣布开源盘古70亿参数的稠密模型、盘古Pro MoE 720亿参数的混合专家模型和基于昇腾的模型推理技术。其中,盘古Pro MoE 720亿参数的混合专家模型权重、基础推理代码,基于昇腾的超大规模混合专家模型推理代码已正式上线开源平台,盘古70亿参数相关模型权重与推理代码也将于近期上线开源平台。
【专刊订阅】
首发专享,限时免费!《SiC》电子专刊第二期上线!立即扫码订阅:https://www.sbs-mag.com/subscribe_active.html?invitation_code=active&name=CSC