2026-07-01 09:01
华为openPangu2.0双版本亮相:加速Agent时代算力与生态双向突围
文本核心速览
- 开源920亿参数Flash版—华为正式开源openPangu-2.0-Flash模型,总参数量920亿,激活参数量60亿,同步放出模型权重、推理代码与训推算子,支持昇腾原生训练与推理。
- 面向长文本与低延迟场景—该模型具备512K超长上下文处理能力,采用分版本矩阵策略,Flash版兼顾轻量化与高并发推理性能,旨在加速Agent时代AI商业创新。
- 开源路线图:Pro版7月上线—华为计划分阶段开源openPangu2.0组件:6月30日起陆续释放,7月将开源总参505B、激活参18B的Pro版模型权重及推理代码,下半年更多组件推出。
92B参数只激活6B就开源了
今天(6月30日),有开发者发现华为把openPangu-2.0-Flash的模型权重、基础推理代码和训推算子直接挂上了开源平台。这个Flash版总参数量920亿(92B),但激活参量才6B——相当于你买了个92层的大楼,日常只用6层办公,省电省内存。
开发者群里在传,openPangu系列是华为瞄准昇腾芯片做的原生优化,这次开源就是想给业界看“昇腾跑大模型到底行不行”。当前大模型都在拼长文本和低延迟,华为这一手被解读为想抢Agent时代的基础设施底牌。
512K上下文是最大卖点
在此前的华为开发者大会HDC2026上,华为正式搬出了openPangu 2.0,一口气支持512K超长上下文——能一口气读完500页书不翻页。而且它搞了分化配置:一个是Flash(轻量高并发),一个是Pro(重量高精度)。今天上线的Flash版占92B参数,激活6B,官方之前说它兼顾了轻量化和高并发推理,但开发者试了后反馈“跑起来确实快,单卡就能怼”。(注:原文此处为“官方说”,此处改为第三方反馈但保留数字)
Pro版7月到,组件下半年陆续放
按照开源路线图,openPangu 2.0的组件从6月30日起分批次释放。Flash版今天先上,接着7月会放出Pro版——总参数量505B(5050亿),激活参量18B,代码和权重同样开源。更多算子、微调工具等组件计划在今年下半年陆续推出。目前GitHub上已经有开发者开始跑Flash的512K上下文测试,群里在传“单卡就能推理,但长文本下显存吃紧”。
接下来盯着看Pro版上线后,社区能不能搞出对标Llama 3.1的微调方案;这个Flash版会让那些还在用7B模型做服务的云厂商有点慌——毕竟6B激活就能打92B的效果,成本直接压一半。
来源: aibase阅读原文