
6月12号下午,东莞。
华为开发者大会HDC 2026的现场,灯光暗下来,一个熟悉的身影走上台。余承东,穿着那件万年不变的深色西装,手里没有拿手机,也没有拿汽车钥匙。
他开口第一句话,全场就炸了。
在我余承东的字典里,没有第二,只有第一。
台下有人鼓掌,有人吹口哨,还有人举着手机录像。这不是发布会,这更像是一场宣战。而宣战的对象,是整个AI大模型江湖。

image
余承东没有上来就吹参数,他先讲了一个很多人不知道的故事。
2021年4月,全中国、全世界都不知道大模型为何物的时候,华为就发布了盘古大模型。那时候OpenAI的GPT-3刚火不久,国内连大模型这个词都还没普及。华为是这个行业绝对的全球先驱者。
他说这话的时候,语气里带着骄傲,但紧接着话锋一转。
后来因为各种各样的原因,没做好,不应该。
全场安静了几秒。
这是余承东的风格,先把自己放到最低,然后再往上爬。他接着说,去年国庆节前夕,公司又让他来负责大模型。注意这个又字,说明他之前管过,后来不管了,现在又被叫回来救火。

image
从2025年9月底接手,到今天站在台上,整整九个月。
openPangu 2.0,这就是余承东交出的第一份成绩单。
两个版本,Pro和Flash。Pro总参数量505B,激活参数量18B。Flash总参数量92B,激活参数量6B。两个版本都支持512K上下文窗口,用的是MoE混合专家架构。
512K上下文是什么概念,一次性可以把整本《三体》扔进去,AI不会忘,还能精准找到某一个细节。以前你让AI分析长篇小说,它得一章一章地嚼,嚼完前面忘了后面。现在不用了,整本书一口吞。

openPangu 2.0架构图
但参数只是表面,真正让业内人士坐直身体的,是另外两件事。
第一件事,这个模型完全基于华为昇腾NPU训练,没有使用任何NVIDIA的GPU。AIMadeTools在报道里直接用了这样一个标题,Huawei's 505B Model Trained Without NVIDIA。文章里说,你用过的一切前沿模型,DeepSeek、Qwen、Kimi、GPT-5、Claude,全部跑在NVIDIA上。openPangu 2.0是第一个在这个规模上完全脱离NVIDIA生态的模型。
这不是技术问题,这是地缘政治问题。
第二件事,单卡推理吞吐率是业界主流开源模型的2倍。同样的服务器,华为能处理两倍的请求,成本直接砍半。这是昇腾算力的亲爹加成,别的厂商学不来。

image
PANews在6月12日的英文报道里写得很直接,华为发布了开源大模型Pangu 2.0,最高505B参数、512K上下文。没有夸张,没有渲染,就是陈述事实。
AIMadeTools的文章更有意思,作者说openPangu 2.0改变了关于NVIDIA生态系统之外可能性的对话。对于在NVIDIA供应受限地区运营的开发者,或者正在建设主权AI基础设施的人来说,现在有了一个前沿模型,证明了替代硬件路径是可行的。
China Digital Trends的报道则聚焦在余承东的目标上,从中国第一走向世界第一。
但说实话,X和Reddit上的讨论并不多。这个话题主要在中国国内媒体和科技圈发酵,国外社交媒体上的英文讨论相对有限。原因也很简单,华为被制裁这么多年,国外普通用户对华为的关注度已经大不如前。但在专业的AI开发者圈子里,这件事的分量很重。
有人可能会问,美国厂商都发布万亿、几十万亿参数的大模型了,华为为什么只做505B。
余承东在台上自己解释了这个问题,而且解释得很坦诚。
算力大量支持了国内其他企业的需求,华为自己留的算力非常有限。AI算力成本非常高,华为更聚焦时延和吞吐率的提升。
翻译一下就是,卡不够,但华为不把卡不够当借口,而是把有限的资源用在刀刃上。与其堆参数做花架子,不如把模型的效率做到极致。
这种思路其实很华为。当年做手机芯片,麒麟也是这么过来的。一开始性能不如高通,但华为把软硬协同做到极致,最后硬是在高端市场杀出了一条血路。

image
6月30日起,openPangu 2.0将分批开源7大核心组件,包括预训练代码、后训练代码、训练算子。
这意味着什么,以前华为是自己造车自己开,现在把发动机图纸公开,让全中国的开发者、企业都来基于盘古造自己的车。
当所有人都用你的标准、你的底座时,你就是标准。
余承东说这是带领团队一路赶超,但在业内人士看来,他这分明是要重新定义大模型的游戏规则。开源许可证允许商业用途、免版税、非独占,基本上就是MIT的精神,但用的是华为自己的许可证。

image
openPangu 2.0不只是云端的大模型,它还要跑进你的手机里。
年底,华为将在麒麟芯片上支持端侧30B模型。30B参数跑在手机芯片上,通过量化剪枝优化,推理速度提升50%,内存占用减少20%。
配合鸿蒙智能体框架2.0,小艺这个语音助手彻底变了。以前你说帮我订个餐厅,它可能只会帮你打开美团。现在它能直接理解你的意图,你想吃川菜、要安静的位置、预算人均200,它能自己操作APP去筛选、下单、甚至在地图上标记好路线。
小艺支持的系统能力有2100多个,能调用的鸿蒙智能体也有2000多个。鸿蒙不再只是一个操作系统,而是一个拥有超级大脑的智能生命体。
有人说余承东只会喊口号。
但你看他的履历,把手机从贴牌做到高端第一,把问界从零干到销冠。他吹过的牛,全都超额兑现了。
今天,面对AI这场决定未来的战役,余承东那句只做第一,不是狂妄,而是宣战。
他在台上甚至现场发布招聘广告,号召全世界AI领域优秀年轻人加入盘古大模型战队,做全世界最好的盘古大模型。他说大模型是年轻人的天下,今天中国有非常多的优秀AI人才,做AI,华为有着强大的系统工程能力。
余承东自己也承认,在大模型领域走向世界第一的挑战很大。去追赶、去超越都需要时间。在AI领域,算法、算力、数据三样缺一不可。
505B参数,在国际前沿模型里不算最大。DeepSeek V4 Pro已经做到1.6T总参数,200B激活参数。GPT-5、Gemini 2.5 Pro、Claude 4这些闭源模型的能力边界,目前还是行业标杆。
中文理解方面,盘古在CLUE榜单上的成绩是89.1%,而文心一言92.3%、通义千问91.7%、GLM-4 90.2%,盘古还有差距。数学推理GSM8K上,盘古72.6%,DeepSeek-V2 91.3%,差距更明显。
千tokens成本,盘古约0.0015元,通义千问约0.0005元,豆包约0.0006元,成本上盘古也没有优势。
所以盘古的核心竞争力到底是什么,不是参数最大,不是成本最低,而是全栈自主可控。从昇腾芯片到MindSpore框架,从盘古模型到鸿蒙系统,华为实现了端到端的自主可控。这在当前的地缘政治环境下,本身就是最大的护城河。

image
九个月,从接手到发布openPangu 2.0,余承东的速度很快。
但大模型这场仗,不是九个月就能打完的。它需要持续的算力投入、人才积累、数据迭代。华为的优势是工程能力强、执行力强、全栈自主。劣势是算力受限、国际生态薄弱、品牌认知在海外市场下滑。
余承东在台上说,过去所有业务,他领导的,都实现了目标,行业第一。
这一次,他面对的是OpenAI、Google、Anthropic这些全球顶级的AI公司。对手更强,战场更大,变量更多。
但不管怎样,那个熟悉的余承东回来了。带着他的大嘴,他的野心,和他那句让人又爱又恨的遥遥领先。
这一次,他要在AI赛道,彻底拿回属于自己的位置。