9月22日举行的2026杭州云栖大会上,平头哥被完整推到主论坛台前。吴泳铭完成主旨演讲后,千问大模型、多模态模型负责人依次登场,随后是平头哥副总裁高慧,她的演讲题目为「Agentic 时代卓越算力基石」。当天发布的产品从真武V900芯片,延伸到ICN Switch互联芯片、磐脉智能网卡、镇岳SSD主控、倚天CPU路线图,以及面向算、存、网全栈协同的超节点服务器。

其中分量最重的是新一代训推一体AI芯片真武V900。它搭载216GB显存,片间互联带宽达到1200GB/s,单芯片性能是上一代真武M890的3倍,平头哥称其是目前中国算力性能最强的AI芯片。精度方面,该芯片原生支持FP8和FP4,可覆盖高精度训练以及低精度、超低精度推理。按公布的计划,V900将于2027年第一季度量产销售,2028年第三季度推出真武J900。此前,真武M890于2026年5月首次亮相,拥有144GB显存和800GB/s片间互联带宽,性能达到上一代810E的3倍,支持从FP32到FP4的多种精度。2024年的真武810E则已从单一推理芯片走向训推一体,采用自研并行计算架构和互联技术,并配套SAIL软件栈。
产品迭代的背后是负载结构的变化。模型进入万亿参数规模后,MoE几乎成为默认架构,它把模型拆成大量专家,每个Token只调用其中一部分,在扩大模型容量的同时压低单次实际参与计算的参数量。即便如此,硬件压力仍被推向算力、显存和通信三个方向。单颗V900拥有216GB显存,10多张即可部署一个万亿规模的大模型。据悉,基于真武M890的超节点已大规模应用,并跑通了Qwen3.8、Kimi K3等超2万亿参数规模模型。
模型被拆到几十甚至上百张芯片上之后,推理就变成计算与数据交换不断交替的过程,芯片之间的通信速度直接影响整个模型能跑多快。这也是平头哥近些年持续投入互联能力的原因。








