首个采用NPO的昇腾960超节点来了!华为新款AI芯片将提前推出

信息来自 财联社 | 科技创新 | 2026-09-17 13:31:07

《科创板日报》还从会上获悉,截至目前,鲲鹏全球开发者超过了416万,全球生态合作伙伴超过7200家,支持了560多个全球开源项目,openEuler装机量也已超过2000万套,成为中国服务器操作系统第一份额。CANN社区月活开发者突破5200名,基于昇腾+CANN的原生训练模型已超过40个,也是国内唯一支持预训练的技术路线。

华为副董事长、轮值董事长汪涛表示,AI变革的速度超过历史上任何一次技术革命。今天大模型参数已经快速迈向10万亿,到2030年将达到100万亿以上;智能体已经可以按小时级连续工作,到2030年将以月为单位执行任务;中国每日推理Token已增长到每日500万亿左右,到2030年将达到百万万亿级。端侧智能也在快速增强,手机模型从2024年的3B发展到今天的30B,未来将进一步走向100B级。这些变化,都对AI基础设施的规模、性能和可靠性提出了更高的要求,只有打造更加强大的AI基础设施,才能筑牢智能世界的坚实底座。

截至目前,昇腾910C超节点已部署超1000套,昇腾950超节点也已规模商用。超节点是一种在物理上由多个计算节点通过高效的互联协议紧密连接组成,具备跨物理节点统一内存编址能力,逻辑上具备“一台计算机”特征的计算系统。

汪涛表示,超节点已成为建设超大规模AI基础设施的必然选择。当前,10万卡集群已成为训练十万亿级SOTA模型的标配,但传统服务器架构导致集群内通信超过训练时间的40%,严重制约了MFU(模型浮点算力利用率)。根据华为马尔科夫实验室仿真结果显示,4K超节点组成的10万卡集群相比由8卡服务器组成的10万卡集群MFU提升了2.75倍。

超节点的设计理念是通过互联实现多NPU的协同。华为研发了新一代NPO(Near-Packaged Optics)形态的光互联产品——Hi-ONE,基于华为自主创新技术,通过光、机、电、磁、热等要素的均衡设计,实现了单引擎7.2T的传输容量。这是业界首个量产的NPO产品,是行业目前最大传输能力的NPO产品,也是唯一实现内置光源的NPO产品。

随着SOTA模型的参数规模达到10T级,其训练、推理系统不再是单一的AI服务器或单一的智算超节点,而是一个复杂的算力系统。该系统包括智算超节点、通算超节点、一套平等互联且免协议转换的互联系统,在推理系统中还需要部署PB级的KV缓存集群。

据悉,鲲鹏超节点进行了升级。基于灵衢全光组网,鲲鹏超节点最大支持4096节点,并形成256TB的统一内存池。

免责声明:本文信息来自 财联社 平台,仅供参考。如有侵权,请及时联系我们删除。

评论交流

0
支持回复和点赞