孤本网
发布于 2026-09-19 / 2 阅读
0
0

华为汪涛:华为要打造AI算力底座,只做好一颗芯片远远不够

在华为全联接大会期间,华为轮值董事长汪涛接受专访,介绍了昇腾AI芯片与超节点集群的进展和规划。他表示,华为要打造AI算力底座,只做好一颗芯片远远不够,只做一台服务器也不够,最终要交付一个高可用度的复杂系统。

芯片方面,汪涛透露,昇腾960DT研发进度比原计划提前三个季度,单芯片算力倍增。昇腾960DT支持2 PFLOPS FP8、4 PFLOPS FP4,HBM容量最高288GB,带宽9.6TB/s。昇腾960超节点支持4096张NPU卡,最高8 EFLOPS FP8算力,HBM容量超过1PB。

按照规划,华为后续将推出昇腾970、昇腾980,未来几年保持一年一代。汪涛称,从今年开始,950、960、970、980将连续几代一年一代快速演进,待国内半导体制造、封装的上下游配套全部打通后实现。他提到,960已在实验室测试了几个月。芯片从立项到产品化往往需要三年,任何发布都应在产品于实验室反复测试、并有准确交付时间之后进行。

在规模算力方面,华为已从昇腾910C的384卡,发展到昇腾950的1024卡,再到昇腾960的4096卡。超节点实现跨物理节点统一内存编址,多NPU互联更接近一台逻辑计算机。仿真训练数据显示,在同样十万卡集群下,由4096卡超节点组成的集群相对传统八卡服务器组成的集群,MFU可提升2.75倍。MFU衡量大模型真正吃到多少理论算力,集群越大,通信、同步、故障越容易吃掉峰值性能。

汪涛强调,AI基础设施已进入系统工程阶段。华为的核心优势在于,大规模超节点涉及芯片、通信、IP网络、光互联、供电、散热、软件和故障管理。他判断:“要做好这么大的超节点集群,需要通信技术、IP、光模块、算力、系统,华为干了

来源:量子位


评论