AI 【新芒xAI】华为发布4096卡昇腾960超节点,大模型团队获得面向十万亿参数的国产算力底座

【新芒xAI】华为发布4096卡昇腾960超节点,大模型团队获得面向十万亿参数的国产算力底座

新芒xAI 9月20日消息,华为在华为全联接大会2026上发布昇腾960超节点,单个系统可扩展至4096张算力卡,采用近封装光学(NPO)光引擎、正交架构与全液冷设计,面向十万亿参数规模模型的训练和推理。

关键要点

华为披露,昇腾960超节点基于灵衢实现内存统一编址,可提供8 EFLOPS FP8和16 EFLOPS FP4算力。系统使用5500个Hi-ONE光引擎,替代传统方案所需的4.8万颗800G光模块,官方称可降低超过550千瓦功耗。

Hi-ONE单引擎总容量为7.2T,采用内置光源。华为还称系统无故障运行时间较上一代提升一倍,可用度达到99.8%。以上性能、能耗与可靠性数据均为厂商发布口径,仍需在不同模型和真实集群负载下验证。

多个昇腾960超节点可通过灵衢网络或RoCE组成更大集群。华为同时推进CANN常态化开源社区运营,以改善模型适配与开发工具生态。

新芒xAI评论

对大模型团队而言,4096卡规模的价值不只在卡数量,而在于通信、内存与故障管理能否把算力转化为有效训练时间。超大模型训练中,单点故障和跨节点通信开销会直接影响成本与交付周期。

对国产算力生态而言,NPO和统一编址试图从系统层面弥补单芯片差距。但客户仍需关注模型迁移成本、算子覆盖、工具成熟度、供应能力和长期运维,而不能只根据峰值算力指标采购。

这次发布为大型训练和推理提供了新的基础设施选择,真正的竞争力将由可持续利用率决定。后续应观察第三方实测、规模部署案例、能耗成本和主流模型原生适配情况。

文章来源信息声明: 本文信息出自权威媒体、企业官方及网络,并经新芒X编辑,转载请注明源出处、作者和链接。 图片部分来源于网络,在此表示感谢,如有侵权请联系我方处理。 文章发布日期后方火形图标后的数字,为文章热度,谨代表受欢迎程度。 新芒X平台仅对用户提供信息及决策参考,本文不构成投资建议。

作者: 新芒Group

新芒出品,专注专业。兼具内容品质和传播影响力
关注微信
微信扫一扫关注我们

微信扫一扫关注我们

关注微博
返回顶部