
华为AI DC创新峰会发布昇腾960超节点与12.8万卡超节点集群:NPO光互联+液冷重构Agentic时代算力底座,极简组网降低30%总体拥有成本
华为全联接大会2026期间AI DC创新峰会披露:新一代昇腾960液冷智算超节点网络带宽提升4倍、内存容量提升11倍;12.8万卡集群极简组网TCO降30%;KV Cache多级缓存命中率超90%,Token Centric Fabric网络同步发布。
【新闻原文】
9月17日至18日,华为全联接大会2026在上海举办。大会期间的AI DC创新峰会2026上,华为副总裁、ICT产品组合管理与解决方案部总裁马海旭系统阐述了Agentic时代数据中心向AI DC演进的技术路径,并推出多项面向智算场景的基础设施解决方案。马海旭表示,随着Agentic时代到来,数据中心正加速向AI DC转型,大功率、高密度成为行业发展特征,AI DC正从数据中心设施、算力基础设施、数据和应用三个层面发生重构:机房设施向液冷散热、高压直流供电、3D数据中心演进;硬件基础设施以智算超节点、分级存储、高带宽低时延网络为关键;AI应用则逐步转向以Agent为核心的模式。
方案层面,华为基于灵衢架构推出新一代昇腾960液冷智算超节点,面向万亿级大模型提供算力支撑,具备异构算力、分级存储、光电互联等能力,对比上一代产品网络带宽提升4倍、RTT时延下降三分之一、内存容量提升11倍。在大规模集群层面,华为推出规模高达12.8万卡的超节点集群,采用极简组网设计,可降低30%总体拥有成本(TCO),依托智能化故障处理技术实现分钟级故障定位与业务恢复。针对长上下文推理场景,华为公布KV Cache多级缓存方案,搭建PB级共享缓存资源池,缓存命中率超过90%,并通过NPU直连SSD降低访问时延。面向Agent推理业务,鲲鹏950超节点搭配AI高性能存储,可将海量Agent沙箱启动时间大幅压缩,支撑万级Agent并发运行。网络方面,华为发布Token Centric Fabric超宽无损数据中心网络与全光无损DCI网络,实现跨地域算力调用。另据中国经济新闻网报道,华为轮值董事长汪涛在大会主题演讲中正式发布全球首个采用NPO(近封装光学)技术的超节点,其Hi-ONE光引擎总传输容量达7.2T,为业界目前最大传输能力的NPO产品。(综合新华网、中关村在线、中国经济新闻网报道)
【企服观察】
华为这次在AI DC创新峰会上拿出的,不是又一次"参数发布会",而是一套面向Agentic时代的完整数据中心重构路线图。对于每天在选型、采购、部署之间权衡的IT企服从业者来说,这份路线图里有三个信号值得认真消化。
第一个信号是超节点从"性能叙事"正式进入"财务叙事"。12.8万卡超节点集群最引人注目的数字不是算力峰值,而是"降低30% TCO"——总体拥有成本恰恰是企业客户招标书上真正会算、会审、会上会的指标。过去国产算力的宣传逻辑停留在"每秒多少TFLOPS",而华为这次把话语体系切换到了"每块钱能换来多少有效算力",这说明国产算力供给侧已经开始按甲方财务口径设计产品。对企服采购方而言,这意味着评估国产算力方案时,除了性能对标,更应该把TCO模型拆开细算:电力、散热、机房改造、运维人力、故障恢复损失,都是过去被低估的科目。液冷、高压直流供电这些"机房设施"层面的演进方向,反过来也在提醒企业:未来两三年若计划自建或扩容智算资源,机房设计必须前置考虑液冷管路与供电冗余,否则后端再强的算力也会被基础设施卡住脖子。
第二个信号是网络层价值口径的切换。Token Centric Fabric这个名字本身就值得单独记录——数据中心网络的设计目标从"多少T带宽"转向"每秒产出多少有效词元"。这个口径变化会重排整条供应链的竞争维度:交换机、光模块、DCI设备的采购决策依据将随之改变。对企业IT部门来说,未来评估智算网络方案时,应当要求供应商提供Token吞吐视角的实测数据,而不是只看端口带宽规格书。NPO近封装光引擎的引入同样值得关注,7.2T传输容量、以5500个光引擎替代4.8万颗800G光模块、功耗降低超550千瓦——这组数字背后的本质是用系统级创新压缩单位算力的能耗与故障面。能耗成本在中长期会逐步成为算力定价的主导变量,提前锁定绿色电力与高效散热资源的企业,将在下一轮算力成本竞争中获得结构性优势。
第三个信号是"记忆"正在从单机资源升级为集群基础设施。KV Cache多级缓存方案把PB级共享缓存资源池做成了可调度的公共设施,缓存命中率超90%,NPU直连SSD把访问时延压缩了一个数量级。这对长上下文推理业务意义重大:当模型的上下文窗口普遍迈向百万Token级,KV缓存的存储与调度效率直接决定推理成本曲线。企服服务商如果做Agent类产品,应该重新评估自己的推理架构——把记忆放在单机显存里的老方案,在集群级缓存池面前会显得既贵又慢。
当然也要保持清醒:30% TCO节省、90%命中率、分钟级故障恢复等数字目前均为华为单方口径,缺少第三方实测与真实合同金额的公开披露;ES3000系列SSD、SP560网卡、Atlas加速卡等新品的量产规模与外部客户名单尚未公布。发布会与订单落地之间,历来隔着一段需要用交付来填的距离。理性的做法是把它当作国产算力全栈成熟度的又一里程碑,同时在真实POC里验证每一个关键指标。对企业而言,多供应商策略仍是眼下最稳妥的算力治理结构:昇腾生态的进展越快,谈判桌上的话语权就越大,这一点无论对云厂商还是对最终企业客户都成立。







评论
请评价真实、客观、有价值的内容请回复有价值的信息,无意义的评论将很快被删除,账号将被禁止发言。