2026-09-18 18:29:23 中华网

9月18日,上海,在华为全联接大会2026上,是华为计算模组的元年,今天重磅发布800GE AI网卡与支持灵衢协议的KVU两款自主创新产品。面向大模型参数跃升至10万亿级、上下文扩展至百万级的Agentic AI时代,刘云强讲到“我们带来了全新的AI网卡和AI SSD产品,迎接AI时代的变化,重构智算底座,让GPU/NPU少搬运,多计算,打通网络和存储,赋能AI算力全速增长。华为以网络与存储协同创新,为智算基础设施构筑极致性能底座。

算力越强,网络越关键。随着训练集群通信占比持续攀升,网络加速从400GE向800GE端口升级。作为超节点Scale-out组网的关键能力,华为800GE AI网卡支持10万级节点互联,通过集合通信卸载、GPU Direct RDMA降时延及400GE大带宽,全面加速AI训练与推理场景。产品基于NP架构实现数控分离,数据免CPU拷贝,AI训练端到端性能提升10%;GPU 直驱支持集合通信组粒度下发报文,通信消息完成时间降低20%以上。依托可编程NP架构,支持 RDMA/TCP协议扩展编程与可编程拥塞算法,护航无损向容损RDMA、逐流向逐包多路径演进。并支持安全启动、国密算法与固件热升级,供应连续可靠。

针对 "存储墙" 制约GPU利用率的行业痛点,华为同步推出支持灵衢协议的KVU计算模组 ——KV Cache的 "最佳搭档",推动 KV Cache从HBM向DDR/SSD下沉,以 "以存代算" 降本增效。KVU集成CPU算力与SSD存储,40GB/s超宽顺序读速率领先业界1.8倍,服务器写时延低至10μs,"像读内存一样读SSD"。KVU Prefix KV-Cache分级缓存解决方案,让首Token时延降低50%,提升NPU吞吐率使得Token成本降低30%。
华为计算模组秉持开放开源理念,全面支持ARM/x86多架构,兼容openEuler、Ubuntu等主流OS,面向合作伙伴与客户输出高可靠硬件与全链路技术支持,网卡、SSD、DPU、RAID卡全系列覆盖通算、智算全场景。两大新品将以 "以网强算、以存代算" 的硬核实力,为Agentic AI时代规模化落地提供自主创新的算力支撑。