首页 > 技术

鲲鹏超节点重磅升级,风冷、液冷双旗舰全新亮相

2026-09-19 11:06:17      中华网   


  [中国,上海,2026年9月17日]华为全联接大会2026在上海举行,鲲鹏超节点全新升级,最大支持4096节点组网,依托灵衢互联构建百TB级内存池,沿着更高性能,更大规模,更安全持续演进,打造Agentic基础设施新架构。

鲲鹏超节点风冷、液冷双旗舰全新亮相

  进入Agentic AI时代,算力架构迎来变革,过去以智算为中心,走向通算与智算协同的全新范式,Agentic AI大量依靠CPU完成编排调度、记忆处理、沙箱运行等工作,新增负载对当前架构带来了新的挑战。为应对这些挑战,鲲鹏突破根技术,基于芯、硬、软打造领先、开放和安全的智能体底座。

  2025年我们发布了全球首个通算超节点,具备三大核心技术优势:内存统一编址、超大带宽和超低时延。今年,鲲鹏超节点迎来全新升级,依托灵衢互联设备实现双层CLOS组网,最大可支持4096节点,依托灵衢大带宽可构建百TB级全内存池,实现八大价值场景性能跃升。

  鲲鹏超节点已广泛运用在生成式广告推荐、证券低时延、Agent沙箱等多个场景。生成式推荐场景,依托灵衢互联加速RPC通信、通过内存池化构建百 TB级全内存KV Cache,实现在线推荐端到端时延降低15%;生成式推荐,灵衢加速RPC通信、全内存KVCache,在线推荐端到端时延降低15%;证券低时延,内存语义替代传统通信,时延下降50%。

  在Agentic AI场景,鲲鹏超节点也得到广泛应用。在AI推理场景的Prefill阶段面临序列变长带来KVC存储容量不足、远端存储带宽受限难题,鲲鹏超节点借助灵衢大带宽互联构建超大KV Cache缓存池,将KVC命中率提升至99%,并依托KAE引擎创新KVC高压缩算法,实现物理存储节省25%。在AI 推理 Decode阶段受序列变长制约,片上内存不足会压低NPU并发,序列长度≥256K时单卡内存需求超300GB,鲲鹏超节点依托灵衢Scale Up网络提供百TB级内存池,接入后NPU单卡吞吐在256K、1M序列下分别提升2倍、2.6倍,序列越长增益越显著。

  面向Agent沙箱高并发启动与高密度部署诉求,RL增训场景需实现10万沙箱秒级启动,高密超分场景存在核存比不足的内存瓶颈,鲲鹏超节点沙箱引擎通过镜像预加载、RemoteFork实现10秒快速启动,结合超大内存池与沙箱暂停恢复技术,沙箱密度提升25%。当Agent进入核心生产系统,安全是底线。鲲鹏围绕处理器,系统和应用,打造三层内生安全架构,鲲鹏处理器内置安全可信根,支持内生国密,Agent异常行为拦截准确率达99%。

  面向未来,鲲鹏将推出全新液冷超节点。最大支持4096节点,并形成高达256TB的统一内存池,可显著加速Agent性能。在Agent沙箱场景,十万级别沙箱启动相比传统服务器方案提升30倍,且沙箱密度还可以再提升25%;在Agent向量检索场景,在百亿千维的复杂向量检索场景下,实现检索效率比传统服务器性能实现倍增。

  Agentic AI时代,千行百业正在被重新定义,CPU成为AI时代关键。鲲鹏持续坚持打造AI时代先进算力底座,以架构换算力,为世界构建新选择。

相关阅读

    无相关信息