发生了什么

在今日举行的华为全联接大会2026上,华为正式推出基于灵衢打造的AI记忆存储产品OceanStor M900。

华为方面指出,Agent与长序列需要多层次KV Cache架构。面向Agent推理系统,华为提出了多层KV缓存架构,并推出基于灵衢UnifiedBus、支持“一跳直连”的华为L3.5层PB级KV缓存——OceanStor M900集群。

该产品采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍,从底层保障KV命中和长稳可靠。

为什么重要

从华为给出的思路看,Agent推理对缓存层次的需求正在被单独产品化,KV缓存不再只是推理框架内部的软件问题,而开始对应专门的存储层级。

如果SSD读写寿命提升16倍的效果在实际负载中成立,那么长序列与Agent场景下频繁读写对存储寿命的消耗压力有望缓解,这关系到推理系统能否长期稳定运行。

“一跳直连”与PB级集群的组合,指向的是把KV缓存容量和访问延迟同时纳入存储系统设计的路线,这可能影响后续AI推理基础设施的形态。

关键事实

OceanStor M900在华为全联接大会2026上推出,基于灵衢打造。

该产品定位为AI记忆存储,面向Agent推理系统。

华为提出多层KV缓存架构,并推出L3.5层PB级KV缓存OceanStor M900集群。

M900集群基于灵衢UnifiedBus,支持“一跳直连”。

M900采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍。

接下来看什么

后续值得关注的是,华为是否会披露M900集群在具体Agent推理负载下的KV命中表现与延迟数据。

多层KV缓存架构与L3.5层的提法如何在产品线中落地、与其他存储层级如何配合,也是观察这一路线实际效果的关键。

混合介质与Retention算法带来的寿命提升,能否在客户真实的长稳运行场景中得到验证,将决定该产品的说服力。

来源