What happened

在今日举行的华为全联接大会2026上,华为推出了基于灵衢打造的AI记忆存储产品OceanStor M900。

华为表示,Agent与长序列需要多层次KV Cache架构,因此面向Agent推理系统提出了多层KV缓存架构,并推出基于灵衢UnifiedBus、支持“一跳直连”的华为L3.5层PB级KV缓存——OceanStor M900集群。

该产品采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍,从底层保障KV命中和长稳可靠。

Why it matters

从华为给出的产品定位看,M900瞄准的是Agent推理场景中的KV缓存需求,这一环节直接关系到长序列与智能体任务的推理效率与稳定性。

华为将“一跳直连”的UnifiedBus互联与PB级缓存容量结合,意味着其试图在存储层为推理系统提供更贴近计算的高速数据通路,而非仅依赖传统存储层级。

SSD读写寿命提升16倍这一指标,指向的是KV缓存高频读写带来的介质损耗问题,若实际落地效果符合描述,将有助于降低长期运行中的硬件更换与运维压力。

Key facts

OceanStor M900在华为全联接大会2026上发布。

该产品基于灵衢打造。

华为提出面向Agent推理系统的多层KV缓存架构。

M900是基于灵衢UnifiedBus、支持“一跳直连”的L3.5层PB级KV缓存集群。

M900采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍。

What to watch next

后续值得关注的是,华为是否会披露M900在具体Agent推理负载下的KV命中率与延迟表现,以验证“一跳直连”架构的实际收益。

混合介质与Retention算法的组合在不同写入强度下的寿命表现,以及该产品在企业级AI基础设施中的落地节奏,也是观察重点。

Sources