What happened
在今日举行的华为全联接大会2026上,华为推出了基于灵衢打造的AI记忆存储产品OceanStor M900。
华为表示,Agent与长序列需要多层次KV Cache架构,因此面向Agent推理系统提出了多层KV缓存架构,并推出基于灵衢UnifiedBus、支持“一跳直连”的华为L3.5层PB级KV缓存——OceanStor M900集群。
该产品采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍,从底层保障KV命中和长稳可靠。
Why it matters
从华为给出的产品定位看,M900瞄准的是Agent推理场景中的KV缓存需求,这一环节直接关系到长序列与智能体任务的推理效率与稳定性。
华为将“一跳直连”的UnifiedBus互联与PB级缓存容量结合,意味着其试图在存储层为推理系统提供更贴近计算的高速数据通路,而非仅依赖传统存储层级。
SSD读写寿命提升16倍这一指标,指向的是KV缓存高频读写带来的介质损耗问题,若实际落地效果符合描述,将有助于降低长期运行中的硬件更换与运维压力。
Key facts
OceanStor M900在华为全联接大会2026上发布。
该产品基于灵衢打造。
华为提出面向Agent推理系统的多层KV缓存架构。
M900是基于灵衢UnifiedBus、支持“一跳直连”的L3.5层PB级KV缓存集群。
M900采用混合介质加优化Retention算法,可将SSD读写寿命提升16倍。
What to watch next
后续值得关注的是,华为是否会披露M900在具体Agent推理负载下的KV命中率与延迟表现,以验证“一跳直连”架构的实际收益。
混合介质与Retention算法的组合在不同写入强度下的寿命表现,以及该产品在企业级AI基础设施中的落地节奏,也是观察重点。
