在华为全联接大会的最新发布中,一款名为OceanStor M900的AI记忆存储系统正式亮相。该系统基于华为自主研发的灵衢技术架构,专为Agent推理场景设计,通过多层KV缓存架构实现高效数据处理。其核心创新在于采用L3.5层PB级KV缓存集群,结合灵衢UnifiedBus总线技术,支持数据"一跳直连"传输,显著降低推理延迟。
针对Agent与长序列处理需求,华为提出了分层缓存解决方案。OceanStor M900通过混合介质存储与智能Retention算法优化,将SSD读写寿命提升至传统方案的16倍。这种设计不仅保障了KV缓存的高命中率,更通过底层硬件革新确保系统长期稳定运行,为大规模AI推理提供可靠支撑。
技术实现层面,该系统突破了传统KV缓存的层级限制。通过构建多层次缓存架构,OceanStor M900能够动态分配热数据与冷数据存储空间,配合灵衢总线的高速带宽特性,实现每秒PB级数据吞吐能力。这种架构特别适用于需要持续交互的Agent应用场景,可有效应对复杂推理任务中的数据爆发式增长。
在存储介质创新方面,华为研发团队通过优化数据保留算法,使混合存储介质发挥最大效能。实验数据显示,在典型AI推理工作负载下,OceanStor M900的存储单元磨损率降低93.75%,同时保持99.999%的数据可靠性。这项突破为构建超大规模AI基础设施提供了新的技术路径。