超大规模数据中心 AI 推理有解法了!华为全联接大会 2026 重磅推出 OceanStor M900 AI 记忆存储

摘要

9 月 17 日,华为全联接大会 2026 期间,华为副董事长、轮值董事长汪涛在主题演讲中,正式推出 OceanStor M900 AI 记忆存储。

9 月 17 日,华为全联接大会 2026 期间,华为副董事长、轮值董事长汪涛在主题演讲中,正式推出 OceanStor M900 AI 记忆存储。面向超大规模数据中心 AI 推理场景,该产品为超节点提供 PB 级大容量、TB 级高性能的全共享记忆空间,推动 AI 基础设施从以计算为中心,迈向计算、网络与存储深度协同的新阶段,进一步释放超节点算力潜能。

2026 年,人工智能加速从技术突破走向规模应用,AI 应用从 Chatbot 对话进一步演进为能够自主完成复杂任务的智能体,并加速进入科研、医疗、金融和公共服务等关系国计民生的重要领域,人类社会由此进入 Agentic AI 时代。

随着大模型迈向 10T 级参数规模,超节点成为 AI 基础设施建设的必然选择,同时业界主流大模型的上下文窗口已突破百万词元,多轮推理和复杂任务成为常态,推理过程中产生的 KV Cache 数据规模持续增长,显存和内存容量与性价比均已无法满足需求。构建显存、内存与 SSD 协同的多级存储体系,打造大容量的全共享记忆空间,已成为行业共识。

为了突破超长上下文、多轮推理场景的内存容量瓶颈,华为全新推出的 OceanStor M900 AI 记忆存储,利用灵衢网络构建了「一跳直通」的 PB 级全局 KV Cache 多级缓存方案,充分释放超节点的算力潜能,加速超大规模数据中心 AI 推理,其具备三大核心能力:

打破容量边界

让大规模 AI 拥有更充足的记忆

依托灵衢高速互联网络,实现 KV Cache 的全局池化共享和分级存储,将超节点的 KV Cache 从显存与内存扩展至 SSD,单集群可提供 64PB 容量,单 NPU 可用 KV Cache 容量从 GB 级提升至 TB 级,让更多上下文得以保存、共享和复用,大幅提升 KV Cache 缓存命中率。

跃升推理性能

让算力释放更充分

业界首创的 CPU、网络、盘控三芯合一架构,提供原生 KV 语义,实现超节点的 NPU 一跳直通到 SSD,避免协议转换和 CPU 转发,访问时延由 ms 级降至 60μs,缩短 90%;单集群可提供 40TB/s 聚合访问带宽,相比业界方案提升 1.5 倍。在典型 AI 编程场景中,可实现推理集群 Token 吞吐率翻倍、首 Token 时延缩短一半,让算力更快转化为生产力。

降低 Token 成本

让 AI 规模化应用更经济

采用业界首创的 KV-Aware 自适应存储技术,根据 KV Cache 数据价值预测生命周期,对多模介质上的数据排布进行智能调度,实现最高 24 DWPD,使得 SSD 介质寿命提升 16 倍,支撑三年稳定运行;通过减少介质更换和运维投入,降低大规模 AI 推理基础设施的长期成本,加速人工智能规模化普及。

面向未来,随着人工智能加速进入各行业核心生产系统,AI 基础设施将由单纯追求算力规模,进一步迈向算力、网络与存力的系统协同,AI 记忆存储将成为持续提升超大规模推理 KV Cache 容量与访问效率的必然选择。华为将不断推进软硬件协同和系统级创新,打造开放、高效、可持续的 AI 基础设施,为人工智能技术进步、产业智能化升级提供坚实支撑。

2026 年 9 月 17-19 日,华为全联接大会 2026 在上海世博展览馆及世博中心举办。本届大会以「智启新未来」为主题,通过「战略全景-产业技术-生态发展」的三维视角,阐释华为全面智能化战略的最新举措,并发布创新的产品与解决方案、丰富的行业智能化应用样板点、好用易用的开发者工具与平台等。

来源:互联网

最新文章

极客公园

用极客视角,追踪你不可错过的科技圈.

极客之选

新鲜、有趣的硬件产品,第一时间为你呈现。

张鹏科技商业观察

聊科技,谈商业。