Kv Cache
主题归档 • 1 条结果
AI 生成:摘要由 AI 根据所链接的来源撰写。 我们如何使用 AI
2026-09-18
科技
华为发布了 OceanStor M900 AI 内存存储,面向超大规模推理,提供高达每集群 64 PB 的 Lingqu 池化 KV 缓存、约 60μs 的 NPU 到 SSD 延迟,以及约 40 TB/s 的聚合带宽。该系统旨在缓解大规模 AI 服务中的 KV 缓存瓶颈。
AI 基础设施 • Pandaily
永久链接
主题归档 • 1 条结果
AI 生成:摘要由 AI 根据所链接的来源撰写。 我们如何使用 AI
华为发布了 OceanStor M900 AI 内存存储,面向超大规模推理,提供高达每集群 64 PB 的 Lingqu 池化 KV 缓存、约 60μs 的 NPU 到 SSD 延迟,以及约 40 TB/s 的聚合带宽。该系统旨在缓解大规模 AI 服务中的 KV 缓存瓶颈。
AI 基础设施 • Pandaily
永久链接