Novus架构定位与核心指标 据报道,NetApp于北京时间9月30日凌晨推出新一代存储架构Novus,主打面向超大规模GPU集群提供数据访问支持。厂商称其聚合吞吐超过100TB/s,可支撑数十万块GPU同时工作,容量设计最高可达ZB级,是业界首个单命名空间支持ZB级容量的文件系统。 从算力需求角度看,单块GPU最高可能需要2GB/s的吞吐才能保持满载,5万块GPU就需要100TB/s的聚合带宽。这一数据对比揭示了超大规模AI训练场景对存储吞吐的严苛要求。 元数据层与数据层分离设计 传统文件系统中,元数据操作与数据传输共用同一路径。当数十万块GPU同时发起元数据查询时,容易造成操作积压,导致文件系统响应迟缓甚至停滞。据引述,洛斯阿拉莫斯国家实验室计算技术高级总监Gary Grider指出,AI工厂规模继续扩大后,元数据操作大量积压会拖慢甚至卡死文件系统。 Novus架构的元数据层由Novus Data Director承担,厂商称这是独立扩展的软件定义控制层,运行在标准x86服务器上。Gary Grider表示,Novus是首个能让元数据层和数据层独立扩展的架构。这意味着