一句话看懂:NVIDIA在FMS大会上宣布开源cuFile API,让GPU能够直接读写存储设备、绕过CPU中转,同时联合40多家存储厂商推进Storage-Next计划,为AI时代重新定义存储架构。
事件核心:发生了什么
本周举行的Future of Memory and Storage(FMS)大会上,NVIDIA宣布开源cuFile API及其底层的垂直存储软件栈。cuFile是GPUDirect Storage的组件,利用GPU的数千线程和高带宽内存,将存储访问延迟从传统路径的分钟级压缩到微秒级。NVIDIA同时公布了Vera CPU的基准测试数据:在两阶段压缩和加密管线中,Vera CPU的吞吐量是x86 CPU的3.21倍。
与开源同步亮相的还有Storage-Next计划,已有DDN、KIOXIA、Micron等40多家存储和闪存厂商参与,目标是确立GPU驱动存储的统一行为规范,最终转化为开放行业标准。NVIDIA还展示了SCADA(规模化加速数据访问)框架,让GPU只将应用所需的数据从存储直接拉入自身高速内存。
为什么重要
AI代理和超大上下文窗口正在让数据集规模突破内存极限,GPU也开始主动发起数千个并发存储请求。传统存储架构中,CPU是数据进出的必经节点,加密、压缩、校验等工作在大量并发访问下容易成为瓶颈。cuFile开源的意义在于:存储不再是被动保存数据的设备,而是主动参与数据路径的一部分。NVIDIA提供的基准数据显示,Vera CPU在加密压缩管线上相比x86有明显吞吐优势,意味着存储平台可以用更少的计算资源吸收AI数据



