NVIDIA Abre Código de APIs cuFile para Acceso Directo GPU-a-Storage; Lanza Iniciativa Storage-Next
En la conferencia Future of Memory and Storage, NVIDIA anunció que está abriendo el código de cuFile, las interfaces de programación que permiten transferencias de acceso directo a memoria (DMA) GPU-a-storage que evitan la CPU. cuFile es el componente central de NVIDIA GPUDirect Storage, permitiendo que las GPUs lean y escriban en almacenamiento directamente utilizando cientos de miles de hilos GPU y memoria de alto ancho de banda, con tiempos de acceso a datos en el rango de microsegundos. El lanzamiento de código abierto incluye la pila de software de almacenamiento vertical, posicionando cuFile para interoperabilidad entre proveedores de almacenamiento y plataformas de GPU.
El lanzamiento aborda un cuello de botella crítico: a medida que los agentes de IA consumen cantidades masivas de datos, las GPUs ahora inician miles de solicitudes de almacenamiento concurrentes. Los sistemas de almacenamiento deben encriptar, comprimir, verificar y reconstruir datos para cada solicitud, y estos servicios de datos pueden convertirse en cuellos de botella a escala. Los procesadores de almacenamiento NVIDIA Vera BlueField-4 STX entregan hasta 3.21x mayor rendimiento que las CPU x86 en canalizaciones de compresión-encriptación de dos etapas, absorbiendo la inundación de datos de IA con significativamente menos infraestructura de cómputo. cuFile permite este camino directo sin intermediarios de CPU, liberando recursos de CPU y reduciendo la latencia.
Junto con cuFile, NVIDIA lanzó Storage-Next, un consorcio de proveedores que une más de 40 proveedores de almacenamiento y flash (DDN, KIOXIA, Micron y otros) con proveedores de GPU y organismos de estándares para alinear cómo debe comportarse el almacenamiento orientado a GPU. La iniciativa incluye SCADA (Acceso de Datos Escalado y Acelerado), un marco que permite que GPUs masivamente paralelas extraigan solo datos necesarios directamente del almacenamiento a su propia memoria de alta velocidad. NVIDIA también lanzó la Open Secure AI Alliance con Google, Intel y Meta como mantenedores inaugurales, apoyando APIs abiertas para acceso seguro y distribuido al almacenamiento de IA.
Para equipos de infraestructura que construyen canalizaciones de datos de IA, cuFile de código abierto y la estandarización de Storage-Next reducen el bloqueo de proveedores y aceleran la adopción de almacenamiento GPU-directo en entornos heterogéneos. El cambio de almacenamiento pasivo a participación activa de la ruta de datos cambia fundamentalmente la economía memoria-versus-almacenamiento en la era de microsegundos.