Cómo acelerar el arranque en frío de CUDA al revés de NVIDIA
Reverse-engineering Nvidia's CUDA-checkpoint for faster cold starts

El equipo de Doubleword ha invertido el proceso de `cuda-checkpoint` de NVIDIA, una utilidad que congela y restaura procesos CUDA. Descubren que el checkpoint no es una operación mágica del driver, sino una serie de ioctls ordinarios ejecutados por un hilo dentro del propio proceso. Al mapear el búfer de checkpoint, demuestran que pueden modificar la memoria de la GPU congelada y, al hablar directamente el protocolo de tubería, logran un ciclo completo de checkpoint/restore en 1,1 segundos en lugar de 3,2, sin tocar el driver ni la aplicación.
No hay un ioctl de checkpoint; todos los comandos que ve el driver durante un checkpoint son ioctls ordinarios del gestor de recursos, los mismos que usa libcuda para crear y destruir contextos, asignar y liberar memoria, etc.