llama.cpp: ejecuta modelos de IA localmente en cualquier hardware

La página oficial de llama.cpp presenta su integración con el agente de codificación local Pi, que permite ejecutar modelos sin configuración ni claves API, manteniendo los archivos en tu máquina. Además, destaca su optimización para una amplia gama de hardware, desde laptops hasta clústeres, con kernels ajustados a mano para cada GPU y CPU.
Los archivos se quedan en tu máquina, las solicitudes nunca salen de ella.