ai-trains-ai - RL-trained agent that trains AI models
Show HN: I RL-trained an agent that trains models with RL (for –$1.3k)

ai-trains-ai es un proyecto que entrena un agente de IA mediante aprendizaje por refuerzo (RL) para que a su vez entrene otros modelos de IA. El agente escribe trabajos de entrenamiento completos, los envía a GPUs reales en Runpod y recibe una recompensa basada en la mejora de los modelos entrenados. Todo el código, los pesos del modelo y los informes están abiertos. El proyecto demuestra que el agente aprende a crear modelos mejores y generaliza a tareas no vistas, con un coste total de unos $1.3k.
El agente aprendió a crear mejores modelos, no solo a hacer que funcionaran.