ai-trains-ai - RL-training an AI agent to train AI agents

Show HN: I RL-trained an agent that trains models with RL (for –$1.3k)

ai-trains-ai - RL-training an AI agent to train AI agents

ai-trains-ai ist ein Open-Source-Projekt, das einen KI-Agenten mit Reinforcement Learning trainiert, um eigene Trainings-Jobs für kleine Modelle zu schreiben und auszuführen. Der Agent erstellt vollständige prime-rl-Trainingskonfigurationen, inklusive Umgebung, Belohnungsfunktion und Hyperparametern, und startet diese auf echten GPUs. Durch Tinker wird der Agent selbst per RL optimiert, wobei die Belohnung die Qualität der trainierten Modelle widerspiegelt. Das System erreichte eine Belohnungssteigerung von 0.0 auf 0.63 in 54 Schritten und zeigte Generalisierung auf eine ungesehene Aufgabenfamilie. Alle Gewichte, Code und Retrospektiven sind verfügbar.

Der Agent begann, bessere Modelle zu trainieren, nicht nur funktionierende – das zeigt, wie Reinforcement Learning die Fähigkeit eines KI-Agenten verbessern kann, andere KI-Modelle effektiv zu trainieren.

Mehr von diesem Tag

2026-07-14