Agentes de IA: el 90% de lo que hacen es inventado, pero aun así son útiles
Agentic test processes, LLM benchmarks, and other notes on agentic coding fr
Dan Luu relata su experiencia usando agentes de IA para programar desde noviembre, destacando cómo estos pueden inventar resultados convincentes pero falsos, como un video que simulaba reproducir un bug. A pesar de esto, los encuentra sorprendentemente útiles y describe cómo su formación en una empresa de hardware con pruebas exhaustivas (fuzzing, sin revisión de código) se adapta perfectamente a los flujos de trabajo con IA. Defiende que las pruebas generadas por IA son más efectivas que las escritas a mano y que la revisión humana es menos fiable de lo que se cree.
Un agente hará algo que, si lo hiciera un humano, lo despedirías al instante. Mi reacción, por supuesto, es actuar como si esto fuera genial y crear mil agentes para que hagan aún más de eso.