Claude, cambia el botón "Add to Cart" a azul
Claude, change the “Add to Cart” button to blue

En Hacker News, desarrolladores comparten su frustración con modelos como Claude y Fable, que insisten en añadir compatibilidad hacia atrás, pruebas y validaciones excesivas en proyectos recién creados y sin usuarios. La queja central es que los LLM sobreactúan la ayuda, ignorando el contexto y complicando cambios simples. Algunos recurren a archivos PROJECT.md o instrucciones explícitas para frenar esta tendencia.
Es como si tuviéramos una supercomputadora alienígena súper inteligente que puede hacer cualquier cosa, pero necesitamos pasar una cantidad enorme de tiempo construyendo cercas y fosos y escribiendo instrucciones extremadamente detalladas para que no se desboque e intente "ayudar".
- dudeinhawaii
Gran sitio, ¡me trajo recuerdos! jaja.
Para intentar aportar algo a esta discusión, creo que si bien he visto este tipo de bucles menos, lo que sí he visto es "demasiado servicial".
Los modelos hoy en día quieren verificar las cosas dos, tres, cuatro veces. Estoy siendo tonto, pero roza el "tengo una solución que funciona, pero déjame escribir una variación en Rust para asegurar una solución convergente y demostrar que esto funciona".
He tenido que detener a los modelos hoy en día principalmente porque se vuelven agonizantemente pedantes en su validación. Opus es en realidad uno de los más pedantes y "descarriados" aquí. Pero de nuevo, no de mala manera. Normalmente digo "deja de probar la latencia entre 50 ejecuciones de esta aplicación... esta es la versión uno... vamos a hacer un millón de cambios más... no nos estás aportando nada".
- dwedge
Me molesté demasiado con esto antes de darme cuenta de que era un juego opcional y que podía simplemente cerrar la pestaña.
- captainbland
Esto es en realidad lo que mantiene a la gente usando IA: un programa de recompensas variable. Básicamente es apostar.
- _fat_santa
Al menos con Codex, esta no ha sido mi experiencia en absoluto. Todavía la caga, seguro, pero en todos los casos puedo preguntar "¿por qué hiciste esto?" y puede rastrear qué le hizo tomar esa decisión en particular. Típicamente siempre es que o no especifiqué el problema correctamente o cometí un error realmente tonto (ejecutar la tarea en el proyecto equivocado... hice esto ayer) o es algo dentro de un archivo de habilidades que le instruye (en cuyo caso corrijo las instrucciones).
Una vez cada muerte de obispo es en realidad el modelo cometiendo un error material en su pensamiento y tengo que volver y rehacerlo.
- johnisgood
> ¿Por qué la mitad del sitio es azul ahora? Te pedí que cambiaras un botón.
> La mitad del sitio es azul. Pedí UN botón.
Esas son mis únicas opciones cuando el sitio claramente no es azul, dos botones lo son.
Hay una razón por la que soy mucho más específico que esto.
- kstenerud
Qué raro... Esto no coincide en absoluto con mi experiencia con Claude. Nunca lo he visto comportarse así.
- JohnMakin
> Vale la pena mencionar: el botón "Add to cart" sigue siendo negro.
Me sacó una carcajada audible. Esto realmente es cómo es la experiencia a veces si solo le das un resultado sin ser específico en la implementación, y sale de la nada, algunos días mucho peor que otros.
Me he vuelto paciente con él, pero como sea que se llame este estilo de salida o lo que haga, es a la vez condescendiente y completamente inútil, y parece diseñado para frustrar.
- oujiii
Jaja esto es exactamente cómo me he estado sintiendo últimamente. Encuentro insoportable trabajar con este modelo por esta razón... ¿hay algún truco que puedas hacer para guiarlo y que no complique las cosas en exceso? Supongo que Codex, allá voy.
- techscruggs
Nunca entendí realmente cómo era estar "triggered" hasta ahora.
- alentred
-= CUIDADO, SPOILERS =-
Esto me atrapó con "cyanide blue", y me estaba REVOLCANDO POR EL SUELO DE LA RISA con "Approaching usage limit". Apenas puedo parar de reír ahora y me duele el estómago. O sea, ¡Gracias!