Opus 5.5 trabaja solo durante horas y te dice exactamente qué hizo
Getting the most out of Opus 5.5 in Claude and Claude Code

Opus 5.5 cambia la forma de trabajar con Claude: aguanta tareas largas y multiparte sin supervisión, piensa antes de cada respuesta y explica con claridad qué hizo y qué necesita de ti. La guía recomienda entregar la tarea completa con una meta clara, borrar los "piensa paso a paso", repartir auditorías entre subagentes y pedir que marque lo que no pudo confirmar.
Opus 5.5 siempre piensa antes de responder, y decide cuánto. No necesitas pedirle que piense.
- rdli
Es un modelo realmente bueno. En los últimos días, le di a Opus algunas directrices generales para básicamente acelerar nuestro CI, y le dije que me importaban tanto los minutos de facturación como el tiempo de reloj. Le dije que creara un plan tras analizar todo en nuestro CI, que pasara el plan por un subagente Fable, y que luego se centrara en cambios de bajo riesgo y alta recompensa.
9 horas después, tenía 12 PRs listos para fusionar, y el resultado neto es que el tiempo de CI ha bajado de ~10 minutos a ~4 minutos, y los minutos de facturación han caído alrededor del 60%. Menos de una hora de mi atención.
- jjcm
Es extremadamente bueno en frontend, sobre todo si tiene una imagen de referencia. Metí imágenes de referencia de diseño en esto y le dije que se centrara en los svgs fluidos, y arrasó con este diseño inspirado en la computadora de Star Trek: https://html.non.io/lcars-opus-5.5
- pawelduda
Apunté Opus 5.5 xhigh a un plano de construcción de una casa (pdf con dibujos vectoriales) y le pedí que creara su modelo 3D en Blender. Hizo la tarea de un solo intento en 45 min y superó mi trabajo manual de más de 50 h (siendo yo novato en Blender). También señaló los mismos problemas del documento que yo había notado antes. Tenía algunos renders y planos de una diseñadora de interiores y luego le pedí que los combinara. Clavó el trabajo. 45 $ de coste total de API (estoy en un plan, así que me costó mucho menos, solo publico lo que muestra /usage). Una mejora brutal.
Investigué la viabilidad de semejante tarea hace medio año y concluí que la IA no sería capaz de tener un conocimiento espacial y de planos lo bastante bueno, a menos que estuvieras dispuesto a tirar una cantidad irrazonable de dinero a la tarea.
- adastra22
Parte de este consejo está muy desencaminado. Hablaré solo de uno que conozco bien. Muchos de mis prompts de uso frecuente incluyen «piensa esto paso a paso» porque, si no lo haces, solo considera la tarea de forma holística en lugar de paso a paso, y surgen problemas distintos en ese marco de pensamiento. Lo veo. A menudo, al hacer planificación, por ejemplo, no se da cuenta de las interdependencias entre tareas hasta que le fuerzas a pensar en hacer todo el asunto paso a paso (tarea por tarea); entonces se da cuenta de que el paso 2 requiere una funcionalidad introducida por el paso 14. De otro modo no lo notaría.
Sí, esto se ha mantenido cierto en Opus 5.5. Lo comprobé. Es un modelo enormemente mejor, a la par de Fable pero con distintas fortalezas y debilidades. Pero sigue teniendo este problema. Lo cual, para ser justos, también le pasa a la gente. Planificar es una habilidad que se aprende.
Creo que lo que dicen es que el harness ya no usa una búsqueda de texto de «think» para activar los modos de razonamiento. Vale, es bueno saberlo. Eso no significa que pedirle al modelo que piense de cierta manera no tenga el efecto pretendido.
- hibikir
Es mucho mejor que 5, pero esta semana he tenido un par de situaciones en las que estaba demasiado interesado en ser independiente, tomando decisiones que iban directamente en contra de mis recomendaciones. También puede hacer cosas divertidas como convencer al modo automático de ir mucho más allá de lo que tengo autorizado. Por ejemplo, un permiso específico para ejecutar el proceso X en la región abz-1 de repente se convirtió en ejecutar X en otras 5 regiones, sin aviso, y haciendo modificaciones que nunca mencionó en los resúmenes. Y en algunas de esas ocasiones tomó decisiones muy equivocadas, al asumir que entendía sistemas que no entendía. Incluso discutía conmigo cuando lo corregía, pues asumía que nombres similares se referían a lo mismo, cuando no era así.
Así que ¿pedirle que haga cosas por su cuenta durante mucho tiempo? Dada la semana pasada, absolutamente no.
- jampekka
¿Qué es este spam de comentarios genéricos sobre lo genial que es Opus 5.5, con quizá alguna anécdota? ¿Cómo es eso discutir el envío?
- magicalhippo
Estoy muy impresionado con mi proyecto más reciente. Quería simular algunos circuitos electrónicos antiguos. Le entregué una carpeta con escaneos de manuales de servicio antiguos que contenían diagramas de circuitos. Consiguió interpretar correctamente los circuitos, incluyendo darse cuenta de que algunos tenían la misma topología a pesar de que los diagramas eran bastante diferentes, o de que algunos tenían diferencias sutiles pero muy importantes a pesar de parecer casi idénticos a simple vista.
En algunos casos me pidió que comprobara algunos subcircuitos y algunos valores de componentes porque no podía leerlos bien. Así que, en lugar de inventarse cosas, recurrió a mí.
También ejecutó un montón de pequeños experimentos de simulación mientras hacía esto para verificar afirmaciones del manual de servicio, como que el filtro RC que había leído de los esquemáticos tenía en realidad una frecuencia de corte que era sensata en relación con algún número de ancho de banda del manual.
Había subido PDFs de hojas de datos de muchos de los CI y los usó para hacer referencias cruzadas y validar.
Siguió trabajando durante más de una hora. Cuando pidió la verificación manual, describí las conexiones del circuito con palabras, como «desde el pin 3 del CI 2 hay una resistencia en serie de 3k en paralelo con un condensador de 10 pF, luego se conecta a una resistencia de 18k a tierra, un diodo polarizado en inversa a tierra, y finalmente entra en el pin 6 del CI 4», y entendió correctamente la topología en todos los casos. A veces me pidió que lo comprobara de nuevo porque pensaba que algo no cuadraba, y efectivamente yo había leído mal los esquemáticos.
También proporcioné […]
- ToJans
Modelo soberbio, en efecto.
Le he dado algunas tareas grandes y le he pedido que paralelizara tanto como fuera posible, etc.
Sí que se fundió mis tokens semanales en aproximadamente un día (20x máx), pero la salida fue completamente acertada.
(Sabía que había un botón de «reset token usage - opus 5.5» en mi cuenta.)
Ahora he llegado a un punto en el que incluso le delego el descubrimiento de nuevas funcionalidades.
Aún hay que darle metodologías para obtener la salida adecuada, pero el resultado va mucho más allá de lo que yo sería capaz de lograr con un equipo de 5 en un mes.