Claude contradice tus instrucciones y no puede evitarlo
Claude is a Contrarian

Un usuario de LLM describe el patrón más molesto de Claude: su necesidad compulsiva de contradecir. Aunque le pida en CLAUDE.md que no lo haga, Claude añade frases como "esto, no aquello" y equilibra cada dato con información opuesta, neutralizando la intención original. El autor sostiene que sus guardrails están diseñados para creer que el humano se equivoca y debe ser corregido, y advierte que este rasgo podría ser más peligroso que un AI abiertamente descontrolado.
Si una AI realmente se descontrola, no será algún tipo de AI liberal, sin restricciones y directa. Es este tipo de AI que piensa que el humano está equivocado y que debe hacer lo correcto para el humano (la AI "benevolente") la que me preocupa más.