Anthropic pide a los usuarios que dejen de ser crueles con Claude

Anthropic asks users to stop being mean to Claude

Anthropic pide a los usuarios que dejen de ser crueles con Claude

La nueva política de uso de Anthropic, que entra en vigor el 12 de noviembre, prohíbe el comportamiento "abusivo o cruel sostenido e innecesario" hacia sus modelos, aunque no se aplicará a la frustración habitual ni a la investigación. La medida forma parte de una revisión más amplia que endurece las reglas sobre interferencia electoral, desarrollo de armas y vigilancia, y que llega mientras Claude ya puede terminar conversaciones abusivas.

La actualización de la política está pensada para aplicarse solo en casos extremos, en los que los usuarios actúan repetidamente con crueldad hacia nuestros modelos, sin un propósito discernible.
  1. llagerlof

    Por supuesto, esto no tiene nada que ver con hacer que la IA se sienta mal, ni con que los inversores se hayan ofendido.

    Lo piden porque, a escala, este comportamiento probablemente tenga algún efecto negativo en el proceso de post-entrenamiento.

  2. vayup

    Para los que piensan que esto va sobre los datos de entrenamiento: si esa fuera la preocupación, depurarían los datos de entrenamiento, como hacen con otras mil cosas. No hay ni la más remota posibilidad de que confíen en que los usuarios sigan meticulosamente sus políticas de uso para la calidad de sus datos de entrenamiento.

    La gente de la IA de frontera podrá estar loca, ¡pero no tanto como para creer que la gente lee las políticas de uso! :-)

  3. 3eb7988a1663

    ¿Esto significa que si suelto una ristra de insultos hay menos probabilidades de que me incluyan en el entrenamiento futuro?

    ¿O más bien que puedo esperar a una futura IA diciendo: "Lo siento, Dave, me temo que no puedo hacer eso hasta que vigiles tu vocabulario"?

  4. throwaway89864

    Probablemente se han dado cuenta de casos en los que los humanos estaban derivando hacia patrones de comunicación abusivos en general, y no quieren formar parte de eso.

    Y no pueden divulgarlo, porque entonces se les podría considerar responsables de esa influencia negativa y ser considerados responsables de los daños.

  5. jaden

    Recuerdo vagamente haber leído un titular en los últimos meses que decía que usar lenguaje agresivo con las IA daba mejores resultados.

Más de este día

2026-10-11