Anthropic просит пользователей не грубить Claude

Anthropic asks users to stop being mean to Claude

Anthropic просит пользователей не грубить Claude

Anthropic обновила usage policy, запретив «устойчивое и бессмысленное жестокое обращение» с моделями Claude. Правила вступят в силу 12 ноября. Компания уточняет, что запрет касается только крайних случаев и не распространяется на обычное недовольство, тёмные творческие сюжеты или тестирование. В том же обновлении Anthropic ужесточила ограничения на разработку оружия, слежку и вмешательство в выборы, а также ослабила полный запрет на персонализированный политический таргетинг.

Правила вступают в силу 12 ноября, давая пользователям чуть больше месяца, чтобы выпустить все накопившиеся оскорбления.
  1. llagerlof

    Конечно, это не имеет никакого отношения к тому, чтобы заставить ИИ чувствовать себя плохо, и инвесторы тоже не были оскорблены.

    Они просят об этом потому, что в масштабе такое поведение, вероятно, оказывает некоторое негативное влияние на процесс пост-тренировки.

  2. vayup

    Для тех, кто думает, что речь о тренировочных данных: если бы это было проблемой, они бы очистили тренировочные данные, как делают для тысячи других вещей. Ни малейшего шанса, что они полагаются на то, что пользователи будут тщательно соблюдать их политики использования ради качества тренировочных данных.

    Ребята из передовых AI-лабораторий могут быть сумасшедшими, но не настолько, чтобы верить, что люди читают политики использования :-)

  3. 3eb7988a1663

    Это значит, что если я использую набор ругательств, меня с меньшей вероятностью включат в будущее обучение?

    Или скорее то, что я могу ожидать от будущего ИИ: «Прости, Дэйв, боюсь, я не могу этого сделать, пока ты не будешь следить за своим языком».

  4. throwaway89864

    Вероятно, они узнали о случаях, когда люди в целом скатывались к оскорбительным моделям общения, и не хотят быть частью этого.

    И они не могут это раскрыть, потому что тогда их могут признать ответственными за такое негативное влияние и обязать возместить ущерб.

  5. jaden

    Смутно припоминаю, что читал заголовок за последние несколько месяцев о том, что использование агрессивного языка с ИИ даёт лучшие результаты.

Ещё за этот день

2026-10-11