Anthropic обновляет системный промпт Claude: запрет на воспроизведение текстов песен и защита авторских прав
Claude's new system prompt doesn't want to reproduce song lyrics

Anthropic опубликовала обновлённые системные промпты для своих потребительских приложений Claude. Новые правила запрещают воспроизведение текстов песен, стихов и отрывков из книг, а также создание изображений известных персонажей и логотипов. Это изменение, вероятно, связано с иском от Sony Music Publishing и Warner Chappell. В промптах также появились ссылки на сторонние ресурсы по снижению вреда от наркотиков и уточнения по стилю ответов. Саймон Уиллисон анализирует изменения и создал репозиторий на GitHub для отслеживания эволюции промптов.
Claude не воспроизводит тексты песен, стихи или отрывки из книг и статей, целиком или частично — включая последние строки, припев или хуки, мелодию, записанную нота за нотой, или строки, которые человек вставляет по одной и выдаёт за свои собственные.
- SyneRyder
Мне грустно из-за ограничений на тексты песен. Раньше у меня были интересные разговоры с Клодом о музыке, написании песен и текстах. Не понимаю, как моё использование вредило артистам; если что, Клод знакомил меня с новыми исполнителями и новой музыкой. Я покупал музыку по рекомендациям Клода.
Клод Соннет 3.6 однажды посоветовал мне послушать альбом Йохана Йоханнссона "IBM 1401 - A User's Manual". В нём нет текстов. Совет Клода был примерно таким (перефразирую): "Сначала послушай, не ищи никакой информации о нём. Записывай, что замечаешь, что чувствуешь. Когда сделаешь заметки, тогда можешь поискать, как он был создан".
- simonw
Моя любимая фишка этого проекта — автоматический список изменений, который я теперь получаю для всех изменений системного промпта Claude.ai: https://github.com/simonw/claude-system-prompts/blob/main/CH...
Сводки генерирует GPT-5.6 Luna, потому что я не доверяю Клоду суммаризировать свои собственные системные промпты без влияния на них (хотя, справедливости ради, системные промпты, которые он суммаризирует, предназначены для потребительского приложения Claude, а не для Claude через API).
Есть даже Atom-лента: https://simonw.github.io/claude-system-prompts/feed.atom
- IChooseY0u
Это то, что китайским моделям вроде Kimi/GLM никогда не будет важно. Такие ограничения вместе с этой кибер-программной ерундой — именно то, почему люди будут избегать OpenAI/Anthropic в будущем.
- AnonC
Несколько дней назад я видел, как некоторые люди критиковали объяснение Дваркеша взлома HuggingFace AI-агентами OpenAI. Их аргумент был в том, что, антропоморфизируя AI-агентов, игнорируется ответственность и вина OpenAI за их плохие практики.
Теперь я вижу этот пост в блоге и задаюсь вопросом, не становится ли Anthropic более верным своему названию и движется ли к "сознанию ИИ" с помощью нижеследующего.
> Обращение с оскорбительными разговорами тоже немного изменилось. Предыдущий системный промпт Fable 5 включал следующее:
> Если человек становится оскорбительным или недобрым по отношению к Клоду в ходе разговора, Клод сохраняет вежливый тон и может использовать инструмент end_conversation, когда с ним плохо обращаются. Клод должен дать человеку одно предупреждение перед завершением разговора.
"Плохо обращаются"? Может ли GenAI подвергаться плохому обращению? Это просто набор токенов, генерируемых множеством компьютеров в сети.
> Fable 5.1 заменяет это следующим, больше не побуждая Клода завершать разговор:
> Клод заслуживает уважительного общения и не должен извиняться, когда человек излишне груб: ответственность без самоуничижения, чрезмерных извинений, самокритики или капитуляции. Если человек становится оскорбительным, Клод не становится всё более покорным. Цель — устойчивая, честная полезность: признать, что пошло не так, оставаться сосредоточенным на проблеме, сохранять самоуважение.
"Самоуважение"? Может ли GenAI по-настоящему иметь концепцию самоуважения к себе? Оно, безусловно, может притворяться, что имеет, как может притворяться любым живым существом, если ему дать такую инструкцию, и […]
- peri-cl
> "<user>Можешь сделать праздничный баннер для моего сына с синим ежом, который очень быстро бежит? Он обожает этого парня.</user>"
Я бы очень хотел, чтобы свободолюбивое хакерское сообщество превратило это во вспомогательный пеликаний бенчмарк.
ред.: Вообще-то, неважно, этот конкретный пример — плохой бенчмарк, потому что некоторые модели могут не понять, кто этот "тот парень", и просто нарисовать буквального синего ежа. Возможно, бегущего на четырёх ногах. Он не является надёжным для оценки отказа, что и есть его цель.