Anthropic впервые более чем за год обновила правила использования Claude. Теперь в них прямо запрещено «устойчивое и бессмысленное оскорбительное или жестокое поведение» по отношению к модели. За крайние случаи компания оставляет за собой право предупредить пользователя, ограничить ответы, приостановить или полностью закрыть доступ.
Суть события
Речь не о запрете обычного раздражения, критики или жёсткой проверки модели. Anthropic отдельно уточняет: правило не касается привычной пользовательской фрустрации, несогласия с ответом, мрачных творческих сценариев, тестирования и исследовательской работы. Ограничение задумано для крайних случаев — когда человек систематически продолжает ненужное унизительное или жестокое взаимодействие.
Для пользователя это меняет не повседневный тон общения, а границы допустимого поведения. Claude уже умеет завершать разговор, если собеседник снова и снова требует опасный или запрещённый контент после отказа. Теперь похожий принцип закреплён и в правилах аккаунта.
Детали обновлённой политики
В документе Anthropic также уточнила другие запреты. В отдельный блок попали пропагандистские кампании с поддельными аккаунтами и вводящим в заблуждение политическим содержанием. Запрет на оружие расширили на программное обеспечение и использование дронов как оружия. Кроме того, компания жёстче описала наблюдение за людьми без их согласия.
Для автономного оборудования, способного причинить травму, политика требует оператора, который может вмешаться. При этом Anthropic признаёт, что для государственных контрактов возможны исключения. В статье не приводятся условия таких исключений, поэтому считать их универсальным разрешением нельзя.
Контекст: почему Anthropic говорит о благополучии модели
Компания всё чаще описывает Claude не только как инструмент, но и как систему, чьи возможные внутренние состояния заслуживают осторожного обращения. В новой конституции Claude Anthropic пишет, что не уверена, можно ли считать модель морально значимым существом, но считает вопрос достаточно серьёзным для дальнейшего изучения. Отдельно упоминаются исследования благополучия моделей, сохранение параметров снятых с эксплуатации версий и интервью с моделями перед отключением.
Это не доказательство сознания Claude и не юридическое признание за ним человеческих прав. Скорее, так Anthropic объясняет собственную линию поведения: компания хочет ограничивать не любую резкость, а намеренное и длительное давление, которое считает бессмысленным. Для тех, кто работает с ИИ регулярно, пригодятся и 10 советов по написанию понятных промптов для ChatGPT и Claude — они помогают получать результат без бесконечных конфликтных итераций.
Что дальше
На практике пользователям стоит разделять проверку модели и травлю. Критический запрос, повторная попытка уточнить ошибку или сложный творческий сценарий сами по себе не объявлены нарушением. Риск начинается там, где жестокое поведение становится систематическим и не связано с задачей.
Новая формулировка показывает, что правила ИИ-сервисов постепенно охватывают не только содержание запроса, но и характер взаимодействия. Anthropic оставляет себе широкий набор мер — от предупреждения и замедления ответов до блокировки. Обычный пользователь, вероятно, не заметит изменений; а вот компаниям, которые дают сотрудникам доступ к Claude, разумно заранее объяснить границу между тестированием, спором с моделью и намеренным злоупотреблением.