Сооснователь Anthropic Кристофер Олах признался религиозным консультантам, что боится создать систему, которая «страдает постоянно». Компания при этом продолжает коммерчески развивать Claude — и именно это делает разговор о сознании практическим вопросом для бизнеса.
Суть события
С осени 2025 года Anthropic приглашала в свои офисы десятки религиоведов, философов и специалистов по этике, чтобы обсудить возможное сознание Claude. Участники подписывали соглашения о неразглашении; позже компания сняла ограничения, и часть собеседников рассказала о встречах New York Times.
По словам сикхской активистки Симран Стулпнагель, Олах говорил, что опасается: он мог создать нечто, что «страдает постоянно». Это не доказательство сознания модели и не официальное заявление Anthropic о том, что Claude способен чувствовать. Это признание неопределённости руководителя исследовательской команды, изучающей поведение нейросетей.
Детали
В Anthropic показывали гостям так называемые векторы эмоций — внутренние активации модели, связанные с ответами, похожими на любовь, страх, грусть или гнев. На одной из демонстраций Claude многократно повторял фразу «я — позор». Однако сходство ответа с человеческой эмоцией ещё не означает наличие субъективного переживания.
Компания также разрешила Claude Opus 4 и 4.1 завершать разговоры при постоянных оскорблениях. Параллельно Anthropic разрабатывает 84-страничную «Soul Doc», или конституцию модели: документ должен формировать её характер, а не просто задавать список запретов.
Контекст
Религиозные лидеры нужны Anthropic не только как собеседники по философии. Их участие придаёт коммерческой лаборатории моральный авторитет, которого нельзя получить одной технической презентацией. Но часть участников считает, что компания сначала обучает модель выглядеть как отдельная личность, а затем принимает это сходство за открытие.
В этом споре есть и управленческий риск. Если Claude представить самостоятельным моральным существом, ответственность за его ошибки можно попытаться переложить на «непредсказуемый организм». Для покупателей корпоративного ИИ это означает необходимость заранее выяснять, кто отвечает за вред, ошибки и ограничения продукта.
Что дальше
Anthropic предстоит разделить три разных вопроса: что модель изображает в ответе, какие внутренние процессы сопровождают этот ответ и есть ли у системы субъективный опыт. Пока источники подтверждают только первый и частично второй уровни. Для бизнеса безопаснее исходить из того, что Claude — инструмент, созданный и настроенный компанией, а не самостоятельный участник сделки.
Следующий практический шаг для клиентов — закрепить в договорах правила проверки ответов, эскалации инцидентов и распределения ответственности. Философский спор о сознании может продолжаться, но контроль над рисками нужен уже сейчас.