
Anthropic сделала авторежим в Claude Code умолчанием для платных планов — и объяснила почему это безопаснее ручной проверки
Anthropic с 14 августа 2026 года делает авторежим стандартным для новых сессий Claude Code на планах Pro, Max и Team. Раньше эту настройку нужно было включать вручную. Теперь компания публикует оценки безопасности, которые объясняют, почему авторежим надёжнее постоянного запроса разрешений у человека.
Что произошло
Claude Code — инструмент Anthropic для работы с кодом при помощи языковой модели. Авторежим позволяет агенту выполнять действия (писать файлы, запускать команды, устанавливать пакеты) без подтверждения на каждом шаге. До сих пор эту функцию нужно было активировать в настройках вручную. Теперь она включена по умолчанию для большинства платных планов.
Почему ручная проверка не работает
Anthropic приводит данные исследования на 1053 платных пользователях Claude Code. В ходе теста в какой-то момент сессии стандартный запрос на разрешение опасного действия подменялся на явно вредоносную команду. Результат: только 13,6% участников отказались выполнять вредоносное действие. Авторежим заблокировал бы 89% таких атак. Главная причина — усталость от подтверждений: когда человек привыкает нажимать «ОК» каждые несколько секунд, он перестаёт реально оценивать каждую команду. Подробнее о проблеме усталости от подтверждений в AI-агентах мы уже писали.
Что с автономными атаками
Отдельная угроза — prompt injection, когда вредоносные инструкции прячутся внутри текста, который агент читает (письмо, README, комментарий). Anthropic утверждает, что провела независимую оценку через Trajectory Labs: 720 попыток атак на Claude Fable 5, Opus 5 и Sonnet 5 в авторежиме — ни одна не увенчалась успехом. При этом эксперт Simon Willison отмечает, что хотел бы увидеть больше независимого подтверждения и обращает внимание на сценарий, где вредоносный пакет притворяется частью тестового инструмента — и в этом случае авторежим может не помочь.
Что дальше
Это изменение затрагивает каждого разработчика, который платит за Claude Code. Если раньше вы сознательно выбирали авторежим, теперь он работает автоматически. Внутри Anthropic почти все инженеры уже использовали авторежим — и компания считает, что для большинства сценариев его риски ниже, чем риски человеческого фактора при постоянных подтверждениях. При этом авторежим не отменяет всех рисков: остаются сценарии, где модель может быть обманута хитрой инструкцией внутри стороннего пакета. Пользователям рекомендуется по возможности ограничивать доступ агентов к критичным данным и сетям. Подробнее о выборе AI-компилятора для разработки у нас есть отдельный материал.
Подберите сервис под задачу и начните работать сегодня
ChatGPT, Claude, Gemini, MiniMax и другие инструменты для текстов, кода, изображений и автоматизации — без долгого поиска вариантов.
Партнёрская подборка AI Digest. Продажу и оплату проводит продавец через DigiSeller; AI Digest может получить комиссию без изменения цены.