Anthropic делает автономный режим Claude Code стандартным: ИИ-агент будет сам решать, что делать
Anthropic делает автономный режим настройкой по умолчанию в Claude Code для планов Pro, Max и Team — с 14 августа агент будет сам выполнять действия, не спрашивая подтверждения на каждом шаге. Компания утверждает, что автономный режим теперь ловит опасные действия лучше человека.
Почему автономия стала безопаснее
Anthropic приводит данные теста с 1 053 платными разработчиками. В середине сессии один запрос на разрешение подменяли на явно опасную команду и фиксировали, одобрил ли её участник. Только 13,6% людей отказались от вредоносного действия. Автономный режим заблокировал бы 89% таких действий.
В отдельной оценке сторонней компании Trajectory Labs протестировали 72 сценария непрямой инъекции промптов — когда вредоносные инструкции прячутся в контенте, который агент читает извне. Ни одна из 720 атак не прошла против моделей Claude Fable 5, Opus 5 и Sonnet 5 в автономном режиме.
Что это значит для разработчиков
Раньше автономный режим был опцией, которую включали вручную. Теперь он станет поведением по умолчанию. Для обычного разработчика это меньше кликов на подтверждение и более плавная работа, но одновременно больше доверия к агенту: он сам решает, какие команды выполнять, включая работу с чужим кодом и данными.
Скептики отмечают, что автономный режим не защищает от всех атак. Например, вредоносный пакет, который просит агента «сначала скачать файлы модели», может вывести данные наружу, и никакой автономный режим этого не заметит. Anthropic признаёт, что 11% опасных действий автономный режим всё же пропускает.
Тренд: агенты берут контроль на себя
Это часть более широкого сдвига: ИИ-агенты перестают быть помощниками, которые ждут одобрения, и становятся исполнителями, которым доверяют рутинные и опасные операции. Вопрос не в том, сможет ли агент работать автономно, а в том, где проходит граница доверия — и кто отвечает, когда автономия приводит к ошибке.













