Материал рассказывает про обновление в Claude Code — ИИ-агенте для программирования от компании Anthropic. Они сделали так, что у большинства планов теперь по умолчанию включён «авто-режим», который сам решает, принимать ли к выполнению подозрительные команды без частого вмешательства человека. Компания уверена: этот режим существенно лучше защищает от типичных угроз работы с ИИ-кодингом, например, от опасных команд и кибератак, чем если бы решения принимал живой человек.
Что такое авто-режим и почему это важно
Auto mode — это настройка, при которой ИИ-кодер самостоятельно оценивает команды, а не спрашивает пользователя подтвердить каждое действие. На практике это значит: если кто-то пытается подсунуть вредоносную команду (например, «удалить важные файлы» или «передать данные злоумышленнику»), авто-режим с большой вероятностью её заблокирует.
Насколько авто-режим надёжен на самом деле
Anthropic провели масштабные тесты: привлекли 1,053 платных тестировщиков, которые получили опасную команду в середине работы. Только 13.6% из них отказались от вредоносного действия — большинство просто нажали «ОК», усталые от постоянных запросов. А авто-режим бы заблокировал 89% таких попыток. Значит, в 89 случаях из 100 авто-режим работает лучше человека.
Однако и у авто-режима есть сложные случаи — 11% опасных действий он может не остановить. Поэтому полностью полагаться на него и не думать о безопасности нельзя.
Защита от внедрения вредоносных инструкций (prompt injection)
Особая проблема — когда злоумышленник прячет опасные инструкции внутри обычного текста или кода, который ИИ потом «читает» и выполняет, не подозревая подвоха. Anthropic утверждает, что в режиме авто-режима их модели Claude Code практически неуязвимы к таким атакам. В тестах 720 попыток внедрения не удалось ни одной успешной атаки.
Где проходит граница доверия к авто-режиму
Если вы обычный пользователь ИИ для программирования или автоматизации, то авто-режим Claude Code — это очень полезное обновление. Вам не придётся постоянно подтверждать каждое действие, снижая утомляемость и риски ошибочного одобрения опасных команд.
Однако полностью расслабляться не стоит. Важно контролировать, какие пакеты, скрипты или команды ваш ИИ-агент выполняет, особенно если они получены из неизвестных или сторонних источников. Полная безопасность пока недостижима, и автоматическая защита — лишь первый, но важный уровень.
Чтобы глубже понять, как безопасно работать с ИИ-агентами и защититься от большинства угроз, полезно изучить полный гид по OpenClaw и следить за новостями в разделе новостей OpenClaw. Если интересны практические советы по защите и надежности — обратите внимание на статью Как обновление OpenClaw 2026.6.34 сделает работу вашего ИИ-агента надежнее и безопаснее.
Источник
Материал основан на статье Симона Уилсона «Auto mode is now the default in Claude Code for Pro, Max, and Team plans» (2026), https://simonwillison.net/2026/Aug/8/auto-mode. Автор оригинала подробно обсудил результаты тестов и возможности авто-режима в мероприятии AI Engineer World’s Fair.
Другие случаи, когда агент вышел за рамки ожидаемого: обновление безопасности Datasette и инцидент с Hugging Face.