ТЕХНОЛОГИИ

Anthropic делает Auto Mode режимом по умолчанию в Claude Code и повышает требования к безопасной автономности

Claude Code по умолчанию перейдёт в автоматический режим для платных пользователей. Поэтому практический вопрос теперь заключается не в том, могут ли агенты действовать, а в том, достаточно ли понятны их защитные механизмы для безопасной работы.

Патрик Т ·

Anthropic делает Auto Mode режимом по умолчанию в Claude Code и повышает требования к безопасной автономности
Mantis.

Anthropic сообщает, что автоматический режим Claude Code станет режимом по умолчанию для учетных записей Pro, Max и Team с 14 августа, что является продуктовым решением, которое продвигает AI-агентов кодирования на один шаг дальше от постоянного контроля по каждому клику. Компания сообщает, что режим работает без запроса разрешения, если действие не является необратимым, разрушительным или направленным за пределы среды пользователя.

Изменение связано скорее не с новой моделью, а с новым контрактом на работу. Агенты для кодирования полезны, когда они могут просматривать репозиторий, планировать работу, вносить изменения и проверять результат без необходимости, чтобы разработчик одобрял тривиальные шаги. Но каждый пропущенный запрос из этого процесса переносит больше ответственности на границы вокруг агента: репозиторий, который он может видеть, учетные данные, которые он может использовать, и действия, которые остаются невозможными без участия человека.

Кодировочные агенты становятся полезными в производстве, когда их права видимы, ограничены и обратимы. Изображение: Mantis.
Кодировочные агенты становятся полезными в производстве, когда их права видимы, ограничены и обратимы. Изображение: Mantis.

Anthropic сообщил, что тесты с участием 1 053 платных пользователей показали, что автоматический режим выявил 89% вредоносных действий, по сравнению с 13,6% при ручной проверке. Это поразительное сравнение, но оно не отменяет необходимость проверки. Подсказка, которую люди одобряют по привычке, является слабым контролем; автоматический классификатор также может давать сбои так, что команда обнаружит их только после того, как ему будет предоставлена полномочия.

Компания также указала на проверку на внедрение подсказок и настраиваемые правила строгого отказа. Эти функции имеют значение, потому что программные проекты представляют собой связанные системы. Ассистент по программированию может сталкиваться с документацией, текстами проблем, сторонними пакетами и выводом инструментов, которые он не создавал и которым не может безопасно доверять.

Для руководителей инженерных команд настоящим испытанием является не то, сохраняет ли автоматический режим несколько утверждений. Истинная проверка заключается в том, может ли команда объяснить, что сделал агент, быстро остановить его и восстановиться, если он выбрал неправильный путь. Автономность по умолчанию будет заслуживающей доверия только тогда, когда эти ответы станут рутинными.

Темы: Anthropic, Claude Code, ИИ-агенты

Канонический адрес статьи