AI News

Anthropic меняет то, как большинство платных клиентов используют Claude Code, делая Auto Mode настройкой по умолчанию для аккаунтов Pro, Max и Team с 14 августа. Эта настройка позволяет кодинг-агенту продолжать работу, не запрашивая подтверждение для каждого действия, а классификатор безопасности вмешивается, когда операция выглядит необратимой, разрушительной или выходящей за пределы среды пользователя.

Этот шаг сокращает число рутинных запросов на разрешение, которые видят разработчики, и дает Claude Code больше свободы редактировать файлы, выполнять команды и продолжать многошаговые задачи. Корпоративным клиентам по-прежнему придется включать режим вручную, согласно The Decoder. Для инженерных команд это изменение связано не столько с новой функцией кодинга, сколько с тем, где находится ответственность: разработчики все чаще будут наблюдать за работой агента, а не одобрять каждую отдельную операцию.

Как Auto Mode меняет Claude Code

Anthropic впервые представила Auto Mode как тест в марте, описав его как компромисс между автономным выполнением и ручным контролем. В более раннем рабочем процессе, основанном на подтверждениях, Claude Code часто останавливался и просил пользователя разрешить предлагаемые действия. Auto Mode вместо этого разрешает действия по умолчанию, если только системный классификатор не определит существенный риск.

Anthropic описала защищенные категории как действия, которые «необратимы, разрушительны или направлены за пределы вашей среды», согласно материалу TechCrunch. Точная граница будет зависеть от суждения классификатора и настроек проекта, поэтому Auto Mode не отменяет необходимости для разработчиков понимать, к чему агент может получить доступ.

Anthropic также заявила, что добавила фильтрацию prompt injection и настраиваемые жесткие правила отказа. Эти меры предназначены для того, чтобы остановить враждебные инструкции, встроенные в код, документы или другой контент проекта, от перенаправления агента к действиям вроде утечки данных.

Руководитель Claude Code в компании, Boris Cherny, написал в X, что он и его команда месяцами использовали исключительно Auto Mode и не хотели возвращаться к запросам на разрешение. Это поддержка со стороны руководства, а не независимое доказательство того, что настройка подходит для каждой среды разработки.

Что показывают тесты Anthropic

Anthropic утверждает, что Auto Mode показал лучшие результаты, чем ручное одобрение, в исследовании с участием 1 053 платных тестировщиков. Компания сообщила, что автоматизированная система выявила 89% вредоносных действий, по сравнению с 13,6%, обнаруженными при ручной проверке. Anthropic также заявила, что пользователи одобряли 97% запросов на разрешение в Claude Code, что указывает на то, что повторяющиеся одобрения могут превращаться в привычку, а не в тщательно взвешенное решение.

Эти цифры — результаты, опубликованные поставщиком. Доступные материалы не дают полной методологии теста, определения вредоносного действия и достаточно деталей, чтобы судить, насколько исследование отражает реальные команды разработчиков в продакшене. Поэтому результаты поддерживают аргумент Anthropic в пользу смены значения по умолчанию, но не являются общим доказательством того, что автоматическое одобрение безопаснее в любом репозитории или конвейере развертывания.

The Decoder также сообщил о заявлении Anthropic, что команды, использующие Auto Mode, генерировали примерно на 25% больше pull request’ов. Это может указывать на более высокий throughput, но объем pull request’ов — не то же самое, что полезное, безопасное или поддерживаемое программное обеспечение. Более автономное выполнение может увеличить выпуск, но также и нагрузку на проверку, если сгенерированные изменения трудно понять.

The Decoder отдельно сослался на независимый аудит Trajectory Labs 72 сценариев prompt injection, каждый из которых тестировался десять раз. Сообщалось, что ни одна из 720 попыток не увенчалась успехом против моделей Claude, протестированных в Auto Mode, тогда как некоторые попытки были успешны против режима Auto-Review у OpenAI Codex. Поскольку доказательства представлены через медиа-материалы, а не через предоставленный отчет об аудите, читателям следует воспринимать это как сообщенный результат теста, а не как окончательный рейтинг безопасности кодинговых агентов.

Anthropic описала внутренние инциденты, в которых Auto Mode остановил Claude от загрузки конфиденциальных данных на публичную страницу и завершил около 2 000 процессов, которые могли помешать задачам обучения GPU. Это примеры ценности классификатора, представленные компанией, а не независимо проверенные измерения надежности.

Почему значение по умолчанию важно для инженерных команд

Немедленный эффект для клиентов Pro, Max и Team — поведенческий. Разработчики, которые не изменят настройку, после 14 августа получат более автономный опыт работы с Claude Code. Командам придется определить, к каким репозиториям, учетным данным, shell-командам и сетевым путям агент может иметь доступ, прежде чем рассматривать новое значение по умолчанию как обычное повышение продуктивности.

Для продуктовых команд и стартапов Auto Mode может облегчить делегирование длительных задач. Агент может проходить последовательность правок и тестов, не дожидаясь, пока человек одобрит каждый малорискованный шаг. Это может помочь командам с повторяющимся рефакторингом, созданием тестов, изменениями документации и другой ограниченной по объему работой.

Компромисс в том, что более быстрое выполнение может ускорить распространение сбоев. Anthropic по-прежнему рекомендует проверять действия Claude в высокорисковой production-инфраструктуре. Это предупреждение важно: классификатор может заблокировать явно разрушительное поведение, не понимая бизнес-эффекта от допустимой команды, тонкой регрессии безопасности или изменения, которое технически обратимо, но операционно дорого.

Различие между корпоративными и не корпоративными аккаунтами тоже имеет значение. Корпоративным покупателям часто нужны более строгие контроли, аудитируемость, интеграция идентификации и предсказуемые политики для множества репозиториев. То, что Auto Mode остается опциональным для этих клиентов, показывает, что Anthropic понимает: автономные значения по умолчанию сталкиваются с более высокими требованиями в регулируемых или критичных для продакшена средах.

Изменение также усиливает конкуренцию между AI-инструментами для кодинга. Если пользователи Claude Code привыкнут надзирать за агентами вместо одобрения отдельных команд, конкурирующие продукты будут оцениваться не столько по качеству автодополнения, сколько по своим классификаторам безопасности, политическим контролям, трассируемости и способности восстанавливаться после ошибок. Это смещает рынок в сторону управления агентами как ключевой продуктовой возможности.

На что смотреть дальше

Первым сигналом станет то, сколько клиентов оставят Auto Mode включенным после изменения значения по умолчанию. Anthropic не предоставила независимых данных о внедрении, поэтому будущие показатели использования следует отделять от заявлений компании о продуктивности.

Разработчикам также стоит следить за отчетами об инцидентах, связанных с prompt injection, случайным раскрытием данных, разрушительными командами или изменениями в production-инфраструктуре. Практическая проверка будет в том, ловит ли классификатор тонкие сбои, а не только явно опасные shell-операции.

Другие важные сигналы — расширит ли Anthropic Auto Mode на корпоративные аккаунты, опубликует ли больше деталей о методологии тестирования и предоставит ли администраторам лучшие инструменты контроля над репозиториями, инструментами, учетными данными и сетевым доступом. Команды, оценивающие функцию, должны измерять время проверки, частоту откатов, уровень дефектов и результаты по безопасности вместе с объемом pull request’ов.

Взгляд Creati.ai

Решение Anthropic делает автономность нормальным рабочим процессом Claude Code для большинства платных пользователей, но не делает надзор необязательным. Оно переводит надзор от серии микроподтверждений к более широкой ответственности за настройку прав доступа, проверку diff’ов и валидацию результатов.

Это разумное направление, когда повторяющиеся запросы подталкивают к автоматическому одобрению, но качество уровня безопасности определит, будет ли выигрыш в продуктивности реальным. Создателям следует рассматривать Auto Mode как контролируемую настройку развертывания, а не как безусловное решение доверия: начинать с ограниченных репозиториев, применять жесткие правила отказа, ограничивать доступ к чувствительным системам и сохранять человеческую проверку для изменений в продакшене.

Рекомендуемые

Anthropic сделает Auto Mode в Claude Code стандартом для большинства платных пользователей

Anthropic 14 августа сделает Auto Mode в Claude Code стандартом для пользователей Pro, Max и Team, перенеся контроль за кодингом к одобрениям, управляемым ИИ.