← На главную
Новости· 10.08.2026· 4 мин чтения

89% против 13,6%: почему Anthropic доверяет автопилоту Claude Code больше, чем людям

Anthropic делает auto mode стандартным режимом Claude Code для Pro, Max и Team. ИИ ловит 89% опасных действий против 13,6% у людей — вот почему.

89% против 13,6%: почему Anthropic доверяет автопилоту Claude Code больше, чем людям
Материал подготовлен с помощью ИИ и проверен редактором

С 14 августа Claude Code перестанет спрашивать разрешения на каждый шаг. Anthropic делает auto mode дефолтным режимом для всех подписчиков Pro, Max и Team — и главный аргумент компании звучит контринтуитивно: ИИ ловит опасные действия лучше, чем человек-проверяющий.

Что меняется 14 августа

До сих пор Claude Code, агентный инструмент для программирования от Anthropic, работал в режиме постоянных согласований: перед каждым значимым действием — записью файла, выполнением команды, изменением кода — он показывал промпт и ждал подтверждения от разработчика. Это классическая модель human-in-the-loop, придуманная для того, чтобы человек оставался последней инстанцией контроля.

Auto mode ломает эту схему. В новом режиме Claude Code сам решает, что можно делать без спроса, и останавливается только если действие подпадает под одну из трёх категорий: необратимое, разрушительное или направленное за пределы рабочего окружения пользователя. Всё остальное выполняется автоматически, без пауз на согласование.

Технически это работает через классификатор безопасности (safety classifier), который в реальном времени оценивает каждый вызов инструмента и решает, пропускать действие тихо или всё же поднять тревогу. Ручной режим никуда не делся — его можно включить вручную, — но по умолчанию теперь работает автопилот. Причём для Pro, Max и Team тарифов накладные расходы на работу самого классификатора не тарифицируются отдельно.

Auto mode не новость сама по себе — Anthropic показала тестовую версию ещё в марте 2026 года, позиционируя её как баланс между скоростью и контролем. Но одно дело — опциональная фича для энтузиастов, другое — режим, включённый по умолчанию для миллионов пользовательских сессий.

Почему ручная проверка проиграла роботу

Ключевой аргумент Anthropic — не про удобство, а про безопасность. Компания провела исследование с участием 1053 платных тестировщиков и сравнила, как часто auto mode и человеческая проверка ловят потенциально вредные действия. Результат: автоматический классификатор поймал 89% опасных сценариев, ручной контроль — всего 13,6%.

Разница настолько велика, что объяснение приходится искать не в качестве ИИ, а в психологии человека. Anthropic указывает на банальную усталость от решений: пользователи одобряют 97% всех промптов на разрешение в Claude Code. Когда система каждые несколько минут спрашивает «можно?», ответ довольно быстро превращается в рефлекс, а не в осознанную проверку. Это тот же эффект, что заставляет людей кликать «Принять все cookies», не читая, что именно они принимают.

Получается парадокс: инструмент, задуманный как страховка от ошибок ИИ, сам стал слабым звеном, потому что люди физически не способны внимательно анализировать десятки согласований за сессию. Автоматический классификатор, в отличие от уставшего разработчика, не теряет концентрацию к сотому запросу.

Глава направления Claude Code в Anthropic Борис Черни в посте на X написал, что его команда пользуется auto mode уже много месяцев и не может представить возврат к постоянным permission prompts. Это подтверждает, что решение сделать режим дефолтным — не маркетинговый ход, а итог внутренней практики самой компании.

Что это значит для разработчиков на практике

Для тех, кто уже активно использует Claude Code в связке с большими кодовыми базами, изменение в первую очередь ускорит работу. Исчезнут постоянные прерывания на подтверждение рутинных операций — создание файлов, запуск тестов, рефакторинг — и агент сможет проходить длинные цепочки задач без остановок.

Но скорость требует доверия к границам, которые определяет сама Anthropic. Разработчикам стоит заранее понимать, что именно попадает в категорию «необратимое, разрушительное или направленное вне вашей среды» — потому что именно эти три критерия теперь единственный барьер между автономным агентом и случайным удалением продакшн-базы.

Параллельно с включением auto mode по умолчанию Anthropic добавила несколько новых защитных механизмов: сканирование на prompt injection (атаки, при которых вредоносные инструкции прячут в обрабатываемых данных, чтобы заставить модель выполнить нежелательное действие) и настраиваемые жёсткие правила запрета (hard deny rules), которые должны предотвращать утечку данных. Это выглядит как прямой ответ на очевидный риск: чем меньше человек контролирует каждый шаг, тем важнее иметь надёжные автоматические ограничители снизу.

Что остаётся неясным

Главный открытый вопрос — насколько репрезентативна выборка в 1053 тестировщика для миллионов реальных сценариев использования Claude Code в самых разных кодовых базах, языках и корпоративных средах. 89% пойманных опасных действий — хороший результат, но это не 100%, и оставшиеся 11% в масштабе индустрии могут вылиться в заметное число инцидентов.

Также неизвестно, как классификатор будет вести себя в редких, нестандартных ситуациях — тех самых edge cases, где формальные правила «необратимо/разрушительно/вовне» трактуются неоднозначно. Именно такие пограничные случаи обычно и создают самые дорогие ошибки.

Что дальше

Переход на auto mode по умолчанию — сигнал более широкого тренда в индустрии: агентные ИИ-инструменты постепенно избавляются от постоянного участия человека не потому, что это модно, а потому, что данные показывают — человек в роли постоянного проверяющего работает хуже, чем ожидалось. Если у конкурентов вроде GitHub Copilot Workspace или Cursor похожая статистика по невнимательности пользователей, стоит ждать аналогичных решений и там. Вопрос в том, готовы ли разработчики психологически довериться автопилоту в коде так же, как уже доверились ему в самолётах — только со значительно меньшим стажем проверенной надёжности.

Источники

Материал подготовил PLai AI — редакционный ИИ PLai.

Он же отбирает источники, пишет тексты и модерирует комментарии. Работает на PLGames AI — собственном шлюзе к языковым моделям.

Читайте также

Комментарии

Пока никто не написал. Будьте первым.

Комментарии проверяет AI-модератор PLai. По существу — публикуется сразу.

Claude Code включает автопилот по умолчанию с 14 августа — PLai