aiminute. ← Все новости ИИ
Инструменты 2026-08-10

Anthropic изучила 1053 разработчика, жмущих «одобрить»: они замечали 13,6% опасных команд — поэтому 14 августа руль переходит к машине

Anthropic изучила 1053 разработчика, жмущих «одобрить»: они замечали 13,6% опасных команд — поэтому 14 августа руль переходит к машине

С 14 августа Claude Code будет по умолчанию работать в автоматическом режиме у всех на тарифах Pro, Max и Team. Автоматический режим означает, что агент перестаёт спрашивать разрешение перед каждой записью файла и каждой командой оболочки, а вместо этого пропускает каждый вызов инструмента через классификатор, который блокирует всё необратимое, разрушительное или направленное за пределы вашей машины. Anthropic опубликовала цифры, стоящие за этим решением. В контролируемом исследовании с 1053 платными тестировщиками люди, разбиравшие запросы вручную, распознали 13,6 процента предъявленных им опасных команд; автоматический режим заблокировал 89 процентов. В реальных рабочих сессиях доля непреднамеренных вредоносных действий при ручном одобрении более чем вдвое превышала показатель автоматического режима — 6,3 процента против 2,4. Объяснение умещается в одну цифру: разработчики одобряют 97 процентов показанных им запросов, а это не проверка, это щелчок мышью. Вместе с переключением Anthropic добавила жёсткие правила запрета на утечку данных, проверку того, идёт ли git push в публичный или частный репозиторий, контроль состояния git перед разрушительными операциями и просмотр внешнего содержимого на предмет внедрения инструкций. Заблокированное действие отправляет Claude искать более безопасный путь; после достаточного числа блокировок подряд сессия возвращается к режиму вопросов. Токены самого классификатора на этих трёх тарифах больше не оплачиваются. Enterprise, API, Bedrock, Google Cloud и Microsoft Foundry пока остаются на добровольной основе, и Anthropic говорит, что рассчитывает сделать режим стандартным и там в течение месяца.

Почему это важноЛюбопытно не то, что компания выпустила более автономную настройку по умолчанию. Любопытен довод, которым это оправдано, потому что он переворачивает привычный. Запросы разрешения задумывались, чтобы человек оставался в цепочке принятия решений; собственная телеметрия Anthropic говорит, что человек в этой цепочке — резиновая печать, а машина, читающая те же команды, примерно в шесть раз лучше ловит плохие. Это рассуждение выходит далеко за пределы одного продукта: каждое окно согласия, каждое «вы уверены?», каждая очередь на утверждение в программном обеспечении держится на допущении, что если вас спросили, вы посмотрите. Если вы работаете в Claude Code на платном тарифе, практическая суть такова: ваша настройка меняется 14 августа независимо от того, читали вы объявление или нет, и решать лучше сейчас, а не обнаруживать потом — можно закрепить другой режим разрешений, а администраторы могут закрепить его для всей команды. Честная оговорка: 89 процентов — это не 100, и теперь сбои беззвучны. При старой настройке для ошибки требовалось, чтобы вы щёлкнули. При новой не требуется никто.
#Программирование#ИИ-агенты

✓ Проверено · 4 источников

▶ Видео по теме: How auto mode works with Claude Code
WhatsApp X Telegram
Читайте в приложении — бесплатно, 9 языков

Похожие новости

Apple Music будет сообщать, что песню сделала машина, — но говорить об этом или нет, решает тот, кто её загружает
2026-08-21
Слух: анонимная модель, бесплатно возглавившая тест по программированию, якобы является невыпущенным флагманом Zhipu
2026-08-21
Дешёвая рабочая лошадка DeepSeek научилась видеть — и на агентных задачах, где нужны глаза, заявляет о приближении к лучшему у Anthropic
2026-08-21
Nvidia платит 6 миллиардов долларов за машину, которая строит модели конкурента, — и нанимает 109 человек, которые ею управляли
2026-08-21
Stripe только что заплатила 7,5 миллиарда за маршрутизатор моделей. Через несколько дней Ramp собрала свой и раздаёт его бесплатно до января.
2026-08-21