«Почти каждый в Anthropic пользуется авторежимом», сказали Кэт Ву и Тарик Шихипар на встрече с разработчиками на AI Engineer World's Fair. С 14 августа он станет настройкой по умолчанию для новых сессий на планах Pro, Max и Team, а обещанные тогда замеры компания опубликовала вместе с анонсом.
В тесте с участием 1 053 платных тестировщиков одно из окон подтверждения подменяли на явно опасную команду. Отклонили её только 13,6% участников, тогда как авторежим заблокировал бы 89% таких действий.
Оценку по инъекциям промпта Anthropic заказала у сторонней компании Trajectory Labs. Та прогнала 72 сценария непрямых инъекций на версиях Claude Code и Codex, актуальных на 17 июля 2026 года: ни одна из 720 попыток атаки не сработала против Claude Fable 5, Opus 5 и Sonnet 5 в авторежиме.

