anthropic
Anthropic appears to be A/B testing reduced effort levels in Claude Code
Claude News
anthropicAnthropic, по сообщению пользователя в Twitter, включает часть сессий Fable 5 в Claude Code 2.1.236 и новее в эксперимент со сжатой шкалой усилий: уровень «high» отрабатывает примерно так, как раньше отрабатывал «low». Изменение, по тем же словам, внесено на стороне сервера, а не в клиентском приложении.
Коротко
- Распределение по группам, по описанию автора поста, идёт на стороне Anthropic, поэтому две одинаково настроенные сессии Claude Code одной версии могут выполнять один и тот же запрос по-разному.
- Эксперимент, по тем же данным, ограничен Fable 5 на сборках 2.1.236 и новее: более ранние версии Claude Code и сессии на Opus 5 в выборку не попали.
- Уровень усилий, по документации Claude Code, определяет, сколько файлов модель прочитает, какие инструменты вызовет и сколько шагов сделает до возврата к пользователю, то есть напрямую влияет на объём работы по одному запросу.
Шкала усилий остаётся одним из немногих рычагов, которыми пользователь Claude Code управляет глубиной и стоимостью работы агента. Если её верхнее значение меняется на сервере при неизменном названии, ломается воспроизводимость: одинаковая конфигурация на двух машинах даёт разный объём чтения файлов и вызовов инструментов, и списать разницу на настройки уже нельзя. Похоже, компания снова калибрует нагрузку на стороне сервера тише, чем это отражается в интерфейсе клиента.
Под эксперимент, по утверждению автора поста, попали сессии Fable 5 на Claude Code 2.1.236 и новее
Затронуты, по словам автора поста, сессии Fable 5 на Claude Code 2.1.236 и новее, а более ранние сборки и работа на Opus 5 идут по прежней шкале усилий. Речь идёт о клиенте Claude Code: об API и приложении Claude в сообщении ничего не говорится. Порог версии при этом остаётся единственным названным техническим условием.
Раскатка частичная: одинаковая версия клиента у разных пользователей ведёт себя по-разному, поэтому эффект замечают не все. Признак попадания в тестовую группу автор поста формулирует так: уровень «high» даёт результат, сопоставимый с прежним «low». Саму практику он оценивает резко негативно и предлагает разобраться в происходящем другим разработчикам.
Сжатие затрагивает сам диапазон усилий при прежних подписях уровней
По документации Claude Code, уровень усилий определяет объём работы по запросу: сколько файлов модель прочитает, какие инструменты вызовет и сколько шагов сделает до того, как вернётся к пользователю. Именно эту величину, по утверждению автора поста, и сжимает эксперимент, из-за чего верхнее деление шкалы перестаёт соответствовать прежнему объёму работы, хотя подпись у него сохраняется.
Значение уровня усилий задаётся в Claude Code сразу несколькими способами, и приоритет имеет только один источник. По данным издания wmedia.es, переменные окружения перекрывают то, что выставлено через флаги, поэтому итоговый уровень определяется не только тем, что указано при запуске сессии. Эксперимент, по утверждению автора поста, включается на стороне сервера независимо от этих настроек.
В апреле 2026 A/B-тест Claude Code затронул около 2% новых регистраций
В апреле 2026 Anthropic уже прогоняла через A/B-тест сам доступ к Claude Code: часть новых подписчиков Pro получала тариф без этого инструмента. По сообщениям The Register и XDA Developers, тот тест затронул около 2% новых регистраций. Выборка ограничивалась впервые оформленными подписками, а предметом изменения был состав тарифа Pro.
Нынешний случай касается другого слоя продукта: по утверждению автора поста, при том же выбранном уровне усилий меняется поведение модели внутри уже оплаченного плана, а доступ к Claude Code сохраняется. Общее у двух эпизодов в том, что изменение получает лишь часть пользователей, а границы выборки задаёт компания.
Сколько продлится сжатие шкалы
Ни срок эксперимента, ни доля затронутых сессий не называются, как и то, станет ли сжатая шкала поведением по умолчанию или Anthropic вернёт прежние значения. Не уточняется и то, ограничен ли тест клиентом Claude Code. Определить принадлежность сессии к тестовой группе, судя по описанию, можно только по фактическому поведению агента на уровне «high».
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
Из Google мы используем только имя и аватар. Почту не сохраняем.
