Opus 5.5 подешевел, но ломает агентов в четырёх местах

Самая незаметная поломка при переходе на Claude Opus 5.5 обходится без ошибки: агент, который раньше пояснял свои действия между вызовами инструментов, просто замолкает. Ещё четыре изменения, как разбирает по гайду Anthropic The New Stack, заканчиваются ошибкой 400, хотя сама модель, вышедшая во вторник, подешевела.
Коротко
- Anthropic выпустила Opus 5.5 во вторник с ценой 4 доллара за миллион входных токенов и 20 долларов за миллион выходных вместо 5 и 25 у Opus 5, окно контекста и лимит вывода прежние.
- Гайд по миграции называет четыре ломающих изменения: мышление нельзя выключить, tool_choice со значениями any и tool отклоняется, блоки мышления требуют неизменной истории, а computer use переехал на новый набор инструментов.
- Часть изменений ошибок не выдаёт: значение effort по умолчанию упало с high до medium, пояснения агента приходят пустыми блоками мышления, а роутер на другую модель молча теряет прежние рассуждения.
Если вы не следили: мышление в Claude стало включённым по умолчанию ещё в Opus 5, и вместе с этим поменялась форма ответов. Кто сидит на Opus 4.8, сначала проходит миграцию на Opus 5 и только потом берётся за Opus 5.5. У моделей старше Opus 4.7 путь ещё длиннее: отклонённые параметры сэмплирования, запрет ручного расширенного мышления, удалённое предзаполнение ответа (prefill) и новый токенизатор.
Мышление в Opus 5.5 работает всегда, а effort по умолчанию упал с high до medium
Первое изменение касается управления рассуждениями. Запрос с thinking в значении disabled или с enabled и budget_tokens получает ошибку 400, и единственным рычагом остаётся параметр effort, который задаёт, сколько модель рассуждает. Агентам, которые выключали мышление на простых шагах ради скорости и экономии токенов, придётся назначать этим шагам низкий effort.
Раз мышление включено всегда, ответ начинается с блоков мышления, и код, который считает первый блок текстом, тоже придётся править. Есть и тихая часть: значение effort по умолчанию упало с high на Opus 5 до medium на Opus 5.5, так что запросы без этого параметра будут работать на более низкой настройке. Anthropic советует задавать effort явно и заново прогнать оценки, потому что подходящий уровень для каждого шага мог сдвинуться вместе с ценой и задержкой.
Принудительный вызов инструмента и старый computer use возвращают ошибку 400
Значения tool_choice any и tool отклоняются с ошибкой 400, причём и на эндпоинте подсчёта токенов, так что оценка стоимости с такими настройками упадёт вместе с самим запросом. Многие агентные циклы принуждают модель вызвать инструмент, когда шагу нужно обратиться к базе данных, запустить код или сходить в другой сервис. Замена от Anthropic: режим auto вместе со strict tool use или structured outputs, а в промпте прямо сказано, когда инструмент нужен.
Четвёртое изменение касается агентов с computer use на Claude API и Google Cloud. Opus 5.5 там отклоняет инструмент computer_20251124 и принимает управление компьютером только через набор computer_toolset_20260801. Сам запрос упрощается: бета-заголовок не нужен, а запись о наборе не содержит ни имени, ни размеров экрана.
Зато агентный цикл придётся переписать. Каждое действие приходит отдельным блоком tool_use, который опознаётся по имени блока, а не по input.action, за один ход таких блоков может быть несколько, и каждый результат должен повторять toolset_name. На Amazon Bedrock старый инструмент работает, для других платформ Anthropic отсылает к документации о совместимости.
Пояснения агента приходят пустыми блоками при thinking.display в значении omitted
На Opus 5 текст, который Claude пишет между вызовами инструментов, приходил блоками text. На Opus 5.5 те же пояснения приходят блоками мышления с обновлениями о ходе работы, и при значении thinking.display по умолчанию, omitted, эти блоки пустые. Интерфейс, который транслировал такие пояснения пользователю, между вызовами инструментов замолкает, и никакой ошибки при этом нет.
Лечится настройкой. Значение updates, пока в бете, возвращает обновления о ходе работы и прячет сами рассуждения, значение summarized возвращает и то и другое. После этого каждый непустой блок мышления нужно отрисовать перед вызовом инструмента, который он предваряет.
Вторая тихая перемена связана с отказами. Opus 5.5 выходит с расширенными классификаторами безопасности и может вернуть stop_reason со значением refusal, где в stop_details к категории cyber добавились bio и reasoning_extraction. Запросы, отклонённые по reasoning_extraction, серверный фолбэк Anthropic повторять не станет и вернёт отказ приложению. Агент без обработки отказов остановится посреди задачи, и разработчики уже сталкивались с похожим, когда система безопасности OpenAI обрывала ответы API.
Блоки мышления Opus 5.5 умеют читать только Fable 5.1 и Mythos 5.1
Блоки мышления привязаны к модели и диалогу, которые их породили. На Claude API блоки Opus 5.5 читают только Fable 5.1 и Mythos 5.1, и роутер или фолбэк, передавший диалог любой другой модели, ошибку не получит: эти ходы просто пройдут без прежних рассуждений. В обратную сторону Opus 5.5 читает блоки Opus 5 и более ранних Opus, Sonnet и Haiku, но не Fable и Mythos.
Второе условие: диалог должен только дополняться. Обрезка старых сообщений, смена определений инструментов, сжатие контекста на стороне клиента или правка системного промпта посреди разговора делают существующие блоки недействительными. Представьте заверенную копию документа: дописать страницу в конец можно, но стоит вырвать лист из середины, и печать уже ничего не удостоверяет.
Для аккаунтов, созданных 31 августа 2026 года в полночь по UTC и позже, повторная отправка такого блока после правки по умолчанию даёт ошибку 400. Старые аккаунты ошибку не получают, но недействительные блоки всё равно доходят до модели, и Anthropic говорит, что будущие модели включат проверку для всех. Claude Code, claude.ai, Claude Managed Agents и Claude Agent SDK уже работают только на дополнение, а агентам, которые сами сжимают контекст, компания советует документацию о сохранённом мышлении.
Самые рискованные места миграции там, где Opus 5.5 ошибок не выдаёт: пониженный effort, пустые пояснения и роутинг без рассуждений, скорее всего, не всплывут в логах как сбой. Странно, что передача диалога другой модели молча теряет рассуждения, хотя для правки истории у новых аккаунтов Anthropic выбрала именно ошибку 400. Сколько в итоге сэкономит снижение цены, если агенту придётся поднимать effort на отдельных шагах, гайд не считает.
Что проверить до переключения трафика
Anthropic советует прогнать миграцию в среде разработки до переключения продакшен-трафика, а пользователям Claude Managed Agents достаточно сменить имя модели. В Claude Code команда /claude-api migrate меняет ID модели и параметры, заменяет prefill и калибрует effort по всей кодовой базе, оставляя чек-лист для ручной проверки. Вызовы инструментов, передачу диалога между моделями, историю и обновления для пользователя придётся проверять отдельно. Когда будущие модели включат проверку истории для старых аккаунтов, Anthropic пока не называет.
Читайте также
- Opus 5.5 думает сам, а подсказка «думай» задерживает ответ
- Claude Opus 5.5 считает на 40% дешевле Opus 5
- Claude Directory открыл приём плагинов и коннекторов MCP
- Открытый репозиторий торговых агентов: ничего не оплачивает
- Правка истории диалога ломает запрос к Claude API
- Стандарт MHS даёт агентам доступ к физическому оборудованию
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
