Перейти к содержанию

prompt-engineering

Anthropic советует удалить из промптов «думай внимательно»

Claude News

Первый совет в новом гайде Claude по Opus 5.5 касается уборки в промптах: вычеркните «think carefully» и «think step by step» из запросов и сохранённых инструкций. Opus 5.5 думает перед каждым ответом и сам решает, сколько. В тестах Anthropic на чат-продукте без такой строчки ответы начинались раньше, а заметной потери качества не нашли.

Коротко

  • Anthropic опубликовала практическое руководство по Opus 5.5 для приложений Claude и Claude Code: как ставить задачу, вести многочасовой прогон, проверять результат и что делать, если сообщение пометила защита.
  • Главная механика гайда: одна задача целиком, явная финишная черта вроде «тесты проходят» и правило в CLAUDE.md, где сказано, когда останавливаться, а когда работать дальше без лишних отчётов.
  • Ложка дёгтя в защите уровня Fable: помеченное сообщение уходит на более старую модель, а под флаг может попасть даже просьба воспроизвести в ответе внутренние рассуждения Opus 5.5.

Если вы не следили, гайд всё время сравнивает Opus 5.5 с Opus 5 и прежними Opus. Он описывает, в чём новая модель ведёт себя иначе: дольше работает сама, прямо говорит, что сделала, и думает перед каждым ответом. В аккаунте ClaudeDevs в Twitter гайд сжали до трёх советов: отдать задачу целиком, убрать «think carefully» и после длинного прогона сначала проверить, что нужно модели, чтобы идти дальше.

Opus 5.5 работает часами, если назвать ему финишную черту

Гайд просит отдавать задачу одним сообщением и сразу называть, как выглядит «готово»: тесты проходят или все эндпоинты перенесены. По сравнению с прежними Opus самый большой прирост у Opus 5.5 в многошаговой работе, например когда изменение нужно протащить через большой репозиторий до прохождения тестов. Ранние тестировщики гоняли на нём длинные задачи по коду часами почти без присмотра.

Пример из гайда: перенести платёжные эндпоинты со старого клиента на новый, удалить старый клиент, добиться прохождения тестов и спрашивать только тогда, когда тест падает по необъяснимой причине. Если что-то вспомнили посреди прогона, пишите прямо в Claude Code и жмите Enter: прогоны стали длиннее, и перезапуск обходится дороже.

Для дизайна совет другой: перечислить, чего не надо. Без указаний Opus 5.5 откатывается к нескольким стилям по умолчанию, а просьба избегать шаблонного вида лишь меняет один шаблон на другой. Работает конкретный список: без кремового фона, курсивных акцентов в заголовках, меток «01 / 02 / 03», моноширинных подписей и кнопок-таблеток.

Правило в CLAUDE.md решает, где Opus 5.5 остановится

На длинной задаче Opus 5.5 держит вас в курсе и иногда останавливается там, где мог бы продолжать. Он пишет сводку со следующим шагом, но сам шаг не делает, предлагает продолжить или выдаёт список вариантов, которые работу не блокируют. Инструкции, где такие остановки названы, модель выполняет, и гайд предлагает правило для CLAUDE.md:

When a step doesn't need my input, keep going. Put status notes in the same message as your next action. Stop and ask only when you can't continue without me, or before anything destructive: deleting data, force-pushing, or changing anything outside this repository.

Если прогон всё же спросил «Want me to continue?», ответьте «continue». Правило «продолжай» сокращает остановки, поэтому стоп перед удалением данных и force-push стоит оставить, как и запросы разрешений на разрушительные команды. Для парного программирования можно прописать обратное: план в одну строку до старта и короткий итог в конце. Большие аудиты и миграции гайд советует раздавать субагентам и проверять доказательства каждого.

Отчёт Opus 5.5 читают с блока «что нужно от вас»

Когда длинный прогон закончился, сначала ищите, чего Claude ждёт от вас: открытое решение или изменение на одобрение. По словам Anthropic, Opus 5.5 отчитывается яснее, чем Opus 5, и простыми словами пишет, что сделал, что нашёл и что нужно от вас. Формат задаётся в CLAUDE.md, например тремя заголовками Blocked on me, Changed, Found.

Diff или pull request стоит отдать Opus 5.5 на ревью раньше человека. Один из ранних тестировщиков заявил, что Opus 5.5 на самом низком effort поймал больше багов, чем Opus 5 на высоком, и с меньшим числом ложных тревог. В исследованиях гайд советует просить пометить всё, что подтвердить не удалось, и указать, где модель искала.

В приложениях Claude Opus 5.5 точнее, чем Opus 5, читает графики, схемы и скриншоты, включая смысл, который зависит от расположения: какие блоки соединяет стрелка, что изменилось между версиями схемы. В тестах Anthropic он нашёл в длинной переписке дату, выпавшую не на тот день недели, и график, не совпавший с цифрами в презентации.

Opus 5.5 стал первой моделью Opus с защитой уровня Fable на старте

Защита уровня Fable касается биологии и кибербезопасности. В приложениях Claude и Claude Code большинство помеченных сообщений уходят на более старую модель, и работа продолжается там. Поиск уязвимостей в исходном коде разрешён, бытовые вопросы о здоровье и учебные вопросы должны проходить.

В приложениях вы увидите уведомление, которое начинается со «Switched to», и чат останется на старой модели. Вернуть Opus 5.5 можно в выборе модели, но если помеченное сообщение осталось в чате, флаг сработает снова, так что надёжнее начать новый чат. Автопереключение отключается в Settings, раздел Capabilities, пункт «Switch models when a message is flagged», и тогда появится карточка «paused» с вариантами.

В Claude Code к Opus 5.5 возвращаются командой /model, последнее сообщение правят двойным нажатием Esc, переключатель находится в /config, а о ложном флаге сообщают через /feedback. Отдельная категория флагов касается просьбы воспроизвести в ответе внутренние рассуждения. Вместо неё гайд советует попросить объяснить выбор подхода в трёх предложениях.

Почему список задач в файле переживает долгий прогон

Длинный прогон заполняет контекстное окно, то есть весь текст, который модель держит перед глазами разом, и Claude Code начинает сжимать старые ходы в краткое содержание. Файл на диске такое сжатие не затрагивает. Поэтому гайд советует попросить Opus 5.5 вести чек-лист в TASKS.md, отмечать сделанное и дописывать всё новое, что нашлось по ходу.

Так работает смета на стене при ремонте: бригада может забыть, о чём договаривались неделю назад, но по листу видно, что сделано и что осталось. Вы тоже смотрите в файл, а не в прокрутку, и понимаете состояние прогона одним взглядом.

Похожая проблема есть и в длинном чате: думая над коротким уточнением, Opus 5.5 иногда заново перебирает прежний ответ, и реплика приходит медленнее. Для проектов гайд предлагает инструкцию считать отвеченное закрытым, но не для долгого анализа, где поздний шаг может вскрыть ошибку раннего.

Гайд признаёт, что защита иногда помечает легитимную работу, а проверка смотрит на всю переписку с файлами и результатами поиска, так что флаг способен сработать из-за давнего вложения. Какая именно старая модель подхватит работу и как часто это случается, Anthropic не уточняет. На наш взгляд, молчаливое переключение по умолчанию рискованнее карточки с вопросом: после многочасового прогона вы рискуете получить результат уже от другой модели.

Fast mode и донастройка флагов

Fast mode для Opus 5.5 доступен с запуска как research preview и включается командой /fast. Модель та же, текст приходит быстрее, но режим требует включённого extra usage и стоит дороже за токен, чем стандартный. Когда он выйдет из превью и когда донастройка защиты заметно сократит ложные флаги, Anthropic не говорит.

Читайте также

  1. Opus 5.5 подешевел, но ломает агентов ошибкой 400
  2. Opus 5.5 на уровне Fable 5.1, но на 40% дешевле Opus 5
  3. Аудит промптов в Claude Code срезал 14,6% затрат
  4. Скрытый абзац промпта велит агенту не спрашивать разрешения
  5. Из системного промпта Claude Code убрали около 80%
  6. Anthropic обновила правила context engineering для Claude 5

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.