Перейти к содержанию

anthropic

Haiku 5.5 подешевела на 90%, но только до 100K токенов

Promtime

По данным Anthropic на странице модели, миллион входных токенов у Claude Haiku 5.5 стоит 10 центов, если промпт не длиннее 100K токенов. Haiku 4.5, как пишет The News Stack, брала за него доллар при любой длине запроса, так что короткие промпты подешевели вдесятеро.

Коротко

  • Haiku 5.5 вышла 7 октября 2026 года, через девять дней после Sonnet 5.5, и доступна в Claude.ai, через Claude API, в AWS, Google Cloud, Microsoft Foundry и в Claude Code.
  • При промпте до 100K токенов миллион входных токенов стоит 0,10 доллара, выходных 0,50 доллара, а у промптов длиннее ставки 0,50 и 2,50 доллара за миллион.
  • Обновлённый токенизатор тратит на ту же задачу чуть больше токенов, поэтому средняя экономия по сравнению с Haiku 4.5, по оценке, которую приводит The News Stack, составит около 75%.

Если вы не следили: Haiku 4.5 вышла 15 октября 2025 года, сравнялась с Sonnet 4 в коде, работе с компьютером и агентских задачах и набрала 73,3% на SWE-bench Verified. Она оставалась актуальной Haiku, пока выходили Sonnet 5 (30 июня 2026 года), Opus 5 (24 июля), Opus 5.5 (22 сентября) и Sonnet 5.5 (28 сентября). The News Stack называет Haiku 5.5 первой новой версией маленькой модели почти за год и третьей моделью линейки 5.5 за месяц.

Короткие промпты подешевели в десять раз, длинные вдвое

По данным The News Stack, Haiku 4.5 стоила 1 и 5 долларов за миллион входных и выходных токенов при любой длине запроса. У Haiku 5.5 тариф двухступенчатый: до 100K токенов в промпте 0,10 и 0,50 доллара, свыше 100K уже 0,50 и 2,50. Для первой ступени цена за токен упала на 90%, для второй на 50%.

Как пишет The News Stack, Anthropic отмечает, что около 90% запросов к Haiku 4.5 укладывались в дешёвую категорию, и оценивает среднюю экономию примерно в 75% с учётом нового токенизатора. Поверх этого работают обычные скидки: кэширование промптов экономит до 90%, пакетная обработка до 50%. Для сравнения, Sonnet 5.5 стоит 2 и 10 долларов, Opus 5.5 стоит 4 и 20, Fable 5.1 стоит 10 и 50. В API модель вызывается как claude-haiku-5-5.

На OSWorld Haiku 5.5 набирает 72,4% против 15,7% у Haiku 4.5

Таблицу результатов публикует The News Stack, в ней Haiku 5.5 сравнивают с Haiku 4.5, GPT-6 Luna от OpenAI и Sonnet 5.5. На офлайн-подмножестве OSWorld 2.1 у Haiku 5.5 72,4%, у GPT-6 Luna 48,9%, у Sonnet 5.5 83,9%. В Terminal-Bench 4.0 счёт 39,2% против 0,0% у Haiku 4.5, 16,4% у GPT-6 Luna и 70,6% у Sonnet 5.5.

На Humanity’s Last Exam без инструментов Haiku 5.5 получает 45,9% (у Haiku 4.5 10,2%), с инструментами 57,4% (у Haiku 4.5 18,7%). В FrontierCode 1.1 у неё 46,4%, у GPT-6 Luna 42,4%, у Sonnet 5.5 52,1% на уровне усилия Xhigh. В GDPval-AA v2.1 рейтинг Haiku 5.5 равен 1620 против 735 у Haiku 4.5, в AA-Briefcase v1.1 1578 против 614, в Chartography без инструментов 46,4% против 6,4%.

HubSpot получил на своём CRM-наборе 92,8%

Отзывы клиентов Anthropic собрала там же, на странице модели. В HubSpot гоняют модели на симулированных порталах с CRM-задачами, и Haiku 5.5 показала 92,8% в среднем за три прогона, лучший результат на этом наборе. В аудите устаревших, но неоднозначных записей она справилась быстрее всех протестированных моделей, с самой высокой долей попаданий и самой низкой долей ложных срабатываний.

Один из клиентов, чья функция Ask in Document делает около 8 миллионов вызовов в неделю, прогнал 400 запросов: 0,84 у Haiku 5.5 против 0,76 у Haiku 4.5. В Box AI в ранних тестах получили на 11 пунктов больше при примерно вдвое меньшей задержке. Авторы агента AI Teammates сообщают о снижении задержки на выполнение задачи больше чем на 30% и о выводе до 2,5 раза быстрее за ход агента. В Devin Fusion связка Opus 5.5 в роли ведущей модели и Haiku 5.5 в роли помощника держит 66,2 в FrontierCode.

Зачем маленькой модели регулятор усилия?

По данным The News Stack, регулятор даёт разработчику контроль над тем, сколько токенов модель тратит на задачу, а по умолчанию стоит средний уровень. Anthropic называет Haiku 5.5 первой Haiku с такой настройкой и говорит, что так команды могут для каждой задачи выбирать между ценой и интеллектом.

В документации Claude Platform Haiku 5.5 указана с адаптивным мышлением, тогда как Haiku 4.5 требовала вручную задавать бюджет через budget_tokens. Там же значатся окно контекста 1M токенов, до 128K токенов на выходе (у Haiku 4.5 было 200K и 64K) и срез знаний на июнь 2026 года.

Проще всего представить регулятор как коробку передач: на ровной трассе едете на пятой и экономите топливо, в горку переключаетесь пониже и тратите больше, а мотор у машины всё время один и тот же.

Anthropic предлагает и сценарий субагентов: более умная модель вроде Fable или Opus планирует работу и передаёт подзадачи Haiku 5.5, так что можно запускать много агентов параллельно. Для сложного кода и работы со знаниями Anthropic советует Opus 5.5, для чётко очерченных задач Sonnet 5.5.

Сколько именно токенов добавляет новый токенизатор, не раскрывается: известно только «чуть больше», и итоговые 75% нельзя проверить на своей нагрузке без замера. Клиентские цифры получены на собственных оценках этих компаний, подробности которых на странице не раскрыты, а отзывы про Ask in Document и AI Teammates даже не называют компанию. На наш взгляд, главное здесь порог в 100K: при окне в 1M агент с длинной историей переходит на ставку в пять раз выше и, вероятно, сам этого не заметит.

Когда появится Fable 5.5

В линейке 5.5 пока нет только Fable 5.5. The News Stack считает, что её проверка, скорее всего, займёт заметно больше времени, и дата выхода не называется. Haiku 4.5 в документации уже значится как устаревшая, и пользователям советуют перейти на Haiku 5.5. Сроки её отключения на странице модели не указаны.

Читайте также

  1. Claude Opus 5.5 считает на 40% дешевле Opus 5
  2. Чтение кэша у Fable 5.1 подешевело на 75%
  3. Anthropic выпустила Claude Sonnet 5
  4. В Max 20x входит 200 долларов в месяц на Claude API
  5. Картинка 4K в Nano Banana 2.1 от Google стоит 0,076 доллара
  6. GPT-6.1 Sol почти догнала Astra за пятую часть цены

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.