Haiku 5.5 думает 415 секунд до первого слова ответа

Почти семь минут, если точно, 415,30 секунды, проходит в режиме Max, прежде чем Claude Haiku 5.5 выдаёт первый токен ответа. Такие цифры приводит Artificial Analysis. У рассуждающих моделей той же ценовой категории медиана составляет 2,17 секунды, а в индексе интеллекта Haiku 5.5 набрала 43 балла и стоит на втором месте из 182.
Коротко
- Anthropic выпустила Haiku 5.5 7 октября 2026 года, а Artificial Analysis проверила рассуждающую версию в режиме Max через API Anthropic, пока единственного провайдера этой модели.
- Цена составляет 10 центов за миллион входных токенов и 50 центов за миллион выходных при медианах 25 и 90 центов, а печатает модель 243,4 токена в секунду против медианы 110,9.
- Расплачиваться приходится многословностью: на прогоне индекса Haiku 5.5 в режиме Max выдала 440 миллионов выходных токенов при медиане 100 миллионов, и одна задача обошлась в среднем в 21 цент.
Если вы не следили: по данным Anthropic, предыдущая Haiku 4.5 вышла 15 октября 2025 года, и Anthropic подавала её как ровню Sonnet 4 в коде, работе с компьютером и агентных задачах, с результатом 73,3% на SWE-bench Verified. По подсчёту трекера Next AI Model, между двумя Haiku прошло 357 дней, хотя обычно паузы длятся 291 день. По данным ClaudeKit, Opus 5.5 вышла 22 сентября 2026 года, Sonnet 5.5 вышла 28 сентября, а Haiku 5.5 вышла в семействе 5.5 последней.
Haiku 5.5 набрала 43 балла и стала второй из 182 моделей своего класса
Индекс интеллекта Artificial Analysis версии 4.3.2 собран из 10 оценок: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1. Haiku 5.5 в режиме Max получила 43 балла при медиане 13 у сравнимых моделей. SciCode и CritPt на странице помечены как оценки на пересмотре.
Класс сравнения устроен так. Проприетарные модели Artificial Analysis сравнивает с закрытыми и открытыми моделями того же ценового диапазона, а цену считает смешанной, в пропорции 3:1 между входом и выходом. Рассуждающие модели сравниваются и с рассуждающими, и с обычными. Всего в этом классе 182 модели.
Haiku 5.5 печатает 243,4 токена в секунду, но начинает отвечать только через 415 секунд
По скорости вывода Haiku 5.5 в режиме Max стоит девятой из 182: 243,4 токена в секунду на API Anthropic при медиане 110,9. Скорость считается с момента, когда от API пришёл первый фрагмент ответа. По шкале скорости Artificial Analysis модель получила высшую оценку, 4 из 4.
Задержка до первого токена ответа составила 415,30 секунды при медиане 2,17 секунды у рассуждающих моделей той же ценовой категории. В эту метрику Artificial Analysis включает время «размышления» рассуждающей модели. По многословности Haiku 5.5 стоит на 62-м месте: 440 миллионов выходных токенов на прогоне индекса при медиане 100 миллионов.
Миллион входных токенов стоит 10 центов, а кэшированные запросы дешевле на 90%
На API Anthropic Haiku 5.5 стоит 10 центов за миллион входных токенов и 50 центов за миллион выходных, медианы класса составляют 25 и 90 центов. Скидка на кэш составляет 90%. В пропорции 7:2:1 между попаданиями в кэш, обычным входом и выходом Artificial Analysis получает смешанную цену 8 центов за миллион токенов. По данным Anthropic, пакетная обработка снижает цену ещё на 50%.
Одна задача индекса обошлась в среднем в 21 цент, по этой метрике модель на 46-м месте из 182. В стоимость задачи входят все типы токенов: вход, попадания в кэш, запись в кэш, рассуждения и ответ. Haiku 5.5 принимает текст и изображения, отвечает текстом и держит контекст в 1 миллион токенов, это около 1500 страниц A4 шрифтом Arial 12-го кегля. Число параметров Anthropic не раскрывает, веса закрыты.
Почему быстрая модель так долго молчит
Так работают рассуждающие модели. Перед ответом Haiku 5.5 выстраивает цепочку рассуждений, и эти токены тоже генерируются, хотя ответом их никто не считает. Чем длиннее цепочка, тем позже появляется первый токен ответа, как бы быстро ни шла сама генерация. Представьте собеседника, который говорит скороговоркой, но перед первой фразой семь минут молча пишет черновик.
По данным Anthropic, Haiku 5.5 стала первой Haiku с управлением усилием (effort): для каждой задачи можно отдельно решить, сколько интеллекта получать и сколько за него платить. Замеры Artificial Analysis сделаны в режиме Max, в названии конфигурации значится ещё и «Default Fallback». Сайт упоминает, что у модели может быть и вариант без рассуждений.
По собственному описанию Anthropic, Haiku 5.5 рассчитана на чаты, голосовых агентов и живую поддержку, а ещё на роль дешёвого субагента, которому Fable или Opus раздают подзадачи. На наш взгляд, режим Max с паузой в 415 секунд с такими сценариями не сочетается, так что уровень усилия придётся подбирать под задачу. И с ценой есть оговорка: по данным Anthropic, 10 и 50 центов действуют для запросов до 100 тысяч токенов, а для более длинных цена растёт до 50 центов и 2,5 доллара.
Как Haiku 5.5 поведёт себя без Max
Главного замера пока нет: Artificial Analysis не приводит цифр для младших уровней усилия и для возможного варианта без рассуждений, как нет и данных о задержке при других настройках. Пока модель доступна только у Anthropic, сравнить её с другими провайдерами тоже не получится. Когда появятся замеры остальных режимов, будет видно, сколько из 43 баллов сохраняется без семиминутной паузы.
Читайте также
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
