Перейти к содержанию

anthropic

Haiku 5.5 печатает быстро, но молчит 415 секунд

Claude News

Claude Haiku 5.5 в режиме Max молчит 415,30 секунды до первого токена, почти семь минут, а потом выдаёт текст более чем вдвое быстрее типичной модели своего класса. Такие замеры опубликовала Artificial Analysis. В её индексе интеллекта у новой Haiku 43 балла и второе место из 182 моделей.

Коротко

  • Anthropic выпустила Haiku 5.5 7 октября 2026 года, и Artificial Analysis уже прогнала её через свой индекс из десяти тестов, от Terminal-Bench 4.0 до Humanity's Last Exam.
  • Через API Anthropic Haiku 5.5 стоит 0,10 доллара за миллион входных токенов и 0,50 доллара за миллион выходных, а одна задача индекса обходится в среднем в 0,21 доллара.
  • Подвох в многословии: на весь индекс Haiku 5.5 в режиме Max потратила 440 миллионов выходных токенов при медиане 100 миллионов, а время раздумий Artificial Analysis засчитывает в задержку до первого токена.

Если вы не следили: по данным Anthropic, предыдущая Haiku 4.5 вышла 15 октября 2025 года, сравнялась с Sonnet 4 в коде, работе с компьютером и агентных задачах и набрала 73,3% на SWE-bench Verified. Семейство 5.5, как пишет ClaudeKit, открыл Opus 5.5 22 сентября 2026 года, а 28 сентября к нему добавился Sonnet 5.5. По подсчётам Next AI Model, между двумя Haiku прошло около 357 дней при обычном для линейки интервале в 291 день.

Haiku 5.5 набрала 43 балла и заняла второе место из 182 моделей

Artificial Analysis Intelligence Index версии 4.3.2 собран из десяти оценок: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1. Haiku 5.5 в режиме Max набрала в нём 43 балла при медиане 13 у сопоставимых моделей.

Сопоставимые здесь значит модели из той же ценовой корзины. Закрытые модели Artificial Analysis сравнивает с открытыми и закрытыми того же ценового диапазона, считая смешанную цену в пропорции 3:1 между входом и выходом. Рассуждающие модели идут в общий зачёт с обычными. В таком классе 182 модели, и Haiku 5.5 среди них вторая.

Haiku 5.5 принимает текст и изображения, отвечает текстом. Окно контекста у неё в 1 миллион токенов, по подсчёту Artificial Analysis это около 1500 страниц A4, набранных двенадцатым кеглем Arial.

После паузы Haiku 5.5 печатает 243,4 токена в секунду

Скорость вывода Artificial Analysis меряет после того, как из API пришёл первый фрагмент ответа. По этому замеру Haiku 5.5 в режиме Max через API Anthropic выдаёт 243,4 токена в секунду при медиане 110,9 у рассуждающих моделей того же ценового класса. В рейтинге скорости она девятая из 182.

С задержкой картина обратная. До первого токена через API Anthropic проходит 415,30 секунды при медиане 2,17 секунды в том же классе. Для рассуждающих моделей Artificial Analysis включает в этот показатель время, которое модель тратит на раздумья до ответа.

Раздумья стоят токенов. На прогон всего индекса Haiku 5.5 в режиме Max сгенерировала 440 миллионов выходных токенов при медиане 100 миллионов у моделей своего класса. Sonnet 5.5 в максимальном режиме потратил на тот же индекс 410 миллионов.

Задача индекса обходится Haiku 5.5 в среднем в 0,21 доллара

Через API Anthropic Haiku 5.5 стоит 0,10 доллара за миллион входных токенов при медиане класса 0,25 доллара и 0,50 доллара за миллион выходных при медиане 0,90 доллара. Скидка на попадания в кэш составляет 90%. При смеси 7:2:1 между кэшем, обычным входом и выходом Artificial Analysis получает 0,08 доллара за миллион токенов.

В среднюю стоимость задачи индекса, 0,21 доллара, входят вход, запись и чтение кэша, раздумья и сам ответ. По этой метрике Haiku 5.5 на 46-м месте из 182, заметно ниже, чем по интеллекту и скорости.

В тарифах есть оговорка. По данным Anthropic, 0,10 и 0,50 доллара действуют для запросов до 100 тысяч токенов, а за более длинные берут 0,50 доллара за вход и 2,50 доллара за выход. Там же Anthropic обещает экономию до 90% на кэшировании промптов и 50% на пакетной обработке.

Почему быстрая Haiku 5.5 так долго молчит

Ответ в устройстве рассуждающей модели. Прежде чем ответить, Haiku 5.5 пишет для себя цепочку рассуждений, и эти токены тоже генерируются и входят в счёт. Секундомер Artificial Analysis включается в момент запроса и останавливается на первом токене ответа, поэтому весь черновик попадает в задержку.

Представьте студента на устном экзамене: семь минут он молча исписывает черновик, а потом отвечает бегло и без запинок. Говорит он быстро, но экзаменатор всё равно ждал семь минут.

Глубину раздумий в Haiku 5.5 можно настраивать. По данным Anthropic, это первая Haiku с управлением уровнем усилий, где команда сама выбирает баланс цены и интеллекта под задачу. Замер Artificial Analysis сделан на максимальном уровне Max.

Anthropic, по её описанию, рассчитывает Haiku 5.5 на массовые и чувствительные к цене задачи, на чаты, голосовых агентов и живую поддержку. Ещё одна роль у неё субагентская: Fable или Opus планирует работу и раздаёт Haiku подзадачи, чтобы много агентов работали параллельно.

Artificial Analysis не раскладывает 415 секунд на раздумья и обработку входа и не объясняет пометку Default Fallback в названии конфигурации, а Haiku 5.5 пока доступна лишь у одного API-провайдера, так что сверить замер не с чем. На наш взгляд, для чатов, голосовых агентов и живой поддержки, под которые Anthropic позиционирует Haiku 5.5, режим Max с почти семиминутным молчанием не годится, и замер в нём мало говорит о главном сценарии модели.

Сколько баллов останется без режима Max

Замеров Haiku 5.5 на уровнях усилий ниже Max на странице Artificial Analysis нет, и когда они появятся, не сообщается. Страница оговаривает, что у модели может существовать и вариант без рассуждений. Пока неизвестно, сколько из 43 баллов Haiku 5.5 сохранит, если сократить раздумья с минут до секунд.

Читайте также

  1. Sonnet 5.5 выдал 410 млн токенов ради третьего места
  2. Haiku 5.5 решил 39,2% Terminal-Bench, у Haiku 4.5 был ноль
  3. Sonnet 5.5 обогнал Opus 5.5 в Terminal-Bench 4.0
  4. Два верхних режима Claude Fable 5.1 дают 90% на ARC-AGI-2
  5. Opus 5 обгоняет Fable 5 на OSWorld 2.0 за треть цены
  6. Claude Fable 5: возможности и ограничения доступа

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.