Перейти к содержанию

model-releases

Opus 5.5 возглавил индекс, наговорив 260 млн токенов

Claude News

На десять тестов индекса Artificial Analysis Claude Opus 5.5 в режиме максимального усилия потратил 260 миллионов выходных токенов. Это почти втрое больше медианы в 92 миллиона. Зато, как видно на странице модели на Artificial Analysis, 58 баллов ставят его на первое место среди 206 моделей своего класса.

Коротко

  • Artificial Analysis опубликовала разбор Opus 5.5 в конфигурации Adaptive Reasoning, Max Effort, Default Fallback. Модель вышла 22 сентября 2026 года, и эта версия заняла первую строчку в своём классе.
  • Opus 5.5 набрал 58 баллов при медиане 25, а в API Anthropic стоит 4 доллара за миллион входных и 20 долларов за миллион выходных токенов, то есть вдвое дороже медианы класса.
  • Подвох в объёме рассуждений: весь прогон индекса обошёлся в 8 708,20 доллара, или 5,98 доллара за задачу, а в графе скорости стоит N/A.

Если вы не следили: по данным TechCrunch, Opus 5.5 вышел всего через два месяца после Opus 5, который появился 24 июля. По словам Anthropic, Opus 5 заметно прибавил в качестве при той же цене, что и Opus 4.8, и стал моделью по умолчанию на плане Max. По данным hidekazu-konishi.com, над линейкой Opus есть ещё уровень Mythos. Его представили 9 июня 2026 года вместе с Claude Fable 5.

58 баллов при медиане 25: Opus 5.5 возглавил индекс из 10 тестов

Индекс Artificial Analysis версии v4.3.2 состоит из 10 тестов: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience и AA-LCR v1.1. По методологии Artificial Analysis тесты разбиты на четыре блока с весами: агенты 30%, код 20%, научные рассуждения 20% и общие задачи 30%.

Opus 5.5 в этой конфигурации получил 58 баллов и стал первым среди 206 моделей класса, где медиана равна 25. Класс определяется ценой: проприетарную модель сравнивают с моделями того же ценового диапазона по смешанной цене, в которой вход и выход берутся в пропорции 3:1. Opus 5.5 попадает в верхний диапазон, дороже 1 доллара за миллион токенов.

Насколько точны сами баллы? По оценке Artificial Analysis, 95-процентный доверительный интервал индекса меньше ±1%. Эту оценку сервис получил в экспериментах, где некоторые модели прогоняли больше 10 раз на всех наборах тестов.

Цена вдвое выше медианы, но на кэш действует скидка 95%

В API Anthropic Opus 5.5 стоит 4 доллара за миллион входных токенов и 20 долларов за миллион выходных. У медианной модели класса эти цены вдвое ниже: 2 и 10 долларов. Для закэшированных промптов Artificial Analysis указывает скидку 95%. Если смешать попадания в кэш, обычный вход и выход в пропорции 7:2:1, получается 2,94 доллара за миллион токенов.

По данным TechCrunch, у предшественника миллион выходных токенов стоил 25 долларов, так что Opus 5.5 подешевел, и по остальным ценовым показателям издание отмечает похожее снижение. Сейчас Artificial Analysis видит у модели только одного API-провайдера.

Остальное есть в технической карточке. Контекстное окно вмещает 1 миллион токенов, это примерно 1 500 страниц A4, набранных Arial 12-го кегля. На вход модель принимает текст и изображения, на выходе выдаёт только текст. Веса закрыты, размер модели и число параметров Anthropic не раскрывает.

Рассуждения Opus 5.5 оплачиваются как выход, отсюда 8 708,20 доллара за прогон

Opus 5.5 относится к рассуждающим моделям: прежде чем ответить, он проходит цепочку промежуточных шагов, и эти токены оплачиваются как выходные. Как пишет Anthropic, у моделей Claude есть параметр effort, которым клиент выбирает между качеством ответа и скоростью с экономией токенов. Artificial Analysis измеряла вариант Max Effort.

Представьте экзамен, где платят за каждую исписанную страницу черновика, а не только за ответ. Чем дольше студент считает, тем выше шанс верного решения и тем дороже обходится работа. По сути effort определяет, сколько черновика вы готовы оплатить.

На максимальном усилии Opus 5.5 потратил на весь индекс 260 миллионов выходных токенов при медиане 92 миллиона, а полный прогон стоил 8 708,20 доллара. Стоимость задачи Artificial Analysis складывает из пяти частей: обычный вход, попадания в кэш, запись в кэш, рассуждения и ответ. Каждый тест учитывается со своим весом в индексе. В этой конфигурации задача у Opus 5.5 в среднем стоит 5,98 доллара.

Главного в карточке не хватает: скорости. В графе выходных токенов в секунду стоит N/A, а что означает Default Fallback в названии конфигурации и как модель справляется на более низких уровнях effort, не раскрыто. На наш взгляд, 58 баллов стоит читать вместе с 260 миллионами токенов: первое место куплено почти тройным расходом на рассуждения, и в длинных агентных сессиях счёт, вероятно, будет расти так же.

Сроки Sonnet 5.5 и Haiku 5.5

По данным TechCrunch, Anthropic обещает выпустить Sonnet 5.5 и Haiku 5.5 «в ближайшие недели» с похожим приростом качества. Точных дат пока нет. Неизвестно и то, когда в карточке Opus 5.5 на Artificial Analysis появится замер скорости. Пока его нет, сравнивать модель с соседями по таблице можно только по баллам и цене, а по времени ответа нельзя.

Читайте также

  1. Ответ Opus 5.5 стоил в 3,4 раза больше, чем у GPT-6 Sol
  2. Claude Code 2.1.280 отдал Opus 5.5 даже тарифу Pro
  3. Opus 5.5 на уровне Fable 5.1, но на 40% дешевле Opus 5
  4. Fable 5.1 лидирует в индексе Artificial Analysis, но дороже
  5. Два верхних режима Claude Fable 5.1 дают 90% на ARC-AGI-2
  6. Кеш-чтение подешевело на 75% в Claude Fable 5.1

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.