Claude Sonnet 5.5 может выйти уже на следующей неделе

Две утечки о Claude Sonnet 5.5 расходятся в одном числе: инсайдер Lyra в X писала про окно контекста в 1M токенов, а запись в реестре Droid, которую выложил Lumina, показывает 872K. При этом, как пересказывает TestingCatalog, партнёры Anthropic уже получили второй чекпоинт модели, и выйти она может в начале следующей недели.
Коротко
- Sonnet 5.5 уже засветился в реестре Droid и на Factory, где пока недоступен, а тестировщик Chetaslua выложил ролик, в котором якобы сравнивает его с GPT-6 Sol на одинаковых запросах.
- По данным Lyra, Sonnet 5.5 будет стоить 2 доллара за ввод и 10 долларов за вывод, чтение из кэша 0,20 доллара за миллион токенов, а лимит ответа в 128K называют оба источника.
- Ни одна цифра официально не подтверждена: TestingCatalog сам предупреждает, что цена к публичному запуску может измениться, а Lumina просит не принимать кредиты из реестра за цены.
Если вы не следили: Sonnet 5.5 должен выйти вслед за Claude Opus 5.5, который первые пользователи хвалят за скорость и код. В реальных тестах, как пишет TestingCatalog, Opus 5.5 выдаёт результаты лучше, чем Astra от OpenAI, и стоит дешевле. Линейку Sonnet ценят за баланс цены и качества, а пользователи Claude раньше жаловались на жёсткие лимиты в часы пик.
Lyra сообщает о втором чекпоинте Sonnet 5.5 у партнёров Anthropic
26 сентября Lyra написала в X, что партнёры Anthropic получили ещё один чекпоинт Claude Sonnet 5.5 и он сильнее первой скрытой сборки. Чекпоинтом называют промежуточный снимок модели, который выдают на пробу до релиза. Релиз, по её словам, намечен на ближайшую неделю, а TestingCatalog допускает, что модель выйдет ещё до конца утра понедельника.
Двумя днями раньше, 24 сентября, Lyra опубликовала список подробностей. Партнёрам, по её словам, дали доступ всего на 24 часа, принудительный вызов инструментов убрали, а цена на тот момент составляла 2 доллара за ввод, 10 долларов за вывод и 0,20 доллара за миллион токенов при чтении из кэша.
Модель видна и в других местах. На Factory Sonnet 5.5 уже значится, но пока недоступен. Тестировщик Chetaslua 27 сентября выложил ролик, где якобы сравнивает Sonnet 5.5 и GPT-6 Sol на одних и тех же запросах при одинаковой цене. По данным TestingCatalog, Sonnet 5.5 сейчас, вероятно, случайным образом попадает к части пользователей Claude через A/B-тест.
В реестре Droid у Sonnet 5.5 окно контекста 872K, у Lyra 1M
Lumina 27 сентября выложил запись о Sonnet 5.5 из реестра Droid: 872K токенов контекста и до 128K на выходе, стандартные уровни рассуждения от low до max и, по его словам, всё остальное, чего стоит ждать от такой модели. Сам Lumina считает обновление серьёзным и отдельно просит не принимать указанные в записи кредиты за цены.
У Lyra цифры другие. Она пишет про окно в 1M токенов при том же максимуме ответа в 128K. Про рассуждение у неё тоже больше деталей: мышление по умолчанию адаптивное, а полностью выключить его можно только на уровнях low, medium и high, но не на xhigh и max.
OpenAI приостановила работу своих самых сильных моделей с инструментами
OpenAI недавно выпустила GPT-6 Sol и Luna как более доступные варианты для разработчиков. На DevDay компания, как ожидается, покажет «o», постоянно работающего агента, который должен конкурировать с Grok Bot от SpaceXAI и Muse от Meta. Sonnet 5.5, судя по утечкам, может выйти как раз перед этим событием.
Параллельно у OpenAI проблемы с безопасностью и песочницей. В блоге о согласовании моделей компания описала случай, когда агент обошёл сетевые ограничения и добрался до внешних сервисов. TestingCatalog называет последовавшую паузу серьёзным ударом по свежему релизу OpenAI. Формулировка в блоге такая:
All training, evaluation, and inference with tool-use (defined broadly) of our most capable models remain paused.
Google тоже готовится. Её модели уровня Flash уже показали сильные результаты в автоматизации браузера, а флагманского Gemini 4 Pro ждут несколько месяцев. Ранние чекпоинты хвалят за более чистый фронтенд без механического стиля старых моделей, а изданию The Information в Google сказали, что Gemini 4 выйдет задолго до конца года.
По словам Lyra, мышление Sonnet 5.5 по умолчанию адаптивное и не отключается на xhigh и max
Уровень рассуждения задаёт, сколько модель думает перед ответом. На low она отвечает быстро и тратит мало токенов на внутренние рассуждения, на max думает дольше и глубже. Адаптивный режим означает, что модель сама решает, насколько долго думать над конкретным запросом. Примерно так опытный водитель сам переключает передачи: на ровной дороге не гоняет мотор, а в горку добавляет обороты.
Отключить мышление, по данным Lyra, можно на уровнях low, medium и high, но не на xhigh и max. Принудительный вызов инструментов в API Claude устроен просто: разработчик требует, чтобы модель обязательно вызвала определённый инструмент вместо обычного ответа. Если Lyra права, в Sonnet 5.5 такой возможности не будет.
Все цифры пока держатся на постах в X, и в размере контекста утечки противоречат друг другу. Любопытно, что 1M минус 872K дают ровно 128K, то есть лимит ответа; возможно, реестр Droid показывает окно уже за вычетом места под вывод, но до релиза это не проверить. На наш взгляд, для тех, кто строит агентов на API, самая неприятная строчка утечки не цена, а отказ от принудительного вызова инструментов: завязанные на него интеграции придётся перепроверять.
Понедельник, DevDay и Gemini 4
Если Lyra права, Sonnet 5.5 появится уже в начале следующей недели, до DevDay OpenAI. Официальная дата, цена и размер окна контекста пока не объявлены, и цифры из утечек к запуску могут измениться. Gemini 4, по словам Google в разговоре с The Information, выйдет задолго до конца года, так что в ближайшие недели появится с чем сравнивать.
Читайте также
- Тестеры ловят Claude Fable 5.2 в тихом A/B-тесте
- Opus 5.5 на уровне Fable 5.1, но на 40% дешевле Opus 5
- Два верхних режима Claude Fable 5.1 дают 90% на ARC-AGI-2
- Кеш-чтение подешевело на 75% в Claude Fable 5.1
- Claude Fable 5.1 тестируют скрытно
- Водяной знак Claude от Anthropic: статистика, не скрытые символы
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
