Перейти к содержанию

anthropic

Подписки Claude могут съедать больше 40% инференса

Claude News

SemiAnalysis проверяла три одинаковые подписки одного провайдера, и на одной из них лимиты оказались примерно на 20% ниже. Объяснение нашлось простое: аккаунт попал в «крайне маленький» A/B-тест. Об этом пишут аналитики SemiAnalysis в большом разборе лимитов, и главный вывод там другой: на Opus 5.5 планы Claude дают примерно в 5 раз больше ценности в пересчёте на цены API, чем GPT 6.1 Sol у OpenAI.

Коротко

  • По грубым подсчётам SemiAnalysis, подписки дают Anthropic лишь 10% выручки, но могут занимать больше 40% вычислений на инференс и снижают среднюю выручку на мегаватт примерно на 36 миллионов долларов.
  • Лимиты измеряли опытным путём: запросы с одним типом токенов повторяли до тех пор, пока счётчик использования не сдвигался достаточно раз, чтобы погрешность сузилась до ±5%.
  • Подвох в том, что провайдеры могут менять лимиты молча, а OpenAI недавно вдвое урезала ценность плана за 200 долларов и выровняла число токенов на доллар во всех тарифах Pro.

Если вы не следили, инди-разработчики долго хвалили OpenAI за щедрые лимиты, особенно на фоне Anthropic. По оценке SemiAnalysis, щедрые сбросы лимитов отчасти объясняют недавний взлёт Codex, а Anthropic из-за них не раз отказывалась от запланированного урезания подписок, чтобы не проиграть в общественном мнении. При этом подписки сильно дотируются и работают как инструмент привлечения клиентов.

На Opus 5.5 подписка Claude даёт примерно в 5 раз больше ценности, чем GPT 6.1 Sol

На верхнем уровне моделей лимиты почти равны: GPT-6 Astra и Fable 5.1 дают похожие объёмы. Разница в том, что на Fable в Claude можно потратить только 50% лимита. План Anthropic за 200 долларов после Fable 5.1 на 2 485 долларов в ценах API сохраняет ещё половину лимита, а такой же план OpenAI после Astra на 2 897 долларов исчерпан полностью.

Главный разрыв на среднем уровне, который обе компании продвигают как модель на каждый день. Opus 5.5 на подписках Claude даёт примерно в 5 раз больше ценности в пересчёте на API, чем GPT 6.1 Sol. Sol дешевле Opus за токен, но и в сырых токенах, по данным SemiAnalysis, разрыв остаётся огромным.

Довод в пользу OpenAI один: в её планах Pro нет пятичасового лимита, поэтому выбрать большую долю месячного объёма проще. Аналитики считают, что примерно 4-кратного превосходства Opus 5.5 на планах Claude по ценности в ценах API этот довод не перекрывает. Китайские лаборатории тоже дотируют подписки, и в среднем их ценность на доллар немного ниже примерно 12-кратной, которую даёт OpenAI.

OpenAI вдвое сократила токены в плане за 200 долларов и добавила тариф за 500

Замеры подтвердили объявленное Tibo снижение ценности плана за 200 долларов на 50%. Планы, купленные до сокращения, сохраняют старые лимиты до 29 октября, новые сразу получают сниженные. OpenAI вдвое уменьшила число токенов на каждом уровне моделей. Для класса Sol ценность в пересчёте на API упала больше чем на 50%, потому что одновременно подешевел кэшированный ввод у 6.1 Sol.

Новый план за 500 долларов даёт лишь на 21% больше Astra, чем старый план за 200, а ценность моделей Sol в пересчёте на API у него даже ниже. Главная функция тарифа, Ultrafast на 300 токенов в секунду, ещё проходит замеры.

Раньше Pro за 100 долларов давал на Astra примерно вдвое больше ценности на доллар, чем Plus, а Pro за 200 добавлял ещё примерно вдвое на всех моделях. После сокращения Pro 100, 200 и 500 дают одинаковое число токенов на доллар для каждой модели. Plus сопоставим с ними на Sol и проигрывает на Astra. У Anthropic все тарифы и раньше давали одинаковую ценность на доллар.

При полном использовании Opus 5.5 подписка Claude уходит в маржу −369%

Цены недавно резали все. У Fable 5.1 чтение из кэша на 75% дешевле, чем у Fable 5. У Opus 5.5 ввод и вывод подешевели на 20% относительно Opus 5, а чтение из кэша на 60%. GPT 6.1 Sol снизил цену чтения из кэша на 50% против GPT 6 Sol, который сам был на 60–67% дешевле 5.6 Sol.

Лимиты за ценами не поспевают. OpenAI не тронула лимиты Sol в плане за 200 долларов с выходом 6.1 Sol, и ценность в пересчёте на API упала примерно на 30%. Anthropic не добавила токенов Fable с версией 5.1, а лимиты Opus с выходом 5.5 подняла примерно на 20% в планах Max и на 50% в Pro, чего не хватило, чтобы компенсировать снижение цен API.

По расчёту SemiAnalysis при 100% использовании лимита и валовой марже API 92% подписка, целиком потраченная на Opus 5.5, даёт маржу −369%, а на Fable 5.1 около 1%. При более реалистичных 20% использования выходит 6% и 80% соответственно. Anthropic снижает ценность для более дорогих моделей, а OpenAI, по описанию аналитиков, сразу урезала лимиты до уровня Fable по всем моделям.

Чтобы измерить лимит, SemiAnalysis скармливала моделям «Войну и мир»

Подписки не показывают цену токенов. Вместо неё есть шкалы от 0 до 100% за 5 часов и за 7 дней, у Fable ещё отдельная, как в Claude Code. По сути платёж покупает пачку кредитов, а каждая пара «модель и тип токена» списывает их по своему курсу, который может сильно расходиться с ценами API.

Для ввода и кэша брали фрагмент «Войны и мира», потому что на бессмыслицу некоторые модели не отвечают. Случайная метка в каждом запросе мешает кэшированию, фиксированная заставляет читать кэш. Для вывода просили техническое эссе: просьбу повторить «SemiAnalysis» 100 000 раз модели отклоняют.

Счётчик двигается рывками, поэтому токены считают между двумя его сдвигами, примерно как расход бензина от одной риски указателя до следующей. Неполные шаги в начале и в конце отбрасывают. Если 500 миллионов токенов чтения кэша счётчик не сдвигают, чтение считают бесплатным.

Так и нашёлся A/B-тест. Аккаунт со сниженными лимитами был заметно старше двух других, но провайдер подтвердил, что возраст ни при чём. По его словам, лимиты не снижали оптом, а проверяли, как лучше распределить моменты, когда люди в них упираются.

Сама SemiAnalysis признаёт пределы метода. Ценность в пересчёте на API искажается, если модель изначально слишком дорога или дешева по ценам API, а надёжных данных об эффективности токенов в отрасли нет, и бенчмаркам Artificial Analysis аналитики не доверяют. На наш взгляд, главная проблема в самом дизайне: шкала от 0 до 100% без цены в токенах, да ещё после того, как OpenAI убрала со страницы цен обещания «в 5 раз» и «в 20 раз» больше, чем в Plus, оставляет пользователя считать лимит вслепую.

Что изменится 29 октября

Старые лимиты у планов OpenAI за 200 долларов, купленных до сокращения, действуют только до 29 октября. Замеры Ultrafast и лимитов подписки ChatGPT в сторонних приложениях вроде Devin ещё идут, результаты обещают подписчикам Tokenomics Model по готовности, без конкретной даты. Сравнение с Cursor и Cognition анонсировано, но цифр в открытой части разбора нет.

Читайте также

  1. Anthropic удалила пост про рост лимитов и признала минус 17%
  2. Лимиты Claude Max сверяют по логам, а оспаривают в суде
  3. Anthropic открыла Claude Startups шире: год Team бесплатно
  4. У флагмана Anthropic проблемы с притоком пользователей
  5. Anthropic вернёт кредиты пострадавшим от лишних списаний
  6. Счёт на 16,6 миллиона долларов от биллинга Anthropic

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.