anthropic

Кеш-чтение подешевело на 75% в Claude Fable 5.1

Claude News

Anthropic снизила стоимость cache reads для Claude Fable 5.1 на 75%, до $0,25 за миллион токенов, что для типичных нагрузок даёт около 25% экономии относительно Fable 5. Остальные цены остались прежними: $10 за миллион входных токенов и $50 за миллион выходных. Модель вышла на всех платформах, включая AWS, Google Cloud и Microsoft Azure, следует из анонса Anthropic.

Коротко

  • Fable 5.1 и Mythos 5.1 представляют собой одну и ту же модель с разными наборами защит: Mythos доступна только участникам программ проверенного доступа в кибербезопасности и науках о жизни.
  • На Terminal-Bench-Science 0.1 Fable 5.1 набирает 52,6% против 24,7% у Fable 5, на Terminal-Bench 4.0 55,8%, а Mythos 5.1 в том же тесте 60,9%; все замеры проводились с включёнными продакшен-защитами.
  • В Claude Code киберзащиты вмешиваются в среднем на 60% реже за сессию по сравнению с прежними защитами Fable 5, а сама модель теперь допускается к поиску уязвимостей, но не к созданию эксплойтов.

Снижение цены на cache reads бьёт по самой дорогой части агентных сценариев, где повторное чтение уже обработанного контекста формирует основную долю счёта, и, судя по всему, именно поэтому Anthropic оценивает экономию на контекстно-тяжёлых задачах примерно в 45%. Не менее важен разворот в защитных механизмах: избыточные срабатывания фильтров напрямую мешают работе в задачах безопасности, и снижение их частоты вероятно повлияет на выбор модели сильнее, чем прирост в бенчмарках.

На GDPval-AA v2 Fable 5.1 получает 1853 балла против 1723 у Fable 5

В AutomationBench модель показывает 31,4% против 26,9% у Opus 5 и 19,6% у GPT-5.6 Sol, на Terminal-Bench-Science 0.1 52,6% против 29,0% и 22,4% соответственно. Для сравнения, в GDPval-AA v2 Opus 5 набирает 1824 балла, GPT-5.6 Sol 1711. На OSWorld 2.0 у Fable 5.1 77,9% при частичном зачёте и 41,7% при строгом.

Anthropic приводит пример инвестиционной компании Millennium: Fable 5.1 нашла причину редкого сбоя во внутренних системах, которую инженеры фирмы и другие модели не могли объяснить несколько лет. В Claude Code модель по умолчанию работает на уровне усилий high, в Claude Cowork и на Claude.ai на medium.

Enterprise Frontier Safeguards разрабатывали более чем со ста клиентами и тремя облачными провайдерами

EFS хранит данные клиента в его собственной облачной инфраструктуре, а не у Anthropic, и человеческую проверку по умолчанию проводит сам заказчик. Партнёрами по разработке выступили AWS, Google Cloud и Microsoft Azure. До запуска EFS подходящие клиенты могут работать с Fable 5.1 в режиме нулевого хранения данных.

Биологические фильтры Fable 5.1 и Fable 5 срабатывают на 85% реже на безобидных запросах об элементарной биологии и медицине по сравнению с защитами, запущенными вместе с Fable 5. Запросы про исследования и разработку в науках о жизни по-прежнему перенаправляются на модели Opus, как и пентест, генерация эксплойтов и сканирование бинарников.

Аккаунты API, созданные с момента релиза, не могут вручную править предыдущий контекст Claude в многоходовом диалоге с сохранением расшифровки его рассуждений. В Anthropic объясняют это закрытием публично описанной техники дистилляции; существующие аккаунты изменение пока не затрагивает, но оно распространится на всех с будущими релизами моделей.

Mythos 5.1 ускорила семь открытых моделей до 2,5 раза

Модель написала собственные GPU-ядра и добавила кэширование промежуточных результатов, ускорив семь открытых моделей глубокого обучения на NVIDIA H100 при идентичных выходных данных. По оценке Anthropic, на массовых расчётах это срезает затраты на GPU на 30–60%; оптимизации компания планирует выложить в открытый доступ.

Mythos 5.1 также получила доступ к открытым инструментам дизайна и фолдинга белков, а её конструкции проверяли экспериментально две внешние организации. На трёх мишенях аффинность связывания оказалась в десять раз выше, чем у лучших работ конкурсов Adaptyv Bio, а доля жизнеспособных связывателей достигла почти 50% на 12 мишенях при обычных для отрасли 10–15%.

Fable 5.1 обучила нейросеть и построила карту высот для трети Венеры по радарным снимкам миссии NASA Magellan и уже существовавшей карте пятой части планеты. Детализация выросла с 10–20 км до 2–3 км, точность высот улучшилась до 25%. Карта опубликована под лицензией Creative Commons.

Сроки EFS и доступа к Mythos

EFS выходит поэтапно начиная с этой осени, а Mythos 5.1 сейчас открыта только для части американских организаций через Cyber Verification Program и Life Sciences Verification Program; расширение круга партнёров Anthropic согласовывает с правительством США. Продукт Claude Security теперь работает на Mythos 5.1.

Набор учёных в программу по наукам о жизни компания обещает открыть в ближайшее время, конкретных дат не называя. API для определения водяного знака, добавленного по требованиям Кодекса практик EU AI Act, работает в закрытом превью для регуляторов, СМИ, исследователей и обязанных проверять маркировку компаний.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.