Перейти к содержанию

anthropic

Сканер Anthropic шлёт отчёты о багах без проверки людьми

Promtime

Anthropic будет отправлять мейнтейнерам open-source проектов отчёты об уязвимостях, которые написала модель и не проверял ни один человек, и сразу предупреждает, что в части отчётов будут ошибки. Так устроен бесплатный OSS Scanner, одна из двух первых частей программы Anthropic Cyber Mission, о которой объявила Anthropic.

Коротко

  • Anthropic Cyber Mission начинается с двух направлений: защиты операционных технологий в энергосетях, водоканалах и на транспорте и поиска уязвимостей в открытом коде, на котором держится почти весь софт.
  • Каждый отчёт OSS Scanner содержит proof of concept, объяснение и, где возможно, предложенный патч; Anthropic ждёт долю верных срабатываний выше 90% и обещает постепенно её повышать.
  • Находить баги стало проще, чем чинить: в Project Glasswing между находкой и патчем часто проходили месяцы, а в операционных технологиях исправление в редких случаях может ждать десятилетия.

Если вы не следили: по данным Anthropic, Project Glasswing стартовал 7 апреля 2026 года вокруг Claude Mythos Preview, невыпущенной модели, которая, по словам компании, в поиске и эксплуатации уязвимостей уступает лишь самым сильным специалистам-людям. Первые итоги, как пишет Build Fast with AI, вышли 22 мая: 23 019 найденных уязвимостей более чем в 1 000 open-source проектов, из них 6 202 оценены как высокой или критической опасности.

OSS Scanner отправляет мейнтейнерам отчёты без проверки людьми

В Glasswing схема была осторожной. Anthropic сканировала сотни популярных open-source проектов, люди разбирали и проверяли многие из найденных потенциальных уязвимостей, а результаты уходили мейнтейнерам приватно, через процесс скоординированного раскрытия. Часть мейнтейнеров, которым хватает сил на разбор в больших объёмах, попросила присылать всё, что нашли модели, проверенное или нет.

Ответом стал OSS Scanner, сервис по образцу Google OSS-Fuzz, к которому проекты подключаются сами. Записавшиеся проекты регулярно и бесплатно получают сканы от самых сильных моделей Anthropic. В каждом отчёте есть proof of concept, то есть демонстрация того, как баг можно эксплуатировать, плюс объяснение и, если найдётся, предложенный патч.

Отчёты пишет модель, и уходят они без человеческой проверки. Так быстрее, но Anthropic прямо говорит о неточностях, например о неверной оценке критичности. Компания ждёт долю верных срабатываний выше 90% и обещает со временем подтянуть и её, и качество патчей. Сервис рассчитан на проекты, которые успевают разбирать находки; остальным по-прежнему придут проверенные людьми отчёты по политике CVD.

В программу защиты инфраструктуры вошли 11 партнёров, от Accenture до Rockwell Automation

Вторая часть миссии касается операционных технологий: контроллеров, управляющего софта и промышленных сетей, на которых работают энергосети, водоканалы, заводы и транспорт. Такое оборудование строят на десятилетия, и его часто нельзя выключить ради патча, поэтому известные уязвимости остаются открытыми годами. Техника проприетарная, любое изменение рискованно, а ошибка может остановить станцию.

Critical Infrastructure Defense Program приводит модели Claude, инженеров на местах и исследования угроз Anthropic к доверенным подрядчикам, на которых полагаются операторы. Партнёры-основатели: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC и Rockwell Automation. Среди них консультанты, компании по защите сетей и производители самого оборудования.

По словам Anthropic, работа уже идёт: несколько партнёров с помощью Claude чинят уязвимости и помогают в этом клиентам. Первым шагом компания называет работу с небольшой группой подрядчиков, чтобы понять, какие подходы действительно работают. С июня у Anthropic действует программа для властей штатов, округов, племён и территорий: модели и техподдержку там предложили больше чем половине штатов США и ряду крупнейших публичных операторов инфраструктуры.

Бесплатность сканера оплачивает фонд 0xDAF, запущенный в августе

Anthropic профинансировала организации, стоящие за широко используемым открытым кодом: Python Software Foundation, Alpha-Omega и OpenSSF через Linux Foundation, Apache Software Foundation. Поддержку получили и Akrites с Gold Eagle, которые собирают и координируют сообщения об уязвимостях из многих источников, чтобы мейнтейнеров не завалило потоком.

Defender Advantage Fund (0xDAF), запущенный в августе, финансирует пилотные программы в этих направлениях и держит OSS Scanner бесплатным. Мейнтейнеры могут подать заявку в Claude for Open Source на бесплатную подписку Claude Max, а в Cyber Verification Program на расширенный доступ к кибервозможностям Claude для защитной работы. В эту программу на этой неделе влился и сам Glasswing.

Anthropic ждёт перевеса защиты через два года, но не в ближайшее время

Свою логику Anthropic объясняет прямо. Модели с сильными кибервозможностями уже широко доступны атакующим, а защитные инструменты, включая её собственные, до многих защитников пока не дошли. Прогноз компании: через два года ИИ будет на стороне защиты, баги станет проще ловить до релиза. В ближайшее время, признаёт Anthropic, это может быть не так.

Эксплуатация уязвимостей подешевела, а проверка, раскрытие и исправление остаются медленными и держатся на людях. В Glasswing между находкой и патчем часто проходили месяцы, а в операционных технологиях исправление в редких случаях может ждать десятилетия, пока его получится безопасно применить на работающем оборудовании.

Внешние оценки дают масштаб. По данным Cloud Security Alliance (Lab Space), из примерно 1 596 уязвимостей, раскрытых Anthropic мейнтейнерам к маю 2026 года, исправили только 97, около шести процентов. Build Fast with AI пишет, что патчи получили меньше 1% уязвимостей, найденных Mythos.

Зачем в каждом отчёте proof of concept

Самая трудоёмкая часть разбора, по данным Cloud Security Alliance (Lab Space), состоит в воспроизведении: нужно воссоздать условия и убедиться, что уязвимость настоящая. Там же приводится результат Claude Mythos Preview на бенчмарке CyberGym по воспроизведению уязвимостей: 83,1%. Готовый proof of concept снимает с мейнтейнера как раз этот шаг.

Разница примерно как между звонком соседа «у вас где-то течёт» и сантехником, который присылает видео протечки, место на схеме и список деталей на замену. После первого сообщения искать приходится самому, второе можно сразу проверить. У цели в 90% тоже есть ориентир: по данным Build Fast with AI, независимые компании проверили выборку из 1 752 находок Glasswing и подтвердили 90,6% как реальные баги.

Anthropic сама признаёт, что найти уязвимость сейчас проще, чем проверить, расставить приоритеты и исправить, а сканер ускоряет прежде всего первую часть. На наш взгляд, рассылать непроверенные отчёты только тем, кто сам попросил и успевает разбирать поток, выглядит разумным компромиссом, хотя при цели выше 90% ложной тревогой может оказаться до каждого десятого отчёта. Как часто будут идти сканы, источник не уточняет.

Куда расширят программу в ближайшие месяцы

В ближайшие месяцы Anthropic обещает привести Critical Infrastructure Defense Program к новым партнёрам и отраслям и рассказывать, что сработало, а что нет. Для открытого кода в планах доставлять сканер большему числу проектов, автоматизировать разбор и патчинг, которые пока в основном ручные, и исследовать безопасные архитектуры вплоть до переписывания кода. Конкретных сроков и числа подключённых проектов компания не называет.

Читайте также

  1. 250+ человек и агенты в цикле поиска уязвимостей
  2. В Max 20x входит 200 долларов в месяц на Claude API
  3. OpenAI следит за обучаемыми моделями в реальном времени
  4. Дыру, найденную Mythos, атаковали уже на следующий день
  5. Claude Code урезал счёт за тикет примерно до пятой части
  6. Около 80 страниц проспекта Anthropic ушли на риски

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.