Сканер Anthropic шлёт отчёты о багах без проверки людьми

Anthropic будет отправлять мейнтейнерам open-source проектов отчёты об уязвимостях, которые написала модель и не проверял ни один человек, и сразу предупреждает, что в части отчётов будут ошибки. Так устроен бесплатный OSS Scanner, одна из двух первых частей программы Anthropic Cyber Mission, о которой объявила Anthropic.
Коротко
- Anthropic Cyber Mission начинается с двух направлений: защиты операционных технологий в энергосетях, водоканалах и на транспорте и поиска уязвимостей в открытом коде, на котором держится почти весь софт.
- Каждый отчёт OSS Scanner содержит proof of concept, объяснение и, где возможно, предложенный патч; Anthropic ждёт долю верных срабатываний выше 90% и обещает постепенно её повышать.
- Находить баги стало проще, чем чинить: в Project Glasswing между находкой и патчем часто проходили месяцы, а в операционных технологиях исправление в редких случаях может ждать десятилетия.
Если вы не следили: по данным Anthropic, Project Glasswing стартовал 7 апреля 2026 года вокруг Claude Mythos Preview, невыпущенной модели, которая, по словам компании, в поиске и эксплуатации уязвимостей уступает лишь самым сильным специалистам-людям. Первые итоги, как пишет Build Fast with AI, вышли 22 мая: 23 019 найденных уязвимостей более чем в 1 000 open-source проектов, из них 6 202 оценены как высокой или критической опасности.
OSS Scanner отправляет мейнтейнерам отчёты без проверки людьми
В Glasswing схема была осторожной. Anthropic сканировала сотни популярных open-source проектов, люди разбирали и проверяли многие из найденных потенциальных уязвимостей, а результаты уходили мейнтейнерам приватно, через процесс скоординированного раскрытия. Часть мейнтейнеров, которым хватает сил на разбор в больших объёмах, попросила присылать всё, что нашли модели, проверенное или нет.
Ответом стал OSS Scanner, сервис по образцу Google OSS-Fuzz, к которому проекты подключаются сами. Записавшиеся проекты регулярно и бесплатно получают сканы от самых сильных моделей Anthropic. В каждом отчёте есть proof of concept, то есть демонстрация того, как баг можно эксплуатировать, плюс объяснение и, если найдётся, предложенный патч.
Отчёты пишет модель, и уходят они без человеческой проверки. Так быстрее, но Anthropic прямо говорит о неточностях, например о неверной оценке критичности. Компания ждёт долю верных срабатываний выше 90% и обещает со временем подтянуть и её, и качество патчей. Сервис рассчитан на проекты, которые успевают разбирать находки; остальным по-прежнему придут проверенные людьми отчёты по политике CVD.
В программу защиты инфраструктуры вошли 11 партнёров, от Accenture до Rockwell Automation
Вторая часть миссии касается операционных технологий: контроллеров, управляющего софта и промышленных сетей, на которых работают энергосети, водоканалы, заводы и транспорт. Такое оборудование строят на десятилетия, и его часто нельзя выключить ради патча, поэтому известные уязвимости остаются открытыми годами. Техника проприетарная, любое изменение рискованно, а ошибка может остановить станцию.
Critical Infrastructure Defense Program приводит модели Claude, инженеров на местах и исследования угроз Anthropic к доверенным подрядчикам, на которых полагаются операторы. Партнёры-основатели: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC и Rockwell Automation. Среди них консультанты, компании по защите сетей и производители самого оборудования.
По словам Anthropic, работа уже идёт: несколько партнёров с помощью Claude чинят уязвимости и помогают в этом клиентам. Первым шагом компания называет работу с небольшой группой подрядчиков, чтобы понять, какие подходы действительно работают. С июня у Anthropic действует программа для властей штатов, округов, племён и территорий: модели и техподдержку там предложили больше чем половине штатов США и ряду крупнейших публичных операторов инфраструктуры.
Бесплатность сканера оплачивает фонд 0xDAF, запущенный в августе
Anthropic профинансировала организации, стоящие за широко используемым открытым кодом: Python Software Foundation, Alpha-Omega и OpenSSF через Linux Foundation, Apache Software Foundation. Поддержку получили и Akrites с Gold Eagle, которые собирают и координируют сообщения об уязвимостях из многих источников, чтобы мейнтейнеров не завалило потоком.
Defender Advantage Fund (0xDAF), запущенный в августе, финансирует пилотные программы в этих направлениях и держит OSS Scanner бесплатным. Мейнтейнеры могут подать заявку в Claude for Open Source на бесплатную подписку Claude Max, а в Cyber Verification Program на расширенный доступ к кибервозможностям Claude для защитной работы. В эту программу на этой неделе влился и сам Glasswing.
Anthropic ждёт перевеса защиты через два года, но не в ближайшее время
Свою логику Anthropic объясняет прямо. Модели с сильными кибервозможностями уже широко доступны атакующим, а защитные инструменты, включая её собственные, до многих защитников пока не дошли. Прогноз компании: через два года ИИ будет на стороне защиты, баги станет проще ловить до релиза. В ближайшее время, признаёт Anthropic, это может быть не так.
Эксплуатация уязвимостей подешевела, а проверка, раскрытие и исправление остаются медленными и держатся на людях. В Glasswing между находкой и патчем часто проходили месяцы, а в операционных технологиях исправление в редких случаях может ждать десятилетия, пока его получится безопасно применить на работающем оборудовании.
Внешние оценки дают масштаб. По данным Cloud Security Alliance (Lab Space), из примерно 1 596 уязвимостей, раскрытых Anthropic мейнтейнерам к маю 2026 года, исправили только 97, около шести процентов. Build Fast with AI пишет, что патчи получили меньше 1% уязвимостей, найденных Mythos.
Зачем в каждом отчёте proof of concept
Самая трудоёмкая часть разбора, по данным Cloud Security Alliance (Lab Space), состоит в воспроизведении: нужно воссоздать условия и убедиться, что уязвимость настоящая. Там же приводится результат Claude Mythos Preview на бенчмарке CyberGym по воспроизведению уязвимостей: 83,1%. Готовый proof of concept снимает с мейнтейнера как раз этот шаг.
Разница примерно как между звонком соседа «у вас где-то течёт» и сантехником, который присылает видео протечки, место на схеме и список деталей на замену. После первого сообщения искать приходится самому, второе можно сразу проверить. У цели в 90% тоже есть ориентир: по данным Build Fast with AI, независимые компании проверили выборку из 1 752 находок Glasswing и подтвердили 90,6% как реальные баги.
Anthropic сама признаёт, что найти уязвимость сейчас проще, чем проверить, расставить приоритеты и исправить, а сканер ускоряет прежде всего первую часть. На наш взгляд, рассылать непроверенные отчёты только тем, кто сам попросил и успевает разбирать поток, выглядит разумным компромиссом, хотя при цели выше 90% ложной тревогой может оказаться до каждого десятого отчёта. Как часто будут идти сканы, источник не уточняет.
Куда расширят программу в ближайшие месяцы
В ближайшие месяцы Anthropic обещает привести Critical Infrastructure Defense Program к новым партнёрам и отраслям и рассказывать, что сработало, а что нет. Для открытого кода в планах доставлять сканер большему числу проектов, автоматизировать разбор и патчинг, которые пока в основном ручные, и исследовать безопасные архитектуры вплоть до переписывания кода. Конкретных сроков и числа подключённых проектов компания не называет.
Читайте также
- 250+ человек и агенты в цикле поиска уязвимостей
- В Max 20x входит 200 долларов в месяц на Claude API
- OpenAI следит за обучаемыми моделями в реальном времени
- Дыру, найденную Mythos, атаковали уже на следующий день
- Claude Code урезал счёт за тикет примерно до пятой части
- Около 80 страниц проспекта Anthropic ушли на риски
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
