Anthropic шлёт опенсорсу находки моделей без ручной проверки

Часть мейнтейнеров открытого кода сама попросила Anthropic присылать всё, что модели нашли в их проектах, включая находки без проверки людьми. Anthropic согласилась, и так появился OSS Scanner, одна из двух первых частей новой Anthropic Cyber Mission, о которой компания рассказала в анонсе Anthropic.
Коротко
- Anthropic Cyber Mission начинается с двух направлений: защиты операционных технологий в энергосетях, водоканалах и транспорте через программу CIDP и бесплатного сканирования уязвимостей в открытом коде через OSS Scanner.
- Подключённые по записи проекты периодически сканируют самые сильные модели Anthropic, а каждый отчёт содержит пример эксплуатации бага, объяснение и, где это возможно, предложенный фикс.
- Отчёты пишет модель, и уходят они мейнтейнерам без ручной проверки, поэтому часть будет с ошибками вроде неверной оценки серьёзности; Anthropic ожидает долю верных срабатываний выше 90%.
Если вы не следили: в февральском исследовании 2026 года, как писала сама Anthropic, Claude Opus 4.6 нашла и подтвердила больше 500 уязвимостей высокой серьёзности в открытом коде. В апреле 2026 года, по данным The Hacker News, стартовал Project Glasswing: AWS, Apple, Microsoft, Linux Foundation и другие партнёры получили превью Claude Mythos, а в общий доступ модель не вышла из-за риска злоупотреблений.
OSS Scanner шлёт отчёты без ручной проверки, Anthropic ожидает больше 90% верных срабатываний
Во время Project Glasswing Anthropic просканировала сотни популярных открытых проектов. Люди разбирали и проверяли многие потенциальные уязвимости, а результаты уходили мейнтейнерам приватно, по процедуре скоординированного раскрытия (CVD). Некоторые мейнтейнеры, у которых хватает сил разбирать находки потоком, попросили отдавать им всё подряд, проверенное или нет.
OSS Scanner отвечает на эту просьбу. Сервис работает по записи и сделан по образцу OSS-Fuzz от Google: подключённый проект бесплатно и периодически получает сканирование самыми сильными моделями Anthropic. В отчёте три части: proof of concept, то есть рабочий пример эксплуатации, объяснение и предложенный фикс, если он есть.
Людей в этой цепочке нет. Отчёты доходят быстрее, но Anthropic прямо предупреждает, что часть окажется неточной, например с неверной оценкой серьёзности. Компания ожидает долю верных срабатываний выше 90% и собирается со временем поднимать и её, и качество фиксов. Проектам, которые не потянут такой поток, Anthropic продолжит присылать проверенные людьми отчёты по своей политике CVD.
В программу защиты инфраструктуры вошли 11 компаний, от Accenture до Rockwell Automation
Вторая часть миссии касается операционных технологий: контроллеров, управляющего софта и промышленных сетей, на которых работают энергосети, водоканалы, заводы и транспорт. Их строят на десятилетия, и часто их нельзя выключить ради патча, так что известные уязвимости остаются открытыми годами. Оборудование проприетарное, любое изменение рискованно, а ошибка может остановить целую станцию.
Операторы любого размера опираются на узкий круг доверенных подрядчиков. Critical Infrastructure Defense Program (CIDP) даёт этим подрядчикам модели Claude, инженеров Anthropic на местах и её исследования угроз. Партнёры-основатели: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC и Rockwell Automation.
По словам Anthropic, работа уже идёт: несколько партнёров вместе с Claude исправляют уязвимости и помогают клиентам делать то же самое. Начинают с небольшой группы подрядчиков, чтобы понять, какие подходы работают на практике. Другие компании, которые делают продукты и сервисы безопасности для инфраструктуры, могут оставить заявку.
Фонд 0xDAF, запущенный в августе, держит OSS Scanner бесплатным
Anthropic профинансировала организации, которые стоят за популярным открытым кодом: Python Software Foundation, Alpha-Omega и OpenSSF через Linux Foundation, Apache Software Foundation. Поддержку получили и Akrites с Gold Eagle, которые собирают отчёты об уязвимостях из многих источников и координируют их, чтобы не завалить мейнтейнеров.
Defender Advantage Fund (0xDAF), запущенный Anthropic в августе, поддерживает пилотные программы в этих областях и держит OSS Scanner бесплатным. Мейнтейнеры могут подать заявку в Claude for Open Source на бесплатную подписку Max и в Cyber Verification Program за расширенным доступом к киберспособностям Claude для защиты. В начале этой недели в расширенную Cyber Verification Program влили и сам Glasswing.
Есть и государственная линия. В июне Anthropic запустила программу киберзащиты для властей штатов, местных, племенных и территориальных администраций. С тех пор модели Claude и техподдержку получили больше половины штатов США и несколько крупнейших публичных операторов инфраструктуры: для сканирования и патчинга кода, реагирования на инциденты, red teaming.
Почему Opus 4.6 находила то, что пропустили фаззеры
Фаззер берёт грубой силой: бросает в программу горы случайных входных данных и смотрит, что сломается. По описанию Anthropic, в февральском исследовании Opus 4.6 работала иначе: читала код как исследователь, искала по прошлым исправлениям похожие незакрытые баги, замечала проблемные шаблоны и понимала логику настолько, чтобы подобрать ломающий вход. Фаззер дёргает подряд все дверные ручки, а модель сначала изучает поэтажный план.
В том же исследовании Anthropic писала, что часть находок сделана в кодовых базах, где фаззеры годами потратили миллионы часов процессорного времени, а некоторые баги оставались незамеченными десятилетиями. По данным The Hacker News, этим навыкам Anthropic модели специально не учила: они выросли из общих улучшений в коде, рассуждении и автономности, и помогают одинаково и патчить, и эксплуатировать.
Сама Anthropic признаёт, что находить уязвимости стало проще, чем когда-либо, а проверять, расставлять приоритеты и чинить по-прежнему трудно, и по итогам Glasswing снизить киберриск в достаточной мере пока не удалось. OSS Scanner, судя по всему, переносит эту трудную часть на мейнтейнеров: при ожидаемой доле верных срабатываний выше 90% ложные отчёты тоже придётся разбирать людям проекта. На наш взгляд, разумно, что сервис адресован только проектам, способным поспевать за находками, хотя в анонсе не сказано, кто и как определяет эту способность.
Куда двинется OSS Scanner
Anthropic называет сканер первым шагом. Дальше в планах три вещи: довести находки до большего числа проектов, сохранив проверенное людьми раскрытие для тех, кому оно нужно; автоматизировать разбор и патчинг, которые пока в основном ручные; исследовать более безопасные архитектуры и переписывание кода. Сроки этих шагов не названы, как и новые направления, в которые компания обещает расширить миссию.
Читайте также
- Anthropic открывает Claude для пентестов и red-teaming
- Проверка CIMD в клиентах Anthropic: тест против своего сервера
- SDK для Claude сами ведут цикл computer use, браузер ваш
- Anthropic передала полиции запись из «дневника» в Claude
- Конституция Claude запрещает даже ложь из вежливости
- Дыру, найденную Mythos, начали эксплуатировать через сутки
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
