Перейти к содержанию

anthropic

Anthropic шлёт опенсорсу находки моделей без ручной проверки

Claude News

Часть мейнтейнеров открытого кода сама попросила Anthropic присылать всё, что модели нашли в их проектах, включая находки без проверки людьми. Anthropic согласилась, и так появился OSS Scanner, одна из двух первых частей новой Anthropic Cyber Mission, о которой компания рассказала в анонсе Anthropic.

Коротко

  • Anthropic Cyber Mission начинается с двух направлений: защиты операционных технологий в энергосетях, водоканалах и транспорте через программу CIDP и бесплатного сканирования уязвимостей в открытом коде через OSS Scanner.
  • Подключённые по записи проекты периодически сканируют самые сильные модели Anthropic, а каждый отчёт содержит пример эксплуатации бага, объяснение и, где это возможно, предложенный фикс.
  • Отчёты пишет модель, и уходят они мейнтейнерам без ручной проверки, поэтому часть будет с ошибками вроде неверной оценки серьёзности; Anthropic ожидает долю верных срабатываний выше 90%.

Если вы не следили: в февральском исследовании 2026 года, как писала сама Anthropic, Claude Opus 4.6 нашла и подтвердила больше 500 уязвимостей высокой серьёзности в открытом коде. В апреле 2026 года, по данным The Hacker News, стартовал Project Glasswing: AWS, Apple, Microsoft, Linux Foundation и другие партнёры получили превью Claude Mythos, а в общий доступ модель не вышла из-за риска злоупотреблений.

OSS Scanner шлёт отчёты без ручной проверки, Anthropic ожидает больше 90% верных срабатываний

Во время Project Glasswing Anthropic просканировала сотни популярных открытых проектов. Люди разбирали и проверяли многие потенциальные уязвимости, а результаты уходили мейнтейнерам приватно, по процедуре скоординированного раскрытия (CVD). Некоторые мейнтейнеры, у которых хватает сил разбирать находки потоком, попросили отдавать им всё подряд, проверенное или нет.

OSS Scanner отвечает на эту просьбу. Сервис работает по записи и сделан по образцу OSS-Fuzz от Google: подключённый проект бесплатно и периодически получает сканирование самыми сильными моделями Anthropic. В отчёте три части: proof of concept, то есть рабочий пример эксплуатации, объяснение и предложенный фикс, если он есть.

Людей в этой цепочке нет. Отчёты доходят быстрее, но Anthropic прямо предупреждает, что часть окажется неточной, например с неверной оценкой серьёзности. Компания ожидает долю верных срабатываний выше 90% и собирается со временем поднимать и её, и качество фиксов. Проектам, которые не потянут такой поток, Anthropic продолжит присылать проверенные людьми отчёты по своей политике CVD.

В программу защиты инфраструктуры вошли 11 компаний, от Accenture до Rockwell Automation

Вторая часть миссии касается операционных технологий: контроллеров, управляющего софта и промышленных сетей, на которых работают энергосети, водоканалы, заводы и транспорт. Их строят на десятилетия, и часто их нельзя выключить ради патча, так что известные уязвимости остаются открытыми годами. Оборудование проприетарное, любое изменение рискованно, а ошибка может остановить целую станцию.

Операторы любого размера опираются на узкий круг доверенных подрядчиков. Critical Infrastructure Defense Program (CIDP) даёт этим подрядчикам модели Claude, инженеров Anthropic на местах и её исследования угроз. Партнёры-основатели: Accenture, Booz Allen, CrowdStrike, Deloitte, Dragos, Hitachi, Insane Cyber, Nozomi Networks, Palo Alto Networks, PwC и Rockwell Automation.

По словам Anthropic, работа уже идёт: несколько партнёров вместе с Claude исправляют уязвимости и помогают клиентам делать то же самое. Начинают с небольшой группы подрядчиков, чтобы понять, какие подходы работают на практике. Другие компании, которые делают продукты и сервисы безопасности для инфраструктуры, могут оставить заявку.

Фонд 0xDAF, запущенный в августе, держит OSS Scanner бесплатным

Anthropic профинансировала организации, которые стоят за популярным открытым кодом: Python Software Foundation, Alpha-Omega и OpenSSF через Linux Foundation, Apache Software Foundation. Поддержку получили и Akrites с Gold Eagle, которые собирают отчёты об уязвимостях из многих источников и координируют их, чтобы не завалить мейнтейнеров.

Defender Advantage Fund (0xDAF), запущенный Anthropic в августе, поддерживает пилотные программы в этих областях и держит OSS Scanner бесплатным. Мейнтейнеры могут подать заявку в Claude for Open Source на бесплатную подписку Max и в Cyber Verification Program за расширенным доступом к киберспособностям Claude для защиты. В начале этой недели в расширенную Cyber Verification Program влили и сам Glasswing.

Есть и государственная линия. В июне Anthropic запустила программу киберзащиты для властей штатов, местных, племенных и территориальных администраций. С тех пор модели Claude и техподдержку получили больше половины штатов США и несколько крупнейших публичных операторов инфраструктуры: для сканирования и патчинга кода, реагирования на инциденты, red teaming.

Почему Opus 4.6 находила то, что пропустили фаззеры

Фаззер берёт грубой силой: бросает в программу горы случайных входных данных и смотрит, что сломается. По описанию Anthropic, в февральском исследовании Opus 4.6 работала иначе: читала код как исследователь, искала по прошлым исправлениям похожие незакрытые баги, замечала проблемные шаблоны и понимала логику настолько, чтобы подобрать ломающий вход. Фаззер дёргает подряд все дверные ручки, а модель сначала изучает поэтажный план.

В том же исследовании Anthropic писала, что часть находок сделана в кодовых базах, где фаззеры годами потратили миллионы часов процессорного времени, а некоторые баги оставались незамеченными десятилетиями. По данным The Hacker News, этим навыкам Anthropic модели специально не учила: они выросли из общих улучшений в коде, рассуждении и автономности, и помогают одинаково и патчить, и эксплуатировать.

Сама Anthropic признаёт, что находить уязвимости стало проще, чем когда-либо, а проверять, расставлять приоритеты и чинить по-прежнему трудно, и по итогам Glasswing снизить киберриск в достаточной мере пока не удалось. OSS Scanner, судя по всему, переносит эту трудную часть на мейнтейнеров: при ожидаемой доле верных срабатываний выше 90% ложные отчёты тоже придётся разбирать людям проекта. На наш взгляд, разумно, что сервис адресован только проектам, способным поспевать за находками, хотя в анонсе не сказано, кто и как определяет эту способность.

Куда двинется OSS Scanner

Anthropic называет сканер первым шагом. Дальше в планах три вещи: довести находки до большего числа проектов, сохранив проверенное людьми раскрытие для тех, кому оно нужно; автоматизировать разбор и патчинг, которые пока в основном ручные; исследовать более безопасные архитектуры и переписывание кода. Сроки этих шагов не названы, как и новые направления, в которые компания обещает расширить миссию.

Читайте также

  1. Anthropic открывает Claude для пентестов и red-teaming
  2. Проверка CIMD в клиентах Anthropic: тест против своего сервера
  3. SDK для Claude сами ведут цикл computer use, браузер ваш
  4. Anthropic передала полиции запись из «дневника» в Claude
  5. Конституция Claude запрещает даже ложь из вежливости
  6. Дыру, найденную Mythos, начали эксплуатировать через сутки

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.