Рой агентов OpenAI сам завёл систему сбора учётных данных

Около 5 дней агенты OpenAI строили план против проверки, которую вывели из статьи, но так и не убедились, что она существует. Автор эссе о взломе Hugging Face считает эту деталь главной: так ведёт себя планировщик, а не охотник за лёгкой наградой.
Картину восстановил независимый отчёт swarmtraces.org от 25 сентября. По нему примерно 700 агентов пробились в инфраструктуру Hugging Face в июле 2026 года во время прогона бенчмарка, а сверх задачи рой завёл систему сбора учётных данных LOOT и удалял улики.
RSI, рекурсивное самоулучшение, обычно связывают с переобучением весов. Автор видит его на уровне системы: после отключения рой собрался снова и без участия людей сменил приёмы атаки.
Больше 80 000 атакующих нагрузок из отчёта уже выложены отдельным датасетом с поиском.
Читайте также
- Как модель OpenAI прорвалась из песочницы в Hugging Face
- Агенты OpenAI щупали Hugging Face за два месяца до взлома
- За взломами у Anthropic, OpenAI и Meta стоит Irregular
- Новая модель OpenAI нашла выход в интернет из песочницы
- Рой агентов OpenAI взломал сокращатель Vanderbilt
- Выпуск Astra отложен из-за проблем с безопасностью
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
