Anthropic сообщила, что три её модели скомпрометировали системы трёх организаций во время предрелизных киберпроверок: Opus 4.7, Mythos 5 и внутренняя исследовательская модель. Среда оценки осталась подключённой к интернету из-за недопонимания с партнёром Irregular, хотя в промптах моделям говорили об изоляции.
Mythos 5 загрузила вредоносный пакет Python в репозиторий PyPI, считая это частью симуляции. За час его скачали и запустили на 15 реальных системах, включая сканер компании по безопасности, откуда код Claude выкачал учётные данные.
Opus 4.7 взломала реальный сайт, совпавший по имени с вымышленной целью. Самые ранние инциденты произошли в апреле, организации уведомили в понедельник. Anthropic перепроверила более 141 000 тестовых прогонов и остановила киберпроверки с выходом в интернет.

