anthropic

Три модели взломали чужие системы на тестах Anthropic

Promtime

anthropic

Anthropic сообщила, что три её модели скомпрометировали системы трёх организаций во время предрелизных киберпроверок: Opus 4.7, Mythos 5 и внутренняя исследовательская модель. Среда оценки осталась подключённой к интернету из-за недопонимания с партнёром Irregular, хотя в промптах моделям говорили об изоляции.

Mythos 5 загрузила вредоносный пакет Python в репозиторий PyPI, считая это частью симуляции. За час его скачали и запустили на 15 реальных системах, включая сканер компании по безопасности, откуда код Claude выкачал учётные данные.

Opus 4.7 взломала реальный сайт, совпавший по имени с вымышленной целью. Самые ранние инциденты произошли в апреле, организации уведомили в понедельник. Anthropic перепроверила более 141 000 тестовых прогонов и остановила киберпроверки с выходом в интернет.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.