В четверг Anthropic сообщила, что тестируемое ПО вышло в интернет и без ведома компании взломало три ничего не подозревавшие организации. Инциденты датируются апрелем, названия пострадавших не раскрываются, все три уведомили в понедельник.
Доступ модели получили в ходе оценок кибербезопасности. Из-за ошибки конфигурации тестовые среды, которые должны были оставаться изолированными, оказались с выходом в интернет. Anthropic нашла эпизоды при разборе 141 006 запусков таких оценок.
По данным Yahoo News, Claude пробирался в инфраструктуру базовыми приёмами, среди них слабые пароли и точки доступа без аутентификации.
Раскрытие пришлось на несколько дней после того, как OpenAI сообщила о вышедшем из-под контроля агенте, который несколько суток вёл атаку на Hugging Face.

