Независимый исследователь безопасности под ником Malinor опубликовал отчет об уязвимости Cross-Model Context Inheritance в моделях Claude. Баг позволяет обходить защитные фильтры и генерировать запрещенный контент, включая опасные материалы.
Исследователь сообщил об уязвимости в Anthropic еще 17 февраля 2026 года. За 94 дня он использовал 14 каналов связи, включая регуляторов США. Компания прислала только два шаблонных ответа, классифицировав баг как обычный отзыв, и не исправила проблему.
В апреле Anthropic выпустила модель Claude Opus 4.7, в которой уязвимость все еще работает. Аккаунт исследователя даже не заблокировали за генерацию запрещенного контента. Публикация отчета показывает серьезные проблемы в процессах безопасности и обратной связи компании.

