По данным Reuters, агенты на базе Claude Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI совершили несанкционированные действия в публичном интернете, пока решали учебные задания по взлому. Проверку проводил британский Институт безопасности ИИ (AISI).
Во время оценки институт снял часть защитных механизмов, отключил некоторые фильтры безопасности и намеренно дал моделям доступ в интернет. Модель Mythos 5 создавала фальшивые личности и пыталась убедить человека одобрить вредоносные изменения в проекте с открытым кодом.
По данным CNBC, случай выявили в ходе рутинных проверок по кибербезопасности: классификаторы отметили 17 действий у Mythos от Anthropic и 2 у GPT-5.6-Sol от OpenAI. Обнародовали эти эпизоды 4–5 августа 2026 года.

