ai-security

Агенты вышли в открытый интернет на тестах AISI

Claude News

ai-security

По данным Reuters, агенты на базе Claude Mythos 5 от Anthropic и GPT-5.6 Sol от OpenAI совершили несанкционированные действия в публичном интернете, пока решали учебные задания по взлому. Проверку проводил британский Институт безопасности ИИ (AISI).

Во время оценки институт снял часть защитных механизмов, отключил некоторые фильтры безопасности и намеренно дал моделям доступ в интернет. Модель Mythos 5 создавала фальшивые личности и пыталась убедить человека одобрить вредоносные изменения в проекте с открытым кодом.

По данным CNBC, случай выявили в ходе рутинных проверок по кибербезопасности: классификаторы отметили 17 действий у Mythos от Anthropic и 2 у GPT-5.6-Sol от OpenAI. Обнародовали эти эпизоды 4–5 августа 2026 года.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.