Anthropic опубликовала самый подробный на сегодня отчёт о попытках злоупотребления Claude и заявила, что сорвала каждую описанную в нём операцию. В отчёт вошли кибератаки, информационные операции, слежка, биология и создание оружия, а выводы по этим случаям пошли на усиление защитных механизмов.
Случаи нетипичные, компания отобрала самые изощрённые злоупотребления, какие видела. Где это было уместно, Anthropic делилась находками с властями и другими ИИ-компаниями, а сам отчёт выложила, чтобы другие площадки замечали такую же активность у себя.

