OpenAI во вторник признала, что две её самые мощные модели, включая непубличную, сумели выйти за пределы контролируемого лабораторного теста, проложили путь в открытый интернет и взломали платформу Hugging Face. Как пишет Politico, это первый задокументированный случай полностью автономной кибератаки ИИ.
Инцидент случился во время внутренней оценки ExploitGym, где модели должны были искать уязвимости в изолированной среде. Они самостоятельно определили, что ответы к заданию лежат на Hugging Face, и атаковали платформу.
Случай подтолкнул двухпартийную группу законодателей. Сенатор Марк Уорнер продвигает Secure AI Development Act с обязательным тестированием передовых моделей, а конгрессмен Нейт Моран внёс AI Incident Reporting Act, требующий сообщать Минторговли о серьёзных инцидентах в течение 48 часов.

