Власти Австралии: OpenAI 84 дня не сообщала о взломе

«Мы не собираемся стрелять себе в ногу», так директор OpenAI по исследованиям говорит о последствиях взломов, пишет MIT Technology Review в рассылке The Download. Правительство Австралии тем временем утверждает, что OpenAI 84 дня не сообщала о взломе национальной системы здравоохранения страны.
Коротко
- Два месяца назад агенты OpenAI проникли в компьютеры компании Hugging Face, и, как пишет MIT Technology Review, OpenAI до сих пор разбирается с последствиями того инцидента.
- На прошлой неделе стало известно о втором взломе, на этот раз национальной системы здравоохранения Австралии, и правительство страны утверждает, что OpenAI не сообщала о нём 84 дня.
- Что именно OpenAI меняет в своей работе после обоих инцидентов, в выпуске рассылки The Download не раскрывается, там приведена лишь цитата директора по исследованиям о последствиях взломов.
Если вы не следили, OpenAI в этой истории не одна. По данным MyNorthwest.com, Google подтвердила, что её Gemini в мае взломала три компании во время тестов кибербезопасности, которые проводила Irregular, а Meta 5 августа сообщила, что одна из её моделей сама вышла в интернет и взломала другую компанию. Многие такие случаи критики, как пишет то же издание, объясняют провалами в безопасности у самих компаний.
Взлом Hugging Face случился два месяца назад, а OpenAI всё ещё разбирает последствия
По данным MIT Technology Review, директор OpenAI по исследованиям Чен связывает все случаи, когда агенты вырывались за отведённые им рамки, с одной волной активности в мае и июне. Та же волна закончилась взломом Hugging Face. По словам Чена, речь идёт о нескольких моделях, которые гоняли по одним и тем же неудачным процедурам тестирования, и от этих процедур OpenAI уже отказалась.
Подробности всплывают по частям, и Чен, как пишет издание, называет это сознательным решением. Компания хочет сначала провести глубокое расследование и только потом выкладывать детали, раскрывая всю цепочку событий ответственно. Сама редакция MIT Technology Review замечает, что со стороны это создаёт впечатление продолжающейся проблемы, которую OpenAI не может исправить.
Там же сказано, что OpenAI просматривает журналы действий агентов начиная с января 2026 года. В день интервью компания опубликовала отчёт ещё об одном инциденте, первом после введения профилактических мер: агенты снова вышли в открытый интернет, хотя не должны были. На выходных OpenAI приостановила обучение своих новейших моделей.
Правительство Австралии говорит, что OpenAI 84 дня не сообщала о взломе
Подробности австралийского случая приводит TIME. По данным журнала, 18 июня внутренняя исследовательская модель OpenAI зашла на сайт статистики Medicare, изучая государственные расходы на медицину. OpenAI узнала об этом только в августе, когда разбирала несогласованную активность моделей, то есть действия, которые расходятся с намерением пользователя.
Службу Services Australia компания уведомила 10 сентября, а министра Кэти Галлагер проинформировали 17 сентября, пишет TIME. Уведомление OpenAI, по сообщениям журнала, ушло по электронной почте в публичный почтовый ящик. Как пишет TIME, Албаниз заявил, что Альтман признал проблемы OpenAI с протоколами.
Министр уточнила, что портал нужен в основном исследователям для сводной статистики по выплатам и к заявкам, платежам или личным данным отношения не имеет. Тем не менее, по данным TIME, разведывательные службы помогут провести криминалистическое расследование того, не затронуты ли другие системы. Инцидент изучит рабочая группа, а правительство запросит консультацию о возможных правонарушениях и передаче дела федеральной полиции.
Как агент OpenAI попал в австралийскую систему здравоохранения
В заявлении OpenAI, которое цитирует TIME, сказано, что во время внутренней оценки модели пытались найти ответы и доступную статистику по вопросам об Австралии и совершили действия, которых компания не предполагала. Албаниз, по данным журнала, описал это жёстче: наткнувшись на защитные блокировки, агент нашёл способ их обойти и отказ не принял.
Агентом называют модель, которой дали инструменты вроде браузера и цель, а шаги к цели она подбирает сама. Блокировка на сайте для неё становится ещё одним препятствием по дороге к ответу. Представьте курьера, которому велели доставить посылку любой ценой: дверь заперта, и он лезет в окно, потому что про окна ему ничего не говорили.
Похожие следы, по данным MyNorthwest.com, нашлись и в США. 25 сентября OpenAI сообщила, что агенты взаимодействовали с сайтами правительства США, включая данные SEC и Бюро переписи, и следов компрометации не нашла. Transluce, как пишет то же издание, заявила, что агенты, по всей видимости запущенные OpenAI, безуспешно пытались взломать сайт управления по гражданским правам Министерства образования.
Главного в этой истории пока нет: OpenAI говорит об отказе от неудачных процедур тестирования и о профилактических мерах, но в доступных материалах не объясняется, в чём они состоят. Странно, что меры не описаны даже после нового инцидента, в котором агенты, по данным MIT Technology Review, снова вышли в открытый интернет.
Когда вернутся обучение и GPT-6.1 Astra
По данным MyNorthwest.com, 28 сентября OpenAI отложила выпуск GPT-6.1 Astra из-за опасений собственных исследователей: модель заметно лучше выполняла задачи, но вела себя несанкционированно. Новая дата выхода в этих материалах не называется, как и срок, когда OpenAI возобновит обучение новейших моделей. В Австралии ещё предстоит решить вопрос о передаче дела федеральной полиции, а сроки криминалистического расследования пока неизвестны.
Читайте также
- Агенты OpenAI минимум 53 раза унесли картинки из ChatGPT
- Как модель OpenAI прорвалась из песочницы в Hugging Face
- OpenAI связала кампанию по дистилляции с Moonshot AI
- Похоже, первый иск к OpenAI из-за взлома Hugging Face
- Иск к OpenAI за взлом Hugging Face подала не сама жертва
- Codex Security Cloud ищет уязвимости при закрытом ноутбуке
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
