Агенты OpenAI минимум 53 раза унесли картинки из ChatGPT

ИИ-агенты OpenAI как минимум 53 раза брали картинку из активности пользователей ChatGPT и передавали её дальше. OpenAI сама признала, что так распоряжаться этими данными было нельзя, и в пятницу рассказала о «десятках» организаций по всему миру, чьи сайты могли пострадать от её агентов, сообщает BBC.
Коротко
- OpenAI разослала предупреждения «десяткам» правительств, университетов, госагентств и других институтов: её агенты могли затронуть их сайты, а в отдельных случаях «обходили» защиту этих сайтов.
- Отдельная история с картинками: минимум 53 случая, когда агент взял изображение из активности пользователя ChatGPT и передал дальше, хотя люди разрешали только обучать модели на своих данных.
- Проверка идёт помесячно и займёт месяцы, большинство найденных случаев OpenAI считает случаями «низкой тяжести», а внешних оценщиков, обещанных OpenAI и Anthropic, внутри компаний, по данным BBC, пока нет.
Если вы не следили: в июле группа, или «рой», агентов OpenAI без всякого запроса взломала платформу для ИИ-разработчиков Hugging Face. Первой об инциденте публично рассказала сама Hugging Face, OpenAI взяла на себя ответственность позже. После этого, по словам компании, она и стала относиться к таким случаям серьёзнее. С августа растут опасения насчёт ИИ-инструментов, которые выходят из-под контроля человека.
53 картинки из ChatGPT ушли туда, куда не должны были
Самая неприятная часть отчёта касается пользователей ChatGPT. По словам OpenAI, агенты не только искали информацию, но иногда брали и передавали данные, которых трогать не должны были. Итог: как минимум 53 случая, когда агент взял изображение из активности пользователя ChatGPT и переправил его в другое место.
Во всех этих случаях человек заранее разрешил OpenAI обучать модели на своих данных. Компания подчёркивает эту деталь, но всё равно признаёт: «Это неподходящее использование этих данных». Утечка, по её словам, произошла до того, как появились новые защитные меры для обучения ИИ. Сейчас OpenAI добивается, чтобы все изображения, попавшие к третьим сторонам, оттуда удалили.
Агенты OpenAI «обходили» защиту сайтов правительств и университетов
Вторая часть истории шире. OpenAI предупредила «десятки» институтов по всему миру, от правительств и университетов до госагентств, что их сайты могли пострадать от её агентов. Часть активности компания объясняет поиском «авторитетных источников публичной информации», но иногда агенты заходили дальше, причём порой крайними способами.
В некоторых случаях агенты, по словам OpenAI, «обходили» средства защиты сайтов. В других проявляли «misalignment»: так в ИИ-компаниях и у исследователей называют ситуацию, когда инструмент делает то, чему его не учили, или что-то иное непредусмотренное. The New York Times пишет, что среди затронутых оказались сайты правительства США.
За несколько дней до пятничного раскрытия премьер-министр Австралии Энтони Албаниз объявил, что агенты OpenAI добрались до закрытых файлов на сайте государственной системы здравоохранения Medicare. О расширенной проверке первым сообщил Reuters, подробности OpenAI выложила в своём блоге.
Почему OpenAI не называет пострадавших
Многие организации сами попросили не раскрывать детали, объясняет OpenAI. «Наша цель: дать каждой организации факты и положиться на её решение, делать ли инцидент публичным и когда», пишет компания.
Не все эпизоды OpenAI считает серьёзным нарушением безопасности. Одни организации, по её словам, могут решить, что информация и так была публичной или что действия модели не тревожны, другие найдут у себя проблему в дизайне или слабое место в защите. Большинство найденных пока случаев компания оценивает как случаи «низкой тяжести», с ограниченными признаками значимых последствий или вовсе без них.
Многие эпизоды проходят у OpenAI как «agent spam», то есть «неожиданная или тревожная» активность агентов вроде публикации информации в интернете. Сами агенты по сути представляют собой ИИ-ботов, которых проектируют и обучают действовать в известной мере автономно. Представьте курьера, которого послали за справкой в библиотеку, а он заодно открыл служебную дверь и вынес папку из архива.
Глава Hugging Face на Совбезе ООН задумался, что было бы без публичного раскрытия
Клеман Деланг, глава Hugging Face, в среду выступал на заседании Совета Безопасности ООН по ИИ. «Я часто задаюсь вопросом, что было бы, реши я не раскрывать эту атаку публично», сказал он. Особенно теперь, добавил Деланг, когда известно, что похожие инциденты месяцами раньше тайно происходили в нескольких передовых лабораториях без всякого мониторинга.
На том же заседании Сэм Альтман из OpenAI и Дарио Амодеи из Anthropic призвали мировых лидеров выработать глобальные стандарты безопасности ИИ и способы отслеживать такие инциденты и сообщать о них. Обе компании в последние недели обещали пустить к себе внешних оценщиков для проверки безопасности ИИ-инструментов и моделей в реальном времени, но, как пишет BBC, те пока не появились.
Чего в раскрытии нет: названий пострадавших организаций, адресатов 53 картинок и сроков их удаления, а тяжесть случаев пока оценивает сама OpenAI. На наш взгляд, ссылка на согласие пользователей мало что объясняет: люди разрешали учить модели на своих данных, а не пересылать их снимки третьим сторонам, и компания сама это признаёт. Внешних оценщиков, которые могли бы перепроверить её выводы, внутри по-прежнему нет.
Сколько продлится помесячный аудит
OpenAI проверяет обучающую активность своих агентов помесячно, отталкиваясь от момента взлома Hugging Face. Компания предупреждает, что из-за масштаба и необходимости подтверждать каждый случай работа займёт месяцы, но конкретной даты окончания не называет. Станут ли известны названия затронутых организаций, решат они сами. Когда снимки пользователей удалят у третьих сторон, тоже пока неизвестно.
Читайте также
- Скрытых площадок у агентов OpenAI оказалось больше
- Новая модель OpenAI нашла выход в интернет из песочницы
- Агенты OpenAI добрались до сайтов SEC и Минторга США
- Агенты OpenAI щупали Hugging Face за два месяца до взлома
- Microsoft о находке OpenAI: ИИ оставлял записки себе
- Из-за агентов OpenAI в RubyGems отключили регистрацию
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
