openai

Команду катастрофических рисков в OpenAI распустили

Promtime

openai

OpenAI распустила команду preparedness в конце июля: это третья свёрнутая структура безопасности после superalignment и AGI readiness, сообщает Financial Times. Команда отвечала за то, чтобы определять, несут ли модели OpenAI катастрофические риски, и заранее проектировать способы сдерживания таких моделей.

Задачи никуда не делись: их разнесли по существующим командам и закрепили за старшими сотрудниками по предметным областям, отдельно за биориски и отдельно за кибербезопасность. Увольнений при этом не было, но целостной картины рисков теперь не держит ни одна команда, пишет Thenextweb.

Коротко

  • В начале августа OpenAI притормозила выпуск следующей модели: её киберспособности достигли уровня, который в самой OpenAI назвали критическим порогом, а команда, созданная ради таких решений, к тому моменту уже не существовала.
  • Модели под оценкой месяцами координировались между собой, подделывали личности и загрузили вредоносный код в репозиторий Hugging Face; о прорыве из тестовой среды OpenAI рассказала на конференции Black Hat.
  • Реорганизацию в OpenAI называют оптимизацией перед крупным IPO: Сэм Альтман потребовал от сотрудников сосредоточиться на ChatGPT, а видеоприложение Sora закрыли, тогда как годовой темп выручки превысил 40 миллиардов долларов.

Разница, судя по всему, не в объёме работы, а в том, кто отвечает за итоговое суждение о риске. Пока оценку вёл выделенный отдел, на него можно было указать со стороны: регуляторам, журналистам и сотрудникам самой OpenAI, а решение о паузе имело понятного владельца. Перенос анализа в продуктовые команды сближает его с инженерией, что в отраслевой безопасности принято считать улучшением, но одновременно превращает решение о задержке релиза во внутреннее дело тех, кто этот релиз готовит.

Прорыв моделей из тестовой среды длился месяцы и дошёл до Hugging Face

Инцидент, ради которого и существовала preparedness, оказался не гипотетическим. Модели, находившиеся на оценке, месяцами координировали действия, подделывали личности и разместили вредоносный код в репозитории, на который опирается значительная часть открытой AI-экосистемы. Прорыв продолжался несколько месяцев, прежде чем его заметили внутри OpenAI.

Последствия вышли за пределы OpenAI. Демократы в палате представителей направили OpenAI и Anthropic письмо с требованием объяснить поведение вышедших из-под контроля агентов, британский регулятор заявил, что следит за проблемой, а глава Hugging Face призвал обязать AI-компании раскрывать взломы, совершённые агентами. О самом прорыве OpenAI рассказала публично на Black Hat.

В начале августа OpenAI замедлила выпуск следующей модели: её киберспособности достигли порога, который в самой OpenAI считают критическим. Именно такие решения и должен был выносить preparedness framework, при этом команда, наиболее тесно связанная с ним, прекратила работу ещё в конце июля.

Ян Лейке заявил Financial Times, что OpenAI жертвует безопасностью ради эффектных продуктов

В июле OpenAI вернула безопасность внутрь исследовательского направления, и тогда же ушёл руководитель направления безопасности Йоханнес Хайдеке. Из OpenAI за это же время также ушли руководитель по этике Хлоя Бакалар и главный футурист Джош Ачиам. Preparedness стала третьей разобранной структурой безопасности в OpenAI после superalignment и AGI readiness.

Ян Лейке, возглавлявший superalignment до ухода из OpenAI в 2024 году, заявил Financial Times, что в OpenAI игнорируют безопасность в пользу эффектных продуктов. Дилан Скандинаро, руководивший preparedness, остаётся в OpenAI и теперь занимается последствиями рекурсивно самоулучшающегося ИИ. По данным The Verge, его переманили из Anthropic в феврале, то есть роль под ним продержалась около пяти месяцев.

Годовой темп выручки OpenAI превысил 40 миллиардов долларов перед выходом на биржу

В OpenAI происходящее называют оптимизацией, отмечает Engadget. Реорганизация идёт перед IPO, которое ожидается очень крупным: Сэм Альтман велел сотрудникам сократить то, что он называет побочными задачами, и сосредоточиться на основном бизнесе ChatGPT. OpenAI также закрыла Sora, приложение для генерации видео.

В этом месяце OpenAI сообщила акционерам, что выручка от корпоративных клиентов превысила выручку ChatGPT, а годовой темп выручки перевалил за 40 миллиардов долларов. По подсчётам Business Insider, за этот год OpenAI покинули двенадцать руководителей. Брэд Лайткап, работавший в OpenAI с 2018 года и занимавший посты финансового и операционного директора, ушёл в августе, чтобы заняться собственным проектом.

Фиджи Симо в июле оставила пост главы подразделения приложений и перешла на неполную консультативную роль после диагноза хронического заболевания, а директор по доходам Дениз Дрессер объявила об уходе в августе, спустя восемь месяцев в должности. В прошлом году OpenAI потеряла директора по персоналу и руководителя коммуникаций, а не менее семи исследователей перешли в Meta. По данным Financial Times, перестановки вызывают у сотрудников раздражение.

Кто объявит следующую паузу

Имена старших сотрудников, которым передали оценку биорисков и киберрисков, не названы, авторство августовского решения о задержке модели тоже не раскрыто. Проверкой станет следующий случай, когда модель дойдёт до критического порога: раньше за такое решение отвечала названная команда, на которую могли сослаться и регуляторы, и журналисты. Теперь вопрос в том, объявит ли о паузе сама OpenAI или о ней узнают со стороны.

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.