openai
Принудительный rm вылавливают в обёртках sudo и env
Promtime
openaiКоманда Codex усилила распознавание принудительных вызовов rm: детектор теперь срабатывает не только на прямую команду, но и на её вхождения в управляющих конструкциях и обёртках. О пакете изменений, снижающих риск разрушительных действий агента во время работы, сообщается в публикации в Twitter.
Коротко
- Поводом послужил разбор небольшого числа пользовательских сообщений, начатый несколькими неделями ранее; после него правки выкатывались постепенно и касались потенциально разрушительных операций Codex во время работы.
- Обновлённый детектор принудительных вызовов rm распознаёт их, по данным записи на GitHub, в управляющих конструкциях, подстановках, пайплайнах, ловушках, вложенных шеллах, а также в обёртках sudo и env.
- По данным OpenAI, режим Auto-review, вышедший 30 апреля 2026 года, обеспечивает большую часть расхода токенов Codex Desktop внутри самой компании, то есть остаётся основным сценарием внутреннего использования.
Разрушительные команды остаются главным ограничителем автономии кодовых агентов: чем шире права на выполнение shell-команд, тем дороже единичная ошибка. Расширение проверки на обёртки и вложенные конструкции выглядит как переход от сопоставления строк к разбору структуры команды, а это уровень, на котором обход детектора требует заметно больше усилий. Судя по всему, доверие к автономному режиму упирается сейчас именно в такие гарантии, а не в качество генерации кода.
Принудительный вызов rm означает удаление без запроса подтверждения. Проверка одного лишь начала строки такие команды пропускает: rm может оказаться внутри условия, подстановки команды, звена пайплайна или обработчика сигнала trap, оставаясь при этом рабочей командой. Обновлённый детектор Codex разбирает и эти позиции.
Отдельно учитываются обёртки: запуск через sudo или env меняет начало строки, но не результат выполнения и не риск для файлов. Тот же принцип применён к вложенным шеллам, когда rm стартует внутри дочернего интерпретатора. Все эти контексты названы в записи на GitHub.
Запись команды Codex подана как сводка: в ней перечисляются изменения последних недель, которые, по формулировке авторов, дополнительно снижают риск разрушительных действий агента при выполнении задач. Более ранний этап работы описан как изучение небольшого числа поступивших сообщений.
По данным OpenAI, большая часть расхода токенов Codex Desktop внутри самой компании приходится на режим Auto-review. Сам режим вышел 30 апреля 2026 года, а оценка распределения нагрузки актуальна на середину июля 2026 года. Показатель описывает внутреннее использование десктопного клиента сотрудниками OpenAI.
Полный перечень правок не раскрыт
Другие изменения этого пакета в доступных материалах не перечислены, хотя запись охватывает несколько недель работы. Не названы версии клиентов, в которых они действуют, и дальнейшие шаги по ограничению разрушительных операций. Точная доля Auto-review в расходе токенов Codex Desktop тоже не приводится: сказано лишь, что она составляет большую часть.
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
Из Google мы используем только имя и аватар. Почту не сохраняем.
