openai
Fast-режим отваливается в десктопном Codex с API-ключом
Promtime
openaiДесктопное приложение Codex при работе по API-ключу вырезает из запросов параметр service_tier=fast и отправляет service_tier=None: по замерам разработчика, опубликованным на Denta, медианная скорость на стоковой сборке составила 54,7 токена в секунду против 87,3 после ручной правки Electron-приложения, оба замера на GPT-5.6-sol с высоким уровнем рассуждений.
Коротко
- При авторизации по API-ключу переключатель Fast в интерфейсе десктопного клиента отсутствует, правки в конфигурационном файле Codex TOML на приложение не влияют, а штатного способа принудительно включить режим не нашлось.
- Все прогоны шли на GPT-5.6-sol с высоким уровнем рассуждений: в консольном Codex с API-ключом стандартный режим дал 57,5 токена в секунду, Fast 90,2, а десктоп с аккаунтом ChatGPT 35,3 и 45,6.
- Патч для Electron-сборки Codex Desktop выложен в репозитории codex-fast-mode-patcher на GitHub, автор сопровождает публикацию предупреждением о том, что операция опасна и поручать её агенту вслепую не следует.
Почему это важно Разница между клиентами при одном и том же ключе, судя по замерам, упирается в скорость генерации: консольный Codex отдаёт токены заметно быстрее стоковой десктопной сборки. Для практики это означает, что выбор оболочки влияет на итоговую производительность не меньше, чем выбор уровня рассуждений. Обходной путь при этом сводится к правке кода уже установленного приложения, что подходит не любому рабочему окружению.
Стоковый десктоп с API-ключом выдал 54,7 токена в секунду, патченная сборка 87,3
Для проверки автор написал бенчмарк codex-tps и прогнал матрицу конфигураций на GPT-5.6-sol с высоким уровнем рассуждений, фиксируя медианную скорость генерации. Стоковый десктоп с API-ключом и параметром service_tier=fast дал 54,7 токена в секунду, а сборка с принудительно включённым состоянием Fast в интерфейсе, полученная ручной правкой кода, 87,3.
Три другие конфигурации стокового десктопа с API-ключом на той же модели и том же уровне рассуждений дали 60,7 токена в секунду при service_tier вместе с флагом функции, 59,3 без каких-либо настроек Fast и 45,4 при одном лишь флаге функции. Все значения в таблице приведены как медианные.
Переключателя Fast в интерфейсе десктопного клиента при авторизации по ключу нет, и правки в конфигурационном файле Codex TOML на приложение не действуют. Принудительно включить режим штатными средствами не получается: разница в скорости появляется только после правки кода самого приложения, собранного на Electron.
В консольном Codex тот же ключ даёт 90,2 токена в секунду в режиме Fast
В консольном клиенте Codex режим Fast с API-ключом работает штатно. С тем же ключом на GPT-5.6-sol с высоким уровнем рассуждений стандартный режим показал медианные 57,5 токена в секунду, а Fast 90,2. Это наибольшее значение среди всех девяти конфигураций, вошедших в матрицу замеров.
Отдельно измерены два сценария с авторизацией через аккаунт ChatGPT в десктопном приложении: стандартный режим дал 35,3 токена в секунду, режим Fast/Priority 45,6, на той же модели и том же уровне рассуждений. Оба значения ниже любого из двух замеров консольного клиента с API-ключом.
Расхождение между клиентами автор считает ошибкой десктопной сборки, а не намеренно скрытым ограничением: рассуждение он строит на том, что режим Fast с API-ключом отрабатывает в консольном Codex. Почему десктопный клиент обнуляет параметр, он пока объяснить не берётся.
Codex Desktop подменяет service_tier=fast на service_tier=None
Разбор логов показал, что при работе по API-ключу десктопное приложение Codex вырезает переданный параметр service_tier=fast и обращается к API со значением service_tier=None. Ветки кода и логи автор опубликовал для каждой из девяти конфигураций матрицы, включая прогоны с аккаунтом ChatGPT, так что любую строку таблицы медианных значений можно перепроверить независимо от исходной публикации.
Исправление автор внёс сам, отредактировав Electron-сборку Codex Desktop, и выложил получившийся патч в репозитории codex-fast-mode-patcher на GitHub, предложив его тем, кто хочет применить ту же правку к своей копии приложения на собственной машине. Публикацию он сопровождает предупреждением о том, что операция опасна и поручать её агенту вслепую не следует.
Что дальше Пока в стоковой десктопной сборке быстрый режим с API-ключом не включается, обходной путь сводится к консольному клиенту либо к патчу из репозитория codex-fast-mode-patcher, который автор рекомендует применять с осторожностью. Причина, по которой десктопный клиент обнуляет параметр, остаётся невыясненной. Открытым остаётся и вопрос, распространяется ли поведение на другие модели и уровни рассуждений: замеры сделаны только на GPT-5.6-sol с высоким уровнем рассуждений.
Комментарии
Пока никто не написал. Будьте первым.
Присоединяйтесь к разговору
Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.
Из Google мы используем только имя и аватар. Почту не сохраняем.
