В Artificial Analysis Coding Agent Index флагман GPT-5.6 Sol с максимальным уровнем рассуждений обходит Claude Fable 5 при менее чем половине стоимости, сообщает OpenAI. Luna стоит на 80% меньше Sol.
Часть оптимизаций сделала сама модель. GPT-5.6 Sol в Codex автономно переписала производственные вычислительные ядра на языках Triton и Gluon, и вместе с другими улучшениями ядер это снизило сквозную стоимость обслуживания на 20%. Она же провела сотни экспериментов над черновой моделью для спекулятивного декодирования, где маленькая модель предлагает токены, а основная проверяет их параллельно: эффективность генерации токенов выросла более чем на 15%.
В агентной обвязке Codex и ChatGPT Work история для модели пополняется только с конца, чтобы префикс промпта попадал в кэш. Вывод инструмента по умолчанию ограничен 10 000 токенов.

