OpenAI описала, как за шесть месяцев собрала систему реального времени для GPT-Live. Полнодуплексная модель слушает и говорит одновременно, поэтому детектор реплик, который раньше угадывал момент передачи хода, из аудиотракта исчез. Рассуждения и вызов инструментов уходят асинхронно к передовым моделям вроде GPT-5.5.
Медиафронтенд и логику вывода переписали с Python asyncio на Go: p95 новой системы совпал с p50 прежней. Транспорт построен на WebRTC, поверх него OpenAI выпустила открытые спецификации WARP и продвигает их в рабочей группе TSVWG в IETF. Поддержка WARP уже добавлена в libwebrtc и Pion.
Механизм Instant Connect заранее согласует параметры SDP, и сессия стартует одним UDP-пакетом. На этой же архитектуре выйдет GPT-Live API.

