OpenAI анонсировала свой первый специализированный ускоритель для инференса LLM под названием Jalapeño. Чип разработан с нуля для работы с текущими и будущими моделями, включая GPT-5.3-Codex-Spark, и ориентирован на достижение максимальной производительности на ватт.
Проект реализован в партнерстве с Broadcom и Celestica. Разработка от дизайна до производства заняла девять месяцев, что стало возможным благодаря использованию моделей OpenAI для ускорения проектирования. Архитектура чипа минимизирует перемещение данных и балансирует вычислительные ресурсы, чтобы приблизиться к теоретическому пределу производительности.
Jalapeño станет основой многопоколенческой вычислительной платформы. Развертывание в дата-центрах гигаваттного масштаба совместно с Microsoft и другими партнерами запланировано на 2026 год.

