Перейти к содержанию

openai

GPT-6 научили чаще попадать в кэш промптов

Promtime

Закэшированные входные токены в GPT-6 обходятся до 90% дешевле, и попадать в кэш запросы теперь должны чаще. 22 сентября OpenAI рассказала, что переделала кэширование промптов. Кроме более высокой доли попаданий, в анонсе есть новая диагностика, явные точки кэширования (breakpoints) и настройки, которые снижают задержку и расходы.

Кэш срабатывает, когда запрос начинается с того же текста, что и прошлый. Тогда модель берёт это начало готовым и не обрабатывает его заново. По данным Newsroom America, ко всему этому добавили ещё и дашборд кэширования.

На сколько выросла доля попаданий, OpenAI в анонсе не пишет, так что свою экономию придётся считать на собственных запросах.

Читайте также

  1. OpenAI готовит три тарифа API, старший от 50 долларов
  2. Free Mode в Replit снимает плату за токены
  3. Цены за токен у GPT-6 Sol и Luna упали вдвое и больше
  4. Битая картинка могла вскрыть Slack, Meta и GitHub
  5. Юристы и рекрутеры OpenAI сами перешли на Codex
  6. ChatGPT грузится вокруг вопроса «можно ли уже печатать»

Комментарии

Пока никто не написал. Будьте первым.

Присоединяйтесь к разговору

Войдите через Google, чтобы оставить комментарий. Имя и аватар подставятся из вашего профиля Google, а комментарий появится после модерации.

Из Google мы используем только имя и аватар. Почту не сохраняем.