22 сентября 2026 года OpenAI объявила об улучшениях кэширования запросов для семейства GPT-6 и новых инструментах контроля. Это изменение для разработчиков приложений через API, а не обещание уменьшить стоимость подписки ChatGPT.
По данным OpenAI, подходящие совпадающие начала запросов получают скидку при повторном использовании в пределах 30 минут. Новая панель Prompt Caching Dashboard показывает долю кэшированного ввода и её изменение со временем.
Инструмент диагностики помогает выяснить, почему повторное использование не сработало: например, изменились определения инструментов, настройки, модель или входные данные. Разработчикам также предложены явные границы кэширования и предварительная обработка известного контекста.
Практический первый шаг — посмотреть долю попаданий в кэш на одном типовом сценарии приложения, затем разобрать конкретный промах. OpenAI рекомендует сохранять определения, схемы и порядок инструментов стабильными, ограничивая доступность через allowed_tools, а не удаляя определения.
Редакционная рекомендация: проверяйте изменения на небольшом тестовом сценарии с ограниченным бюджетом и сравнивайте расходы и задержку до и после. При ухудшении верните прежнюю конфигурацию. Заявленная скидка до 90% относится к кэшированным входным токенам, не ко всему счёту; реальные результаты зависят от нагрузки. Собственных замеров мы не проводили.
Проверяемые источники
Комментариев пока нет