23 сентября 2026 г.
Повторные запросы к GPT-6 обойдутся дешевле: скидка на кэш до 90%
22 сентября OpenAI улучшила кэширование промптов в API GPT-6: кэшированные входные токены получают скидку до 90%. GPT-6 сам направляет повторяющиеся части запросов в кэш, поэтому `prompt_cache_key` больше не нужен. Кэш срабатывает от 1 024 токенов и держит префикс 30 минут после записи или повторного использования.

OpenAI Developers
@openaidevs
Мы улучшили кэширование промптов в API для GPT-6, чтобы агенты работали быстрее и обходились дешевле. Теперь по умолчанию больше входных токенов попадает в кэш и получает скидку до 90%.
· 12,8 тыс. просмотров
Раньше разработчик указывал `prompt_cache_key`, чтобы повысить шанс повторного использования общего префикса. В GPT-6 OpenAI сама маршрутизирует запросы в кэш. Для ручного выбора кэшируемого префикса остаётся режим `explicit` с cache breakpoint.
Экономия видна в счёте. Один cache write и один полный повторный запрос стоят 1,35 обычной цены входных токенов вместо 2 без кэша. На 10 запросах с полным повторным использованием расход составляет 2,15 вместо 10. У GPT-6 Sol миллион обычных входных токенов стоит $2, а кэшированных — $0,20.
В API GPT-6 кэширование по умолчанию действует с 22 сентября.
Первоисточник

