9 октября 2026 г.
Повторный контекст в GPT-6.1 Sol дешевле: OpenAI вдвое снизила цену чтения кеша
С 29 сентября GPT-6.1 Sol берёт $0,10 за миллион токенов из кеша вместо $0,20 у GPT-6 Sol.

Epoch AI
@epochairesearch
Новая архитектура GPT-6.1 Sol? OpenAI вдвое снизила цену кешированного ввода по сравнению с GPT-6 Sol. Наши замеры показывают, что длинные промпты она тоже обрабатывает быстрее.

· 1,3 тыс. просмотров
GPT-6.1 Sol быстрее начинает ответ на длинных промптах, но на коротких уступает предшественнице.
Для тех, кто использует модели для кода, здесь два отдельных изменения: цена повторного контекста и ожидание начала ответа. Кеш сохраняет повторяющееся начало запроса, например инструкции агента и материалы проекта.
Не хотите разбираться сами? Внедряем ИИ в ваш бизнес: задачи без лимита, одна цена в месяц, отмена в любой момент.
Цена повторного контекста. OpenAI снизила ставку чтения кеша, а обычный ввод оставила по $2 и вывод по $10 за миллион токенов. Эти цены действуют для промптов до 272 тысяч токенов.
| Модель | Чтение кеша за миллион токенов | | --- | --- | | GPT-6 Sol | $0,20 | | GPT-6.1 Sol | $0,10 |
Запись кеша GPT-6.1 Sol стоит $2,50 за миллион токенов, то есть в 1,25 раза дороже обычного ввода. Это отдельная ставка для записываемых токенов. При промпте свыше 272 тысяч токенов OpenAI удваивает ставки ввода и кеша для всего запроса, а ставку вывода умножает на 1,5.
Скорость зависит от длины. В расчётах Epoch AI от 8 сентября GPT-6.1 Sol начинает ответ на контексте около 850 тысяч токенов на 13% быстрее. На контексте около 50 тысяч токенов она на 77% медленнее.
| Контекст | GPT-6 Sol: до начала ответа | GPT-6.1 Sol: до начала ответа | | --- | --- | --- | | Около 850 тысяч токенов | 17,43 секунды | 15,14 секунды | | Около 50 тысяч токенов | 1,32 секунды | 2,34 секунды |
Кеширование включено по умолчанию и работает с повторяющимся префиксом от 1024 токенов. Стабильные инструкции и материалы ставят в начало запроса, новые сообщения добавляют в конец.
Для явного кеширования в запросе задают `prompt_cache_options.mode: "explicit"`, а в конце стабильного блока `input_text` ставят `prompt_cache_breakpoint: {"mode":"explicit"}`. Без маркера этот режим кеш не использует.
Для предварительного прогрева отправляют запрос через Responses API с `prompt_cache_options.prewarm: true`. Следующий запрос повторяет тот же префикс с выключенным или отсутствующим `prewarm`.
В API модель выбирают через `model: "gpt-6.1-sol"`. Для вызова инструментов нужен Responses API, а Chat Completions работает без tool calling.
Источники: Epoch AI, 8 октября 2026 года, и расчёты Джейсона Ли от 8 сентября; документация OpenAI, 8 октября; changelog OpenAI, 29 сентября.
Epoch AI опубликовала 60 замеров обеих моделей от 6 октября: `make sol-api` воспроизводит анализ, а `make sol-api-figures` строит графики из опубликованных таблиц.
Первоисточник