Цены GPT-6 Sol API: как считать кэш и длинный контекст
Разбираем ввод, вывод, чтение и запись кэша Sol. Показываем расчёт при вводе свыше 272K и даём таблицу тарифов с локальным калькулятором.
В прямом OpenAI API GPT-6 Sol стоит 2 доллара за миллион токенов обычного ввода и 10 долларов за миллион токенов вывода в режиме Standard при вводе до 272K включительно. Кэш, длина запроса и режим обработки могут изменить расчёт.
Страница модели и тарифы проверены 23 сентября 2026 года. Единица ниже — доллар США за миллион текстовых токенов. Это не цены Ofox и не лимиты подписки.
Порог меняет цену всего запроса
| Standard | Обычный ввод | Чтение кэша | Запись кэша | Вывод |
|---|---|---|---|---|
| Ввод ≤272K | 2 | 0,20 | 2,50 | 10 |
| Ввод >272K | 4 | 0,40 | 5 | 15 |
При превышении порога тариф длинного контекста применяется ко всему запросу, а не только к превышению. Максимальная вместимость контекста и граница изменения цены — разные параметры.
Batch и Flex стоят половину соответствующего Standard, Fast — вдвое дороже. Эти режимы нельзя произвольно сочетать ради дополнительных скидок. Учитывайте применимые региональные надбавки; текущая резидентность данных в ЕС доступна только в Standard. Используйте режим фактического запроса.
Не считайте запись кэша дважды
По документации кэширования обычный ввод, чтение и запись нужно разнести по непересекающимся категориям.
Стоимость = (обычный ввод × ставка ввода + чтение × ставка чтения
+ запись × ставка записи + оплачиваемый вывод × ставка вывода) / 1 000 000
Токены, оплачиваемые как запись кэша, не надо повторно включать в обычный ввод. Если выгрузка содержит общий ввод и отдельные поля кэша, сначала проверьте их определения. Для вывода берите оплачиваемые токены, включая применимые токены рассуждений, а не только видимый текст.
Пример с фиксированными объёмами
Предположим 20 000 обычного ввода, 60 000 чтения, 20 000 записи и 5 000 вывода в Standard. Это непересекающиеся количества и арифметический пример, не результат запуска модели.
| Категория | Расчёт | Доллары |
|---|---|---|
| Обычный ввод | 20 000 × 2 / 1M | 0,040 |
| Чтение | 60 000 × 0,20 / 1M | 0,012 |
| Запись | 20 000 × 2,50 / 1M | 0,050 |
| Вывод | 5 000 × 10 / 1M | 0,050 |
| Всего | Сумма | 0,152 |
CSV с тарифами и примерами и калькулятор Python позволяют повторить расчёт. Скрипт не обращается к сети, не читает ваш счёт и не предсказывает попадания в кэш.
Для 300 000 обычного ввода и 5 000 вывода применяется длинный тариф ко всему запросу: 0.3 × 4 + 0.005 × 15 = 1.275 USD, без дополнительных сборов. Если первые 272K посчитать по короткому тарифу, получится заниженная оценка.
Снижение ставки не гарантирует вдвое меньший счёт
Анонс сравнивает новые 2/10 долларов с прежней промоценой GPT-5.6 Sol 4/20. Эти ставки ввода и вывода действительно снизились на 50%. Но контекст, рассуждения, вызовы инструментов и повторные попытки могут измениться.
Исторический счёт сохраняет историческую цену. Пересчёт старого объёма по новой ставке — только сценарий, а не изменение фактически уплаченной суммы. Для миграции сравнивайте общую стоимость выполнения одинакового критерия приёмки.
Считайте стоимость задачи, прошедшей проверку
Записывайте точную модель, поставщика, режим, длину ввода, кэш, вывод, стоимость инструментов и результат. Не исключайте неудачные попытки: отвергнутые ответы тоже могли стоить денег.
Sol против Opus 5.5 показывает сопоставимые расчёты, а выбор GPT-6 — подход к оценке задач. У посредника проверяйте реальный тариф маршрута, не переносите на него цену OpenAI автоматически.
Часто задаваемые вопросы
- Дороже стоит только часть сверх 272K?
- Нет. Если ввод превышает 272K, соответствующий тариф длинного контекста применяется ко всему запросу.
- Нужно добавить обычный ввод к записи кэша?
- Не для тех же токенов. Категории должны быть непересекающимися.
- Половина ставки означает половину стоимости задачи?
- Не обязательно: меняются объём, инструменты, повторные попытки и результат приёмки.


