Цены Gemini 3.8 Flash API: $0.75 сейчас, $1.50 с января

Gemini 3.8 Flash стоит $0.75 за миллион входных токенов и $3.75 за выходные до конца 2026 года. Все тарифы, правила лимитов и как получить ключ прямо сейчас.

Цены Gemini 3.8 Flash API: $0.75 сейчас, $1.50 с января

Gemini 3.8 Flash стоит $0.75 за миллион входных токенов и $3.75 за миллион выходных, включая токены размышления, до 31 декабря 2026 года. С 1 января 2027 года обе цифры удваиваются. Идентификатор модели — gemini-3.8-flash, она в статусе GA в Gemini API и в Vertex AI, и поддерживает три уровня мышления. Всё, что ниже, взято со страниц цен и лимитов Google 3 сентября 2026 года, на следующий день после запуска.

ID модели:     gemini-3.8-flash
Стандарт:      $0.75 вход / $3.75 выход за 1M до 2026-12-31
              $1.50 / $7.50 с 2027-01-01
Batch, Flex:   $0.375 / $1.875, затем $0.75 / $3.75
Priority:      $1.35 / $6.75, затем $2.70 / $13.50
Кэш:           чтение $0.075 (затем $0.15); хранение $0.50 за 1M токенов в час (затем $1.00)
Бесплатный тариф: есть, колонка «бесплатно» на странице цен
Контекст:      1 048 576 вход / 65 536 выход
Мышление:      low | medium (по умолчанию) | high; minimal возвращает ошибку
Vertex AI:     GA, 02.09.2026, global + мультирегионы us / eu
Шлюзы:         на 03.09.2026 отсутствует в каталоге Ofox

Обновлено 3 сентября 2026 года. Вводная цена истекает 31 декабря 2026 года; для бюджетов, выходящих за эту дату, нужна вторая строка.

Сколько на самом деле стоит Gemini 3.8 Flash API?

$0.75 за вход, $3.75 за выход, и цена на 2027 год напечатана в той же ячейке. Таблица цен Google для Gemini 3.8 Flash дословно гласит: «$0.75 до 31 декабря 2026 года. $1.50 с 1 января 2027 года» для входа и «$3.75 до 31 декабря 2026 года. $7.50 с 1 января 2027 года» для выхода.

ТарифВход / 1MВыход / 1MДо 2026-12-31С 2027-01-01
Стандарт$0.75$3.75да$1.50 / $7.50
Batch$0.375$1.875да$0.75 / $3.75
Flex$0.375$1.875да$0.75 / $3.75
Priority$1.35$6.75да$2.70 / $13.50
Чтение из кэша контекста$0.075да$0.15
Хранение кэша$0.50 за 1M токенов в часда$1.00
Grounding через Google Search5000 бесплатных запросов в месяц, общий лимит на все модели Gemini 3.x, затем $14 за 1000 запросов

Три детали в этой таблице влияют на счёт сильнее, чем базовая ставка:

  • Цена вывода включает токены размышления. Рассуждение тарифицируется по ставке вывода, $3.75. Уровень effort — это, по сути, ценовой множитель.
  • Batch и Flex — ровно вдвое дешевле. Если задача может подождать, та же модель обойдётся в $0.375 / $1.875.
  • Priority — в 1.8 раза дороже. За $1.35 / $6.75 покупается не другая модель, а отдельный пул лимитов.

У Gemini 3.7 Flash и 3.6 Flash те же строки цен. За токен переход между ними не экономит ничего; подробное сравнение — в 3.8 Flash против 3.7 Flash.

Gemini 3.8 Flash бесплатна?

Да, на бесплатном тарифе, но с лимитами, которые Google не публикует. На странице цен для Gemini 3.8 Flash есть колонка бесплатного тарифа, и в ней написано «бесплатно» для ввода, вывода и кэширования контекста. Grounding — 5000 бесплатных запросов в месяц на любом тарифе.

Чего нет на бесплатном тарифе — публичной цифры запросов в минуту. Страница о лимитах говорит, что лимиты «можно посмотреть в Google AI Studio», и что «указанные лимиты не гарантированы, реальная пропускная способность может отличаться». Сторонние гайды приводят цифры вроде 10 RPM и 1500 запросов в день для бесплатного тарифа — считайте их непроверенными и смотрите реальный лимит своего проекта на странице лимитов AI Studio.

Какие лимиты запросов у Gemini 3.8 Flash?

RPM и TPM по модели показываются только в AI Studio. Google публикует лестницу тарифов, потолок по расходам и лимиты пакетной обработки.

Тариф использованияКак получитьЛимит расходов за 10 минутПотолок токенов в очереди Batch для 3.8 Flash
БесплатныйАктивный проект или бесплатный пробный периодН/Дне указан
Tier 1Подключить активный платёжный аккаунт$103 000 000
Tier 2Оплачено $100, прошло 3 дня с первого платежа$50400 000 000
Tier 3Оплачено $1000, прошло 30 дней с первого платежа$2001 000 000 000

Все цифры со страницы лимитов Google по состоянию на 3 сентября 2026 года. Четыре правила с той же страницы важны на практике:

  • Лимиты применяются на уровне проекта, а не ключа API. Ротация ключей внутри одного проекта ничего не даёт. Дневные квоты сбрасываются в полночь по тихоокеанскому времени.
  • Лимит по расходам тоже возвращает 429 RESOURCE_EXHAUSTED — тот же код, что и превышение RPM. На Tier 1 $10 за 10 минут — это примерно 2.7 млн выходных токенов по стандартной ставке; всплеск длинных вызовов на high может упереться в лимит расходов раньше, чем в лимит по количеству запросов.
  • У Priority-инференса свой пул, равный 0.3x от стандартного лимита для модели и тарифа.
  • Повышение тарифа происходит автоматически: как только выполнены условия по расходам и сроку, переход с бесплатного на Tier 1 — мгновенный, дальнейшие — в течение 10 минут.

Если 429 уже встречается на вызовах Gemini, собственный справочник кодов ошибок Google различает rate_limit_exceeded и quota_exceeded как две разные причины 429, а наш гайд по 429 в Claude Code описывает ту же механику чтения заголовков и экспоненциальной задержки, применимую к любому API с лимитом по принципу token bucket, включая Gemini.

Сколько вы платите за задачу на самом деле

Цена за токен та же, что у 3.7 Flash, но за задачу на high effort — примерно на 45% дороже, потому что модель пишет больше. Пост о запуске от Google прямо говорит: «At times, the model might use more tokens to maximize performance, especially at higher effort levels». Документация для разработчиков добавляет: «Gemini 3.8 Flash can use more tokens on longer running and complex tasks, by design».

Artificial Analysis привела конкретные цифры:

Модель, effortAA Intelligence IndexСтоимость задачи AAВыходных токенов на задачу
Gemini 3.8 Flash, high59$0.5848k, «рост примерно на 30%»
Gemini 3.8 Flash, medium (по умолчанию)57$0.41
Gemini 3.8 Flash, low52$0.24
Gemini 3.7 Flash, high56$0.40

Прогон всего индекса стоил AA $825.83 на 3.8 Flash против $484.73 на 3.7 Flash. Уровень medium по умолчанию — главная история этой таблицы цен: 57 баллов за $0.41 за задачу — на балл выше, чем у 3.7 Flash на high, и дороже примерно на цент. Оценка HLE-Verified для модели из того же поста о запуске — 54.9%.

Бюджет, рассчитанный на объём вывода 3.7 Flash, будет неверным для 3.8 Flash на high effort. Перед тем как закладывать цифры, проверьте completion_tokens (OpenAI-совместимый режим) или usageMetadata.candidatesTokenCount (нативный режим) на своём собственном трафике.

Как получить API-ключ для Gemini 3.8 Flash

Зайдите в Google AI Studio и нажмите Create API key. Отдельная регистрация не нужна. Руководство Google по API-ключам объясняет: «If you are a new user, Google AI Studio automatically creates a default Google Cloud project and API key after you accept the Terms of Service». Существующий пользователь Google Cloud выбирает проект в панели вместо этого. Ключ сразу работает на бесплатном тарифе, карта для старта не нужна.

Перед тем как выпускать это в продакшн, нужно сделать две вещи:

  • Никогда не класть ключ в клиентский код. То же руководство прямо предупреждает: «Keys compiled in client-side code can be extracted by users». Трафик из браузера или мобильного приложения нужно направлять через собственный бэкенд или через шлюз, который сам выпускает ограниченный по правам ключ.
  • Перейти со Standard-ключей до дедлайна. На странице Google сказано: «On September 2026: the Gemini API will reject requests from Standard keys. You must migrate to auth keys before this date to avoid service interruption». Standard-ключи привязаны к биллингу проекта, но не идентифицируют вызывающую сторону; auth-ключи привязаны к сервисному аккаунту и позволяют быстрее реагировать на утечку. В документации не указан конкретный день внутри месяца — для ключа, созданного сегодня, эта миграция не опция, а обязательная задача на этот месяц.

Как получить доступ к Gemini 3.8 Flash

Три пути: Gemini API с ключом из AI Studio, Vertex AI, или OpenAI-совместимый шлюз, когда он добавит эту модель.

Gemini API, нативный протокол

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [{"parts": [{"text": "Перепиши этот GROUP BY через оконную функцию."}]}],
    "generationConfig": {"thinkingConfig": {"thinkingLevel": "medium"}}
  }'

thinkingLevel принимает low, medium и high. minimal возвращает ошибку валидации; в гайде по 3.7 Flash есть точный текст этой ошибки 400, и у 3.8 Flash то же ограничение.

Gemini API, OpenAI-совместимый режим

from openai import OpenAI

client = OpenAI(
    base_url="https://generativelanguage.googleapis.com/v1beta/openai/",
    api_key="YOUR_GEMINI_API_KEY",
)
r = client.chat.completions.create(
    model="gemini-3.8-flash",
    reasoning_effort="medium",
    messages=[{"role": "user", "content": "Перепиши этот GROUP BY через оконную функцию."}],
)
print(r.usage.completion_tokens)

В этом варианте параметр называется reasoning_effort, но соответствует тем же трём уровням.

Vertex AI

Страница модели в Vertex от Google указывает для gemini-3.8-flash статус «Launch stage: GA, Release date: September 2, 2026», модель доступна на глобальной конечной точке global и в мультирегионах us и eu, с оплатой по факту использования Standard, Flex и Priority, а также с Provisioned Throughput. Vertex выставляет счета через Google Cloud и живёт по собственной системе квот; это же официальный путь Google, если Gemini API отказывает по региону.

Через Ofox

На 3 сентября 2026 года Gemini 3.8 Flash отсутствует в каталоге Ofox. google/gemini-3.7-flash там есть — $0.75 за вход и $3.75 за выход на маршруте через Google (маршрут CloudVertex на той же странице модели — $1.50 / $7.50, и именно эту, более высокую, цифру сейчас возвращает поле pricing в /v1/models), доступна через OpenAI-совместимый эндпоинт https://api.ofox.ai/v1 и через нативный протокол Gemini https://api.ofox.ai/gemini. Когда 3.8 Flash добавят, вызов будет таким же, только со строкой модели с префиксом google/. Реальный список моделей, доступных для вызова, определяется живым ответом GET https://api.ofox.ai/v1/models, а не тем, что написано в этой статье.

client = OpenAI(base_url="https://api.ofox.ai/v1", api_key="YOUR_OFOX_API_KEY")
r = client.chat.completions.create(
    model="google/gemini-3.7-flash",   # заменить на google/gemini-3.8-flash, когда появится
    reasoning_effort="medium",
    messages=[{"role": "user", "content": "ping"}],
)

Цена Gemini 3.8 Flash на фоне альтернатив

МодельВход / 1MВыход / 1MAA IndexПримечание
Gemini 3.8 Flash$0.75$3.7559 (high)удвоение 2027-01-01
Gemini 3.7 Flash$0.75$3.7556 (high)удвоение 2027-01-01
Gemini 3.5 Flash$1.50$9.00без объявленного повышения
Gemini 3.5 Flash-Lite$0.30$2.50
DeepSeek V4 Flash 0731$0.44$1.3252тариф пиковых часов, вне пика — вдвое дешевле; подробнее в 3.8 Flash против DeepSeek V4 Flash

Цены Gemini — со страницы цен Google, DeepSeek — со страницы цен его API, обе на 3 сентября 2026 года; оценки индекса — от Artificial Analysis в тот же день. По цене за токен 3.8 Flash — самая дешёвая среди современных Flash-моделей наравне с 3.7 и 3.6. По цене за задачу, по измерениям AA, дешевле всего 3.8 Flash на low — $0.24, но всего 52 балла; в диапазоне 56–57 баллов 3.7 Flash на high и 3.8 Flash на medium расходятся всего на цент.

Дата, которую стоит отметить в календаре

1 января 2027 года каждая строка цен Gemini 3.8 Flash удваивается: $1.50 / $7.50 стандарт, $0.75 / $3.75 Batch и Flex, $2.70 / $13.50 Priority, $0.15 чтение кэша, $1.00 за миллион токенов в час хранения. Если количество токенов не изменится, лестница стоимости задачи AA $0.58 / $0.41 / $0.24 превратится примерно в $1.16 / $0.82 / $0.48. Google печатает это на странице цен с самого запуска, так что это не слух, который стоит перепроверять, а строка, которую можно сразу внести в план.

Источники

Цены, правила лимитов и потолки пакетной обработки взяты со страниц Google по состоянию на 3 сентября 2026 года. Данные каталога Ofox сверены с живым эндпоинтом /v1/models в тот же день.

Часто задаваемые вопросы

Сколько стоит Gemini 3.8 Flash API за миллион токенов?
$0.75 за миллион входных токенов и $3.75 за миллион выходных до 31 декабря 2026 года. С 1 января 2027 года те же ячейки показывают $1.50 и $7.50. В цену вывода входят токены размышления. Кэшированный ввод стоит $0.075 за миллион сейчас и $0.15 с января, хранение кэша — $0.50 за миллион токенов в час, тоже удваивается в ту же дату.
Gemini 3.8 Flash бесплатна?
Да, на бесплатном тарифе Gemini API. На странице цен Google в колонке бесплатного тарифа для Gemini 3.8 Flash указано «бесплатно» для ввода, вывода и кэширования контекста. У бесплатного тарифа лимиты ниже, чем у платных, а точные значения RPM и TPM по каждой модели Google показывает только внутри AI Studio, не в публичной документации.
Какие лимиты запросов у Gemini 3.8 Flash?
Google не публикует значения RPM или TPM по модели для Gemini 3.8 Flash; страница о лимитах говорит, что их «можно посмотреть в Google AI Studio». Что публикуется: лимиты по расходам — $10, $50 и $200 за скользящие 10 минут на Tier 1, 2 и 3, потолки токенов в очереди Batch для 3.8 Flash на тех же тирах — 3, 400 и 1000 миллионов, и Priority-инференс с лимитом 0.3x от стандартного. Лимиты применяются на уровне проекта, а не ключа API.
Gemini 3.8 Flash дешевле, чем Gemini 3.7 Flash?
За токен цена одинакова: $0.75 за вход, $3.75 за выход, те же ставки Batch, Flex, Priority и кэширования, то же удвоение 1 января 2027 года. За задачу 3.8 Flash обходится дороже. Artificial Analysis измерила $0.58 за задачу Intelligence Index при высоком effort против $0.40 у 3.7 Flash, потому что 3.8 Flash пишет примерно на 30% больше выходных токенов.
Как называется модель Gemini 3.8 Flash в API?
gemini-3.8-flash — и в Gemini API, и в Vertex AI. В Vertex модель получила статус GA 2 сентября 2026 года на глобальной конечной точке и в мультирегионах us и eu. В OpenAI-совместимом эндпоинте строка модели та же. Через Ofox модель будет называться google/gemini-3.8-flash, когда появится в каталоге; на 3 сентября 2026 года в каталоге Ofox есть google/gemini-3.7-flash, но не 3.8.
Поддерживает ли Gemini 3.8 Flash уровень мышления minimal?
Нет. В документации Google по моделям указано, что minimal «не поддерживается для Gemini 3.8 Flash и вернёт ошибку». Поддерживаемые уровни мышления — low, medium (по умолчанию) и high. Любая конфигурация, где minimal захардкожен со старой модели Flash, сломается в момент замены ID модели.
Как получить API-ключ для Gemini 3.8 Flash?
Зайдите в Google AI Studio (aistudio.google.com/apikey) и нажмите Create API key. Отдельная регистрация не нужна. Новому пользователю после принятия условий использования Google AI Studio автоматически создаёт проект Google Cloud по умолчанию и ключ API. Существующий пользователь Google Cloud выбирает проект в панели. Ключ сразу работает на бесплатном тарифе, карта для старта не требуется. Официальное руководство Google прямо предупреждает не класть ключ в клиентский код, а ключи типа Standard, которые выдаются сейчас, перестанут работать в сентябре 2026 года: «Gemini API будет отклонять запросы от ключей Standard». Перейти на ключ auth, привязанный к сервисному аккаунту, нужно до этого срока.