Цены Gemini 3.8 Flash API: $0.75 сейчас, $1.50 с января
Gemini 3.8 Flash стоит $0.75 за миллион входных токенов и $3.75 за выходные до конца 2026 года. Все тарифы, правила лимитов и как получить ключ прямо сейчас.
Gemini 3.8 Flash стоит $0.75 за миллион входных токенов и $3.75 за миллион выходных, включая токены размышления, до 31 декабря 2026 года. С 1 января 2027 года обе цифры удваиваются. Идентификатор модели — gemini-3.8-flash, она в статусе GA в Gemini API и в Vertex AI, и поддерживает три уровня мышления. Всё, что ниже, взято со страниц цен и лимитов Google 3 сентября 2026 года, на следующий день после запуска.
ID модели: gemini-3.8-flash
Стандарт: $0.75 вход / $3.75 выход за 1M до 2026-12-31
$1.50 / $7.50 с 2027-01-01
Batch, Flex: $0.375 / $1.875, затем $0.75 / $3.75
Priority: $1.35 / $6.75, затем $2.70 / $13.50
Кэш: чтение $0.075 (затем $0.15); хранение $0.50 за 1M токенов в час (затем $1.00)
Бесплатный тариф: есть, колонка «бесплатно» на странице цен
Контекст: 1 048 576 вход / 65 536 выход
Мышление: low | medium (по умолчанию) | high; minimal возвращает ошибку
Vertex AI: GA, 02.09.2026, global + мультирегионы us / eu
Шлюзы: на 03.09.2026 отсутствует в каталоге Ofox
Обновлено 3 сентября 2026 года. Вводная цена истекает 31 декабря 2026 года; для бюджетов, выходящих за эту дату, нужна вторая строка.
Сколько на самом деле стоит Gemini 3.8 Flash API?
$0.75 за вход, $3.75 за выход, и цена на 2027 год напечатана в той же ячейке. Таблица цен Google для Gemini 3.8 Flash дословно гласит: «$0.75 до 31 декабря 2026 года. $1.50 с 1 января 2027 года» для входа и «$3.75 до 31 декабря 2026 года. $7.50 с 1 января 2027 года» для выхода.
| Тариф | Вход / 1M | Выход / 1M | До 2026-12-31 | С 2027-01-01 |
|---|---|---|---|---|
| Стандарт | $0.75 | $3.75 | да | $1.50 / $7.50 |
| Batch | $0.375 | $1.875 | да | $0.75 / $3.75 |
| Flex | $0.375 | $1.875 | да | $0.75 / $3.75 |
| Priority | $1.35 | $6.75 | да | $2.70 / $13.50 |
| Чтение из кэша контекста | $0.075 | — | да | $0.15 |
| Хранение кэша | $0.50 за 1M токенов в час | — | да | $1.00 |
| Grounding через Google Search | 5000 бесплатных запросов в месяц, общий лимит на все модели Gemini 3.x, затем $14 за 1000 запросов |
Три детали в этой таблице влияют на счёт сильнее, чем базовая ставка:
- Цена вывода включает токены размышления. Рассуждение тарифицируется по ставке вывода, $3.75. Уровень effort — это, по сути, ценовой множитель.
- Batch и Flex — ровно вдвое дешевле. Если задача может подождать, та же модель обойдётся в $0.375 / $1.875.
- Priority — в 1.8 раза дороже. За $1.35 / $6.75 покупается не другая модель, а отдельный пул лимитов.
У Gemini 3.7 Flash и 3.6 Flash те же строки цен. За токен переход между ними не экономит ничего; подробное сравнение — в 3.8 Flash против 3.7 Flash.
Gemini 3.8 Flash бесплатна?
Да, на бесплатном тарифе, но с лимитами, которые Google не публикует. На странице цен для Gemini 3.8 Flash есть колонка бесплатного тарифа, и в ней написано «бесплатно» для ввода, вывода и кэширования контекста. Grounding — 5000 бесплатных запросов в месяц на любом тарифе.
Чего нет на бесплатном тарифе — публичной цифры запросов в минуту. Страница о лимитах говорит, что лимиты «можно посмотреть в Google AI Studio», и что «указанные лимиты не гарантированы, реальная пропускная способность может отличаться». Сторонние гайды приводят цифры вроде 10 RPM и 1500 запросов в день для бесплатного тарифа — считайте их непроверенными и смотрите реальный лимит своего проекта на странице лимитов AI Studio.
Какие лимиты запросов у Gemini 3.8 Flash?
RPM и TPM по модели показываются только в AI Studio. Google публикует лестницу тарифов, потолок по расходам и лимиты пакетной обработки.
| Тариф использования | Как получить | Лимит расходов за 10 минут | Потолок токенов в очереди Batch для 3.8 Flash |
|---|---|---|---|
| Бесплатный | Активный проект или бесплатный пробный период | Н/Д | не указан |
| Tier 1 | Подключить активный платёжный аккаунт | $10 | 3 000 000 |
| Tier 2 | Оплачено $100, прошло 3 дня с первого платежа | $50 | 400 000 000 |
| Tier 3 | Оплачено $1000, прошло 30 дней с первого платежа | $200 | 1 000 000 000 |
Все цифры со страницы лимитов Google по состоянию на 3 сентября 2026 года. Четыре правила с той же страницы важны на практике:
- Лимиты применяются на уровне проекта, а не ключа API. Ротация ключей внутри одного проекта ничего не даёт. Дневные квоты сбрасываются в полночь по тихоокеанскому времени.
- Лимит по расходам тоже возвращает
429 RESOURCE_EXHAUSTED— тот же код, что и превышение RPM. На Tier 1 $10 за 10 минут — это примерно 2.7 млн выходных токенов по стандартной ставке; всплеск длинных вызовов на high может упереться в лимит расходов раньше, чем в лимит по количеству запросов. - У Priority-инференса свой пул, равный 0.3x от стандартного лимита для модели и тарифа.
- Повышение тарифа происходит автоматически: как только выполнены условия по расходам и сроку, переход с бесплатного на Tier 1 — мгновенный, дальнейшие — в течение 10 минут.
Если 429 уже встречается на вызовах Gemini, собственный справочник кодов ошибок Google различает rate_limit_exceeded и quota_exceeded как две разные причины 429, а наш гайд по 429 в Claude Code описывает ту же механику чтения заголовков и экспоненциальной задержки, применимую к любому API с лимитом по принципу token bucket, включая Gemini.
Сколько вы платите за задачу на самом деле
Цена за токен та же, что у 3.7 Flash, но за задачу на high effort — примерно на 45% дороже, потому что модель пишет больше. Пост о запуске от Google прямо говорит: «At times, the model might use more tokens to maximize performance, especially at higher effort levels». Документация для разработчиков добавляет: «Gemini 3.8 Flash can use more tokens on longer running and complex tasks, by design».
Artificial Analysis привела конкретные цифры:
| Модель, effort | AA Intelligence Index | Стоимость задачи AA | Выходных токенов на задачу |
|---|---|---|---|
| Gemini 3.8 Flash, high | 59 | $0.58 | 48k, «рост примерно на 30%» |
| Gemini 3.8 Flash, medium (по умолчанию) | 57 | $0.41 | — |
| Gemini 3.8 Flash, low | 52 | $0.24 | — |
| Gemini 3.7 Flash, high | 56 | $0.40 | — |
Прогон всего индекса стоил AA $825.83 на 3.8 Flash против $484.73 на 3.7 Flash. Уровень medium по умолчанию — главная история этой таблицы цен: 57 баллов за $0.41 за задачу — на балл выше, чем у 3.7 Flash на high, и дороже примерно на цент. Оценка HLE-Verified для модели из того же поста о запуске — 54.9%.
Бюджет, рассчитанный на объём вывода 3.7 Flash, будет неверным для 3.8 Flash на high effort. Перед тем как закладывать цифры, проверьте completion_tokens (OpenAI-совместимый режим) или usageMetadata.candidatesTokenCount (нативный режим) на своём собственном трафике.
Как получить API-ключ для Gemini 3.8 Flash
Зайдите в Google AI Studio и нажмите Create API key. Отдельная регистрация не нужна. Руководство Google по API-ключам объясняет: «If you are a new user, Google AI Studio automatically creates a default Google Cloud project and API key after you accept the Terms of Service». Существующий пользователь Google Cloud выбирает проект в панели вместо этого. Ключ сразу работает на бесплатном тарифе, карта для старта не нужна.
Перед тем как выпускать это в продакшн, нужно сделать две вещи:
- Никогда не класть ключ в клиентский код. То же руководство прямо предупреждает: «Keys compiled in client-side code can be extracted by users». Трафик из браузера или мобильного приложения нужно направлять через собственный бэкенд или через шлюз, который сам выпускает ограниченный по правам ключ.
- Перейти со Standard-ключей до дедлайна. На странице Google сказано: «On September 2026: the Gemini API will reject requests from Standard keys. You must migrate to auth keys before this date to avoid service interruption». Standard-ключи привязаны к биллингу проекта, но не идентифицируют вызывающую сторону; auth-ключи привязаны к сервисному аккаунту и позволяют быстрее реагировать на утечку. В документации не указан конкретный день внутри месяца — для ключа, созданного сегодня, эта миграция не опция, а обязательная задача на этот месяц.
Как получить доступ к Gemini 3.8 Flash
Три пути: Gemini API с ключом из AI Studio, Vertex AI, или OpenAI-совместимый шлюз, когда он добавит эту модель.
Gemini API, нативный протокол
curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.8-flash:generateContent" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{"parts": [{"text": "Перепиши этот GROUP BY через оконную функцию."}]}],
"generationConfig": {"thinkingConfig": {"thinkingLevel": "medium"}}
}'
thinkingLevel принимает low, medium и high. minimal возвращает ошибку валидации; в гайде по 3.7 Flash есть точный текст этой ошибки 400, и у 3.8 Flash то же ограничение.
Gemini API, OpenAI-совместимый режим
from openai import OpenAI
client = OpenAI(
base_url="https://generativelanguage.googleapis.com/v1beta/openai/",
api_key="YOUR_GEMINI_API_KEY",
)
r = client.chat.completions.create(
model="gemini-3.8-flash",
reasoning_effort="medium",
messages=[{"role": "user", "content": "Перепиши этот GROUP BY через оконную функцию."}],
)
print(r.usage.completion_tokens)
В этом варианте параметр называется reasoning_effort, но соответствует тем же трём уровням.
Vertex AI
Страница модели в Vertex от Google указывает для gemini-3.8-flash статус «Launch stage: GA, Release date: September 2, 2026», модель доступна на глобальной конечной точке global и в мультирегионах us и eu, с оплатой по факту использования Standard, Flex и Priority, а также с Provisioned Throughput. Vertex выставляет счета через Google Cloud и живёт по собственной системе квот; это же официальный путь Google, если Gemini API отказывает по региону.
Через Ofox
На 3 сентября 2026 года Gemini 3.8 Flash отсутствует в каталоге Ofox. google/gemini-3.7-flash там есть — $0.75 за вход и $3.75 за выход на маршруте через Google (маршрут CloudVertex на той же странице модели — $1.50 / $7.50, и именно эту, более высокую, цифру сейчас возвращает поле pricing в /v1/models), доступна через OpenAI-совместимый эндпоинт https://api.ofox.ai/v1 и через нативный протокол Gemini https://api.ofox.ai/gemini. Когда 3.8 Flash добавят, вызов будет таким же, только со строкой модели с префиксом google/. Реальный список моделей, доступных для вызова, определяется живым ответом GET https://api.ofox.ai/v1/models, а не тем, что написано в этой статье.
client = OpenAI(base_url="https://api.ofox.ai/v1", api_key="YOUR_OFOX_API_KEY")
r = client.chat.completions.create(
model="google/gemini-3.7-flash", # заменить на google/gemini-3.8-flash, когда появится
reasoning_effort="medium",
messages=[{"role": "user", "content": "ping"}],
)
Цена Gemini 3.8 Flash на фоне альтернатив
| Модель | Вход / 1M | Выход / 1M | AA Index | Примечание |
|---|---|---|---|---|
| Gemini 3.8 Flash | $0.75 | $3.75 | 59 (high) | удвоение 2027-01-01 |
| Gemini 3.7 Flash | $0.75 | $3.75 | 56 (high) | удвоение 2027-01-01 |
| Gemini 3.5 Flash | $1.50 | $9.00 | — | без объявленного повышения |
| Gemini 3.5 Flash-Lite | $0.30 | $2.50 | — | |
| DeepSeek V4 Flash 0731 | $0.44 | $1.32 | 52 | тариф пиковых часов, вне пика — вдвое дешевле; подробнее в 3.8 Flash против DeepSeek V4 Flash |
Цены Gemini — со страницы цен Google, DeepSeek — со страницы цен его API, обе на 3 сентября 2026 года; оценки индекса — от Artificial Analysis в тот же день. По цене за токен 3.8 Flash — самая дешёвая среди современных Flash-моделей наравне с 3.7 и 3.6. По цене за задачу, по измерениям AA, дешевле всего 3.8 Flash на low — $0.24, но всего 52 балла; в диапазоне 56–57 баллов 3.7 Flash на high и 3.8 Flash на medium расходятся всего на цент.
Дата, которую стоит отметить в календаре
1 января 2027 года каждая строка цен Gemini 3.8 Flash удваивается: $1.50 / $7.50 стандарт, $0.75 / $3.75 Batch и Flex, $2.70 / $13.50 Priority, $0.15 чтение кэша, $1.00 за миллион токенов в час хранения. Если количество токенов не изменится, лестница стоимости задачи AA $0.58 / $0.41 / $0.24 превратится примерно в $1.16 / $0.82 / $0.48. Google печатает это на странице цен с самого запуска, так что это не слух, который стоит перепроверять, а строка, которую можно сразу внести в план.
Источники
- https://ai.google.dev/gemini-api/docs/pricing
- https://ai.google.dev/gemini-api/docs/rate-limits
- https://ai.google.dev/gemini-api/docs/latest-model
- https://ai.google.dev/gemini-api/docs/api-key
- https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
- https://docs.cloud.google.com/vertex-ai/generative-ai/docs/models/gemini/3-8-flash
- https://artificialanalysis.ai/articles/gemini-3-8-flash
- https://ofox.ai/models/google/gemini-3.7-flash
Цены, правила лимитов и потолки пакетной обработки взяты со страниц Google по состоянию на 3 сентября 2026 года. Данные каталога Ofox сверены с живым эндпоинтом /v1/models в тот же день.
Часто задаваемые вопросы
- Сколько стоит Gemini 3.8 Flash API за миллион токенов?
- $0.75 за миллион входных токенов и $3.75 за миллион выходных до 31 декабря 2026 года. С 1 января 2027 года те же ячейки показывают $1.50 и $7.50. В цену вывода входят токены размышления. Кэшированный ввод стоит $0.075 за миллион сейчас и $0.15 с января, хранение кэша — $0.50 за миллион токенов в час, тоже удваивается в ту же дату.
- Gemini 3.8 Flash бесплатна?
- Да, на бесплатном тарифе Gemini API. На странице цен Google в колонке бесплатного тарифа для Gemini 3.8 Flash указано «бесплатно» для ввода, вывода и кэширования контекста. У бесплатного тарифа лимиты ниже, чем у платных, а точные значения RPM и TPM по каждой модели Google показывает только внутри AI Studio, не в публичной документации.
- Какие лимиты запросов у Gemini 3.8 Flash?
- Google не публикует значения RPM или TPM по модели для Gemini 3.8 Flash; страница о лимитах говорит, что их «можно посмотреть в Google AI Studio». Что публикуется: лимиты по расходам — $10, $50 и $200 за скользящие 10 минут на Tier 1, 2 и 3, потолки токенов в очереди Batch для 3.8 Flash на тех же тирах — 3, 400 и 1000 миллионов, и Priority-инференс с лимитом 0.3x от стандартного. Лимиты применяются на уровне проекта, а не ключа API.
- Gemini 3.8 Flash дешевле, чем Gemini 3.7 Flash?
- За токен цена одинакова: $0.75 за вход, $3.75 за выход, те же ставки Batch, Flex, Priority и кэширования, то же удвоение 1 января 2027 года. За задачу 3.8 Flash обходится дороже. Artificial Analysis измерила $0.58 за задачу Intelligence Index при высоком effort против $0.40 у 3.7 Flash, потому что 3.8 Flash пишет примерно на 30% больше выходных токенов.
- Как называется модель Gemini 3.8 Flash в API?
- gemini-3.8-flash — и в Gemini API, и в Vertex AI. В Vertex модель получила статус GA 2 сентября 2026 года на глобальной конечной точке и в мультирегионах us и eu. В OpenAI-совместимом эндпоинте строка модели та же. Через Ofox модель будет называться google/gemini-3.8-flash, когда появится в каталоге; на 3 сентября 2026 года в каталоге Ofox есть google/gemini-3.7-flash, но не 3.8.
- Поддерживает ли Gemini 3.8 Flash уровень мышления minimal?
- Нет. В документации Google по моделям указано, что minimal «не поддерживается для Gemini 3.8 Flash и вернёт ошибку». Поддерживаемые уровни мышления — low, medium (по умолчанию) и high. Любая конфигурация, где minimal захардкожен со старой модели Flash, сломается в момент замены ID модели.
- Как получить API-ключ для Gemini 3.8 Flash?
- Зайдите в Google AI Studio (aistudio.google.com/apikey) и нажмите Create API key. Отдельная регистрация не нужна. Новому пользователю после принятия условий использования Google AI Studio автоматически создаёт проект Google Cloud по умолчанию и ключ API. Существующий пользователь Google Cloud выбирает проект в панели. Ключ сразу работает на бесплатном тарифе, карта для старта не требуется. Официальное руководство Google прямо предупреждает не класть ключ в клиентский код, а ключи типа Standard, которые выдаются сейчас, перестанут работать в сентябре 2026 года: «Gemini API будет отклонять запросы от ключей Standard». Перейти на ключ auth, привязанный к сервисному аккаунту, нужно до этого срока.


