---
title: Цены Gemini API: полный разбор тарифов
description: "Цены Gemini API: ставки Pro, Flash и Flash-Lite за токены, cached input, надбавка за контекст от 200K и плоская скидка 50% на apiToken.sale."
url: https://apitoken.sale/ru/docs/learn/gemini-api-pricing
language: ru
---

# Цены Gemini API: Pro, Flash, Flash-Lite и генерация изображений

Цена Gemini API складывается из трёх измеряемых компонентов — input, cached input и output; ставки задаются tier модели, у Pro есть надбавка за длинный контекст, а у Nano Banana 2 — отдельный тариф на image output. В этом гайде — все актуальные ставки, арифметика их суммирования и то, где в расчёт вступает плоская скидка 50% apiToken.sale.

## Цена Gemini API за 1 млн токенов по моделям

Тарификация Gemini API — чистый per-token metering: вы платите за входные токены, которые отправляете, и за выходные, которые генерирует модель; cached input тарифицируется как отдельный, более дешёвый компонент, а платы за запрос или минимального расхода нет. Официально диапазон — от $0.10/$0.40 за 1 млн токенов у Gemini 2.5 Flash-Lite до $2/$12 у Gemini 3.1 Pro Preview. apiToken.sale рассчитывает каждый из этих компонентов с плоской скидкой 50%, поэтому те же запросы обходятся в $0.05/$0.20 – $1/$6.

| Модель | Официально: input / cached / output | Цена здесь после скидки 50% |
| --- | --- | --- |
| gemini-3.1-pro-preview | $2 / $0.20 / $12 | $1 / $0.10 / $6 |
| gemini-3.8-flash | $0.75 / $0.075 / $3.75 промо | $0.375 / $0.0375 / $1.875 |
| gemini-3.1-flash-lite | $0.25 / $0.025 / $1.50 | $0.125 / $0.0125 / $0.75 |
| gemini-2.5-flash-lite | $0.10 / $0.01 / $0.40 | $0.05 / $0.005 / $0.20 |

Все значения — за 1 млн токенов. Cached input — самостоятельный компонент, который отдельно отражается в usage metadata ответа: у текстовых моделей он тарифицируется по 10% от ставки свежего input, применяется автоматически к повторяющимся префиксам промпта, и отдельной платы за запись в кэш нет. Один и тот же токен никогда не тарифицируется одновременно как cached и как fresh input.

## Как складывается стоимость реального запроса

Стоимость любого вызова — сумма трёх произведений: fresh input токены на ставку input, cached токены на ставку cached и output токены на ставку output. Во время промо Google до 2026-12-31 запрос к gemini-3.8-flash, который отправляет 20 000 входных токенов — 12 000 из которых обслужены из кэша — и генерирует 1 500 выходных токенов, стоит 8 000 × $0.75/M + 12 000 × $0.075/M + 1 500 × $3.75/M = $0.006 + $0.0009 + $0.005625 = $0.012525 по официальным ставкам. После плоской скидки 50% такой вызов стоит $0.0062625.

- Output — самый дорогой компонент: во всех текстовых моделях выше output стоит в 4–6 раз дороже input, поэтому многословные ответы обходятся дороже длинных промптов.
- Выбор модели важнее обрезки промпта: input у 3.1 Flash-Lite стоит в восемь раз дешевле, чем у 3.1 Pro, а у 2.5 Flash-Lite — в двадцать раз.
- Стабильные префиксы — системные промпты, схемы инструментов, few-shot примеры — после попадания в кэш тарифицируются по 10%, так что повторяющийся трафик дешевеет без изменений в коде.

> Объект usageMetadata в каждом ответе generateContent отдельно показывает количество токенов промпта, cached и candidate. Планируйте бюджет по этим точным цифрам, а не по количеству символов в промпте.

## Тарификация длинного контекста свыше 200K входных токенов

Gemini 3.1 Pro Preview — единственная текстовая модель с надбавкой за длинный контекст. Как только запрос превышает 200K входных токенов, весь запрос — а не только токены за порогом — тарифицируется по $4 за input, $0.40 за cached input и $18 за output за 1 млн: двойная ставка input и 1.5× output.

У моделей Flash и Flash-Lite такого tier нет. Они держат стандартные ставки во всём контекстном окне 1 млн токенов с output до 64K. Анализ на 500K токенов, который на Pro стоит $2 только за input, на Gemini 3.8 Flash по текущей официальной промо-ставке стоит $0.375 — а скидка apiToken.sale затем ещё раз делит обе цифры пополам.

> Измерьте, прежде чем отправлять гигантский контекст в Pro: countTokens бесплатно возвращает точное количество тарифицируемых входных токенов (см. ниже), так что негабаритные задачи можно осознанно маршрутизировать на Flash, а не обнаруживать надбавку в дашборде.

## Генерация изображений: Gemini 3.1 Flash Image (Nano Banana 2)

Nano Banana 2 — публичное имя gemini-3.1-flash-image, и тарифицируется она иначе, чем текстовые модели. Текст на входе и выходе дёшев — $0.50 за input и $3 за текстовый output за 1 млн, — но отрисованные изображения тарифицируются отдельным компонентом по $60 за 1 млн image-output токенов. Контекстное окно тоже меньше: 128K на вход и до 32K на выход.

```
curl https://router.apitoken.sale/v1beta/models/gemini-3.1-flash-image:generateContent \
  -H "x-goog-api-key: $APITOKEN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"A clean isometric diagram of a satellite"}]}]}'
```

- Image output измеряется в image-output токенах: официально $60 за 1 млн, после скидки — $30.
- Cached input у этой модели скидки не получает — тарифицируется по полной ставке input $0.50.
- Текстовый output в том же ответе остаётся по стандартной ставке $3 за 1 млн.

[Детали по модели: контекст, лимиты output и все тарифные компоненты](/models/gemini-3-1-flash-image)

## Оцените расход через countTokens до генерации

countTokens — бесплатный вызов по тому же model path. Он возвращает точное количество входных токенов, которое тарифицировал бы запрос, ничего не генерирует и не затрагивает ни квоту, ни баланс. Запускайте его перед крупными задачами на Pro или image-задачами, чтобы надбавка за длинный контекст не стала сюрпризом.

```
curl https://router.apitoken.sale/v1beta/models/gemini-3.1-pro-preview:countTokens \
  -H "x-goog-api-key: $APITOKEN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"<your full prompt here>"}]}]}'
```

Стриминг цену тоже не меняет: streamGenerateContent?alt=sse измеряет те же токен-компоненты, что и одношаговый generateContent, так что транспорт выбирайте по задержке и UX, а не по стоимости.

## Как apiToken.sale рассчитывает Gemini со скидкой 50%

Ничего из описанного выше metering на apiToken.sale не меняется. Ваш запрос выполняется на нативной поверхности Gemini /v1beta generateContent с аутентификацией вашим ключом в заголовке x-goog-api-key, и usage metadata показывает те же количества токенов. Меняется расчёт: каждый вызов сначала переводится в точный официальный расход Google, затем из него вычитается плоская B2C-скидка 50%, и только чистая сумма списывается с вашего предоплаченного баланса. Никакой подписки, платы за место или наценки.

Тот же ключ и баланс покрывают поддерживаемые модели Claude, GPT, Gemini и Kimi — каждая тарифицируется по своей официальной rate card с той же скидкой. Каждый запрос виден в дашборде с детализацией до токенов, так что арифметику из этого гайда можно сверить с реальным трафиком.

[Все поддерживаемые модели с их ставками за токен](/models)

## Частые вопросы

### Какая модель Gemini API самая дешёвая?

Gemini 2.5 Flash-Lite: официально $0.10 за input и $0.40 за output за 1 млн токенов, cached input — $0.01. С плоской скидкой 50% apiToken.sale это $0.05/$0.20 — самая низкая опубликованная цена Gemini за токен.

### Когда применяется long-context тариф Gemini?

Только на Gemini 3.1 Pro Preview, когда input превышает 200K токенов. Тогда весь запрос тарифицируется по $4/$0.40/$18 за 1 млн — 2× input и 1.5× output. Flash и Flash-Lite держат стандартные ставки во всём окне 1 млн токенов.

### Сколько стоит генерация изображений в Gemini?

Gemini 3.1 Flash Image (Nano Banana 2) тарифицирует отрисованный output по $60 за 1 млн image-output токенов официально или по $30 после плоской скидки 50%. Текстовый output в том же ответе — $3 за 1 млн.

### Cached input начисляется поверх fresh input?

Нет. Cached токены — отдельный компонент по 10% от ставки input у текстовых моделей, он независимо отражается в usageMetadata — одни и те же токены никогда не тарифицируются дважды. Исключение — gemini-3.1-flash-image, где cached input тарифицируется по полной ставке input.

### Скидка 50% действует на long-context и image-компоненты?

Да. apiToken.sale вычисляет точный официальный расход по каждому компоненту — input, cached input, output, надбавку Pro за длинный контекст и image output — и затем вычитает 50% из итога перед списанием с предоплаченного баланса.

### Можно ли бесплатно узнать количество токенов промпта?

Да. Отправьте POST на /v1beta/models/{model}:countTokens с вашим ключом в заголовке x-goog-api-key — вызов вернёт точное количество input и не затронет баланс.

---
Get a key: https://apitoken.sale/register
More guides: https://apitoken.sale/ru/docs/learn
