---
title: Gemini 3 Flash Preview
description: Текстовая модель Google Gemini 3 Flash Preview. Доступна по протоколу Chat Completions.
keywords: google/gemini-3-flash-preview
---

## Обзор {#overview}

:::figures
| подпись | значение | единица |
| --- | --- | --- |
| Контекст | 1M | токенов |
| Максимум вывода | 65.5K | токенов |
| Вход | 0.3 USD | за 1 млн токенов |
| Выход | 1.8 USD | за 1 млн токенов |
| Релиз | 17 декабря 2025 г. |  |
:::

:::deflist
| поле | что это |
| --- | --- |
| Идентификатор | **google/gemini-3-flash-preview** |
:::

## Быстрый старт: Gemini 3 Flash Preview {#quickstart}

Имя модели уже подставлено. Возьмите ключ из консоли, положите его в переменную окружения — и вызов готов к запуску. Кошелёк организации при этом должен быть пополнен: вызов, за который нечем платить, отвечает 402.

:::code-group
```bash title=cURL
curl https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "google/gemini-3-flash-preview",
  "max_tokens": 1024,
  "messages": [
    {
      "role": "user",
      "content": "Объясни токены одной строкой."
    }
  ]
}'
```
```python title=Python
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://api.kumorouter.com/v1",
    api_key=os.environ["KUMO_API_KEY"],
)

response = client.chat.completions.create(
    model="google/gemini-3-flash-preview",
    max_tokens=1024,
    messages=[{"role": "user", "content": "Объясни токены одной строкой."}],
)
print(response.choices[0].message.content)
```
```typescript title=TypeScript
import OpenAI from "openai";

const apiKey = process.env.KUMO_API_KEY;
if (!apiKey) throw new Error("Set KUMO_API_KEY before running this example.");

const client = new OpenAI({
  baseURL: "https://api.kumorouter.com/v1",
  apiKey,
});

const response = await client.chat.completions.create({
  model: "google/gemini-3-flash-preview",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Объясни токены одной строкой." }],
});

process.stdout.write(`${response.choices[0]?.message.content ?? ""}\n`);
```
```javascript title=JavaScript
import OpenAI from "openai";

const apiKey = process.env.KUMO_API_KEY;
if (!apiKey) throw new Error("Set KUMO_API_KEY before running this example.");

const client = new OpenAI({
  baseURL: "https://api.kumorouter.com/v1",
  apiKey,
});

const response = await client.chat.completions.create({
  model: "google/gemini-3-flash-preview",
  max_tokens: 1024,
  messages: [{ role: "user", content: "Объясни токены одной строкой." }],
});

process.stdout.write(`${response.choices[0]?.message.content ?? ""}\n`);
```
:::

## OpenAI — параметры API {#chat_completions-parameters}

Authorization: Bearer $KUMO_API_KEY

:::matrix
| Параметр | Тип | По умолчанию / диапазон | Описание |
| --- | --- | --- | --- |
| model | string | Обязательный | Идентификатор модели из каталога. |
| messages | array | 1–512 | Сообщения диалога в хронологическом порядке. |
| max_tokens | integer | ≥ 1 | Необязателен. Без max_tokens и max_completion_tokens запрос обслуживается по опубликованному умолчанию поверхности — 32768 выходных токенов. Значение также ограничено возможностями модели. |
| temperature | number | 0–2 | Случайность генерации. Без значения выбор остаётся за моделью. |
| top_p | number | 0–1 | Вероятностная масса выборки. Без значения выбор остаётся за моделью. |
| stop | array | ≤ 4 | Массив строк, останавливающих генерацию. |
| max_completion_tokens | integer | ≥ 1 | Необязательная альтернатива max_tokens. При передаче обоих с РАЗНЫМИ значениями запрос отклоняется: правило старшинства молча отбросило бы одно из двух чисел, написанных намеренно. |
:::

Один вариант ответа на запрос. Параметры frequency_penalty, presence_penalty, seed, logprobs, top_logprobs и logit_bias отклоняются шлюзом: каждый из них менял бы генерацию или форму ответа, и принять его молча значило бы солгать о полученном ответе. n принимается только со значением 1 — это умолчание протокола и ровно то, что шлюз делает, — а n больше единицы отклоняется. user принимается, но не передаётся модели, не сохраняется и не возвращается в ответе. То же относится к полю strict в объявлении функции и полю name в сообщении роли tool: они принимаются, но не передаются. reasoning_effort принимается и тоже не передаётся: ни один запрос к поставщику на этой платформе не несёт бюджета рассуждений, поэтому ответ приходит на умолчании самой модели, что бы ни говорило поле. cache_control в сообщении, в части контента и в переигранном вызове инструмента принимается и тоже не передаётся: у провода поставщика, которым обслуживается этот протокол, нет члена для якоря кэша, поэтому счётчики кэшированных токенов приходят так, будто якорь не присылали. messages[].content принимается и строкой, и массивом частей: части типа text склеиваются по порядку в один текст, то есть запрос, написанный частями, и тот же запрос строкой — один запрос. Часть типа image_url, input_audio, file или refusal отклоняется с указанием её собственного type: мультимодальная способность на этой платформе не подтверждена ни для одной пары, а переигранный отказ доехал бы до поставщика как обычная реплика ассистента. Роль developer принимается и передаётся как system — это новое имя роли инструкций в том же протоколе. stop принимается только массивом; tool_choice — строковым режимом auto, none или required либо объектом, называющим объявленный инструмент. Режим json_object отклоняется по имени: обещание валидного JSON ничего не говорит о его форме.

## Идентификаторы {#identifiers}

:::deflist
| поле | что это |
| --- | --- |
| Каноническое имя | **google/gemini-3-flash-preview** |
| Псевдонимы | gemini-3-flash |
| Код вендора | google |
| Протоколы | chat_completions |
| Модальности | text_generation |
:::

## Возможности {#capabilities}

:::matrix
| Протокол и модальность | Стриминг | Инструменты | Структурированный вывод | Строгие семантики | Стриминг структурированного |
| --- | --- | --- | --- | --- | --- |
| Chat Completions генерация текста | Не подтверждено | Не подтверждено | Не подтверждено | Не подтверждено | Не подтверждено |
:::

Строка описывает пару «протокол и модальность», а не модель целиком: возможность доказывается на конкретной поверхности, и на соседней ответ может быть другим.

## Сравнение {#compare}

:::matrix
| Модель | Контекст | Максимум вывода | Вход $/млн | Выход $/млн | Модальности |
| --- | --- | --- | --- | --- | --- |
| **Gemini 3 Flash Preview** | 1M | 65.5K | 0.3 USD | 1.8 USD | генерация текста |
| [Claude Sonnet 5](/models/claude-sonnet-5) | 1M | 128K | 1.2 USD | 6 USD | генерация текста |
| [Claude Opus 4.8](/models/anthropic~-claude-opus-4-8) | 1M | 128K | 3 USD | 15 USD | генерация текста |
| [Claude Fable 5](/models/anthropic~-claude-fable-5) | 1M | 128K | 6 USD | 30 USD | генерация текста |
| [Claude Fable 5.1](/models/anthropic~-claude-fable-5-1) | 1M | 128K | 6 USD | 30 USD | генерация текста |
| [Claude Haiku 4.5](/models/anthropic~-claude-haiku-4-5) | 200K | 64K | 0.6 USD | 3 USD | генерация текста |
| [Claude Opus 4.5](/models/anthropic~-claude-opus-4-5-20251101) | 200K | 64K | 3 USD | 15 USD | генерация текста |
| [Claude Opus 4.6](/models/anthropic~-claude-opus-4-6) | 1M | 128K | 3 USD | 15 USD | генерация текста |
| [Claude Opus 4.7](/models/anthropic~-claude-opus-4-7) | 1M | 128K | 3 USD | 15 USD | генерация текста |
| [Claude Opus 5.5](/models/anthropic~-claude-opus-5-5) | 1M | 128K | 2.2 USD | 11 USD | генерация текста |
| [Claude Opus 5](/models/anthropic~-claude-opus-5) | 1M | 128K | 3 USD | 15 USD | генерация текста |
| [Claude Sonnet 4.5](/models/anthropic~-claude-sonnet-4-5-20250929) | 1M | 64K | 1.8 USD | 9 USD | генерация текста |
| [Claude Sonnet 4.6](/models/anthropic~-claude-sonnet-4-6) | 1M | 128K | 1.8 USD | 9 USD | генерация текста |
| [Gemini 3.1 Flash Lite](/models/google~-gemini-3.1-flash-lite) | 1M | 65.5K | 0.2 USD (0.15 USD) | 0.9 USD | генерация текста |
| [Gemini 3.6 Flash High](/models/google~-gemini-3.6-flash-high) | 1M | 65.5K | 0.5 USD (0.45 USD) | 2.3 USD (2.25 USD) | генерация текста |
| [Gemini 3.7 Flash High](/models/google~-gemini-3.7-flash-high) | 1M | 65.5K | 0.5 USD (0.45 USD) | 2.3 USD (2.25 USD) | генерация текста |
| [Gemini 3.8 Flash High](/models/google~-gemini-3.8-flash-high) | 1M | 65.5K | 0.5 USD (0.45 USD) | 2.3 USD (2.25 USD) | генерация текста |
| [Codex Auto Review](/models/openai~-codex-auto-review) | 1.1M | 128K | 3 USD | 18 USD | генерация текста |
| [GPT-5.3 Codex Spark](/models/openai~-gpt-5.3-codex-spark) | 128K | 32K | 1.1 USD (1.05 USD) | 8.4 USD | генерация текста |
| [GPT-5.5](/models/openai~-gpt-5.5) | 1.1M | 128K | 3 USD | 18 USD | генерация текста |
| [GPT-5.6 Luna](/models/openai~-gpt-5.6-luna) | 1.1M | 128K | 0.1 USD (0.12 USD) | 0.7 USD (0.72 USD) | генерация текста |
| [GPT-5.6 Sol](/models/openai~-gpt-5.6-sol) | 1.1M | 128K | 2.4 USD | 12 USD | генерация текста |
| [GPT-6 Astra](/models/openai~-gpt-6-astra) | 1.1M | 128K | 6 USD | 30 USD | генерация текста |
| [GPT-5.6 Terra](/models/openai~-gpt-5.6-terra) | 1.1M | 128K | 1.2 USD | 7.2 USD | генерация текста |
| [GPT-6 Sol](/models/openai~-gpt-6-sol) | 1.1M | 128K | 1.1 USD | 5.5 USD | генерация текста |
| [Grok 4.5](/models/xai~-grok-4.5) | 500K | 500K | 1.2 USD | 3.6 USD | генерация текста |
| [Grok 4.6](/models/xai~-grok-4.6) | 500K | 500K | 1.2 USD | 3.6 USD | генерация текста |
| [Grok 4.7](/models/xai~-grok-4.7) | 500K | 500K | 1.1 USD | 3.3 USD | генерация текста |
| [GLM-5.2](/models/zai~-glm-5.2) | 1M | 131.1K | 0.8 USD (0.84 USD) | 2.6 USD (2.64 USD) | генерация текста |
| [GLM-5.3](/models/zai~-glm-5.3) | 1M | 131.1K | 0.8 USD (0.84 USD) | 2.6 USD (2.64 USD) | генерация текста |
:::

## Цены {#pricing}

:::matrix
| Измерение | Ставка |
| --- | --- |
| Входные токены | 0.3 USD за 1 млн токенов |
| Чтение из кеша | 0.03 USD за 1 млн токенов |
| Выходные токены | 1.8 USD за 1 млн токенов |
:::

> [Весь прайс-лист →](https://kumorouter.com/pricing)

## Интеграции {#integrations}

Каждая ссылка открывает свою инструкцию с уже выбранной здесь моделью.

:::cards
- [Codex CLI](/codex-cli?model=google%2Fgemini-3-flash-preview) — Провайдер в config.toml, ключ из переменной окружения — и Codex CLI работает через шлюз, не меняя ни одной вашей привычки.
- [Cursor](/cursor?model=google%2Fgemini-3-flash-preview) — Свой ключ и переопределённый base URL в настройках моделей Cursor — и чат редактора ходит через шлюз. Плюс честный список того, что через него не ходит.
- [Расширения VS Code](/vscode-extensions?model=google%2Fgemini-3-flash-preview) — Cline, Roo Code и Continue — один и тот же OpenAI-совместимый провайдер: base URL, ключ, идентификатор модели. Где эти поля лежат у каждого.
- [SDK](/sdks?model=google%2Fgemini-3-flash-preview) — Официальные SDK OpenAI и Anthropic, Python и Node: установка, клиент с base URL шлюза и ключом из окружения, один вызов. Ваш код остаётся вашим кодом.
- [Интеграции](/integrations?model=google%2Fgemini-3-flash-preview) — Направьте инструмент, который у вас уже стоит, на шлюз: base URL и ключ. Живые рецепты платформы, пошаговые гайды и промпт, которым настройку делает ваш агент.
:::

> [Ошибки](page:errors) [Лимиты](page:limits) [Модели](page:models)
