Перейти к содержимомуKumoДокументация
Разделы
На странице
Модели Google

Gemini 3 Flash Preview

Текстовая модель Google Gemini 3 Flash Preview. Доступна по протоколу Chat Completions.

Открыть как Markdown

Обзор

Контекст

1Mтокенов

Максимум вывода

65.5Kтокенов

Вход

0.3 USDза 1 млн токенов

Выход

1.8 USDза 1 млн токенов

Релиз

17 декабря 2025 г.

Идентификатор
google/gemini-3-flash-preview

Быстрый старт: Gemini 3 Flash Preview

Имя модели уже подставлено. Возьмите ключ из консоли, положите его в переменную окружения — и вызов готов к запуску. Кошелёк организации при этом должен быть пополнен: вызов, за который нечем платить, отвечает 402.

curl https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "google/gemini-3-flash-preview",
  "max_tokens": 1024,
  "messages": [
    {
      "role": "user",
      "content": "Объясни токены одной строкой."
    }
  ]
}'

OpenAI — параметры API

Authorization: Bearer $KUMO_API_KEY

ПараметрТипПо умолчанию / диапазонОписание
modelstringОбязательныйИдентификатор модели из каталога.
messagesarray1–512Сообщения диалога в хронологическом порядке.
max_tokensinteger≥ 1Необязателен. Без max_tokens и max_completion_tokens запрос обслуживается по опубликованному умолчанию поверхности — 32768 выходных токенов. Значение также ограничено возможностями модели.
temperaturenumber0–2Случайность генерации. Без значения выбор остаётся за моделью.
top_pnumber0–1Вероятностная масса выборки. Без значения выбор остаётся за моделью.
stoparray≤ 4Массив строк, останавливающих генерацию.
max_completion_tokensinteger≥ 1Необязательная альтернатива max_tokens. При передаче обоих с РАЗНЫМИ значениями запрос отклоняется: правило старшинства молча отбросило бы одно из двух чисел, написанных намеренно.

Один вариант ответа на запрос. Параметры frequency_penalty, presence_penalty, seed, logprobs, top_logprobs и logit_bias отклоняются шлюзом: каждый из них менял бы генерацию или форму ответа, и принять его молча значило бы солгать о полученном ответе. n принимается только со значением 1 — это умолчание протокола и ровно то, что шлюз делает, — а n больше единицы отклоняется. user принимается, но не передаётся модели, не сохраняется и не возвращается в ответе. То же относится к полю strict в объявлении функции и полю name в сообщении роли tool: они принимаются, но не передаются. reasoning_effort принимается и тоже не передаётся: ни один запрос к поставщику на этой платформе не несёт бюджета рассуждений, поэтому ответ приходит на умолчании самой модели, что бы ни говорило поле. cache_control в сообщении, в части контента и в переигранном вызове инструмента принимается и тоже не передаётся: у провода поставщика, которым обслуживается этот протокол, нет члена для якоря кэша, поэтому счётчики кэшированных токенов приходят так, будто якорь не присылали. messages[].content принимается и строкой, и массивом частей: части типа text склеиваются по порядку в один текст, то есть запрос, написанный частями, и тот же запрос строкой — один запрос. Часть типа image_url, input_audio, file или refusal отклоняется с указанием её собственного type: мультимодальная способность на этой платформе не подтверждена ни для одной пары, а переигранный отказ доехал бы до поставщика как обычная реплика ассистента. Роль developer принимается и передаётся как system — это новое имя роли инструкций в том же протоколе. stop принимается только массивом; tool_choice — строковым режимом auto, none или required либо объектом, называющим объявленный инструмент. Режим json_object отклоняется по имени: обещание валидного JSON ничего не говорит о его форме.

Идентификаторы

Каноническое имя
google/gemini-3-flash-preview
Псевдонимы
gemini-3-flash
Код вендора
google
Протоколы
chat_completions
Модальности
text_generation

Возможности

Протокол и модальностьСтримингИнструментыСтруктурированный выводСтрогие семантикиСтриминг структурированного
Chat Completions генерация текстаНе подтвержденоНе подтвержденоНе подтвержденоНе подтвержденоНе подтверждено

Строка описывает пару «протокол и модальность», а не модель целиком: возможность доказывается на конкретной поверхности, и на соседней ответ может быть другим.

Сравнение

МодельКонтекстМаксимум выводаВход $/млнВыход $/млнМодальности
Gemini 3 Flash Preview1M65.5K0.3 USD1.8 USDгенерация текста
Claude Sonnet 51M128K1.2 USD6 USDгенерация текста
Claude Opus 4.81M128K3 USD15 USDгенерация текста
Claude Fable 51M128K6 USD30 USDгенерация текста
Claude Fable 5.11M128K6 USD30 USDгенерация текста
Claude Haiku 4.5200K64K0.6 USD3 USDгенерация текста
Claude Opus 4.5200K64K3 USD15 USDгенерация текста
Claude Opus 4.61M128K3 USD15 USDгенерация текста
Claude Opus 4.71M128K3 USD15 USDгенерация текста
Claude Opus 5.51M128K2.2 USD11 USDгенерация текста
Claude Opus 51M128K3 USD15 USDгенерация текста
Claude Sonnet 4.51M64K1.8 USD9 USDгенерация текста
Claude Sonnet 4.61M128K1.8 USD9 USDгенерация текста
Gemini 3.1 Flash Lite1M65.5K0.2 USD0.9 USDгенерация текста
Gemini 3.6 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Gemini 3.7 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Gemini 3.8 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Codex Auto Review1.1M128K3 USD18 USDгенерация текста
GPT-5.3 Codex Spark128K32K1.1 USD8.4 USDгенерация текста
GPT-5.51.1M128K3 USD18 USDгенерация текста
GPT-5.6 Luna1.1M128K0.1 USD0.7 USDгенерация текста
GPT-5.6 Sol1.1M128K2.4 USD12 USDгенерация текста
GPT-6 Astra1.1M128K6 USD30 USDгенерация текста
GPT-5.6 Terra1.1M128K1.2 USD7.2 USDгенерация текста
GPT-6 Sol1.1M128K1.1 USD5.5 USDгенерация текста
Grok 4.5500K500K1.2 USD3.6 USDгенерация текста
Grok 4.6500K500K1.2 USD3.6 USDгенерация текста
Grok 4.7500K500K1.1 USD3.3 USDгенерация текста
GLM-5.21M131.1K0.8 USD2.6 USDгенерация текста
GLM-5.31M131.1K0.8 USD2.6 USDгенерация текста

Цены

ИзмерениеСтавка
Входные токены0.3 USD за 1 млн токенов
Чтение из кеша0.03 USD за 1 млн токенов
Выходные токены1.8 USD за 1 млн токенов

Весь прайс-лист →

Интеграции

Каждая ссылка открывает свою инструкцию с уже выбранной здесь моделью.

Ошибки Лимиты Модели