Перейти к содержимомуKumoДокументация
Разделы
На странице
Модели Anthropic

Claude Sonnet 4.5

Текстовая модель Anthropic Claude Sonnet 4.5 (2025-09-29). Доступна по протоколам Anthropic Messages и Chat Completions.

Открыть как Markdown

Обзор

Контекст

1Mтокенов

Максимум вывода

64Kтокенов

Вход

1.8 USDза 1 млн токенов

Выход

9 USDза 1 млн токенов

Релиз

29 сентября 2025 г.

Идентификатор
anthropic/claude-sonnet-4-5-20250929

Быстрый старт: Claude Sonnet 4.5

Имя модели уже подставлено. Возьмите ключ из консоли, положите его в переменную окружения — и вызов готов к запуску. Кошелёк организации при этом должен быть пополнен: вызов, за который нечем платить, отвечает 402.

curl https://api.kumorouter.com/v1/chat/completions \
  -H "Authorization: Bearer $KUMO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "anthropic/claude-sonnet-4-5-20250929",
  "max_tokens": 1024,
  "messages": [
    {
      "role": "user",
      "content": "Объясни токены одной строкой."
    }
  ]
}'

Anthropic-совместимый вызов

curl https://api.kumorouter.com/v1/messages \
  -H "x-api-key: $KUMO_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "anthropic/claude-sonnet-4-5-20250929",
  "max_tokens": 1024,
  "messages": [
    {
      "role": "user",
      "content": "Объясни токены одной строкой."
    }
  ]
}'

OpenAI — параметры API

Authorization: Bearer $KUMO_API_KEY

ПараметрТипПо умолчанию / диапазонОписание
modelstringОбязательныйИдентификатор модели из каталога.
messagesarray1–512Сообщения диалога в хронологическом порядке.
max_tokensinteger≥ 1Необязателен. Без max_tokens и max_completion_tokens запрос обслуживается по опубликованному умолчанию поверхности — 32768 выходных токенов. Значение также ограничено возможностями модели.
temperaturenumber0–2Случайность генерации. Без значения выбор остаётся за моделью.
top_pnumber0–1Вероятностная масса выборки. Без значения выбор остаётся за моделью.
stoparray≤ 4Массив строк, останавливающих генерацию.
max_completion_tokensinteger≥ 1Необязательная альтернатива max_tokens. При передаче обоих с РАЗНЫМИ значениями запрос отклоняется: правило старшинства молча отбросило бы одно из двух чисел, написанных намеренно.
streambooleanfalseПотоковая передача событий Server-Sent Events.
stream_optionsobject{include_usage: boolean}Только при stream: true. include_usage добавляет итоговое событие расхода перед [DONE]; по умолчанию false.
toolsarray≤ 128Объявления функций. parameters — исходный объект JSON Schema размером до 65536 байт на инструмент, включая вложенные объекты и массивы.
tool_choicestring | objectauto | none | required | {type: "function", function: {name}}auto — выбор остаётся за моделью, none — вызов запрещён, а объявления остаются видимыми, required — вызов какого-либо объявленного инструмента обязателен, объект — обязателен вызов названного. Без значения инструмент выбирает модель.

Один вариант ответа на запрос. Параметры frequency_penalty, presence_penalty, seed, logprobs, top_logprobs и logit_bias отклоняются шлюзом: каждый из них менял бы генерацию или форму ответа, и принять его молча значило бы солгать о полученном ответе. n принимается только со значением 1 — это умолчание протокола и ровно то, что шлюз делает, — а n больше единицы отклоняется. user принимается, но не передаётся модели, не сохраняется и не возвращается в ответе. То же относится к полю strict в объявлении функции и полю name в сообщении роли tool: они принимаются, но не передаются. reasoning_effort принимается и тоже не передаётся: ни один запрос к поставщику на этой платформе не несёт бюджета рассуждений, поэтому ответ приходит на умолчании самой модели, что бы ни говорило поле. cache_control в сообщении, в части контента и в переигранном вызове инструмента принимается и тоже не передаётся: у провода поставщика, которым обслуживается этот протокол, нет члена для якоря кэша, поэтому счётчики кэшированных токенов приходят так, будто якорь не присылали. messages[].content принимается и строкой, и массивом частей: части типа text склеиваются по порядку в один текст, то есть запрос, написанный частями, и тот же запрос строкой — один запрос. Часть типа image_url, input_audio, file или refusal отклоняется с указанием её собственного type: мультимодальная способность на этой платформе не подтверждена ни для одной пары, а переигранный отказ доехал бы до поставщика как обычная реплика ассистента. Роль developer принимается и передаётся как system — это новое имя роли инструкций в том же протоколе. stop принимается только массивом; tool_choice — строковым режимом auto, none или required либо объектом, называющим объявленный инструмент. Режим json_object отклоняется по имени: обещание валидного JSON ничего не говорит о его форме.

Anthropic — параметры API

x-api-key: $KUMO_API_KEY

ПараметрТипПо умолчанию / диапазонОписание
modelstringОбязательныйИдентификатор модели из каталога.
messagesarray1–512Сообщения диалога в хронологическом порядке.
max_tokensinteger1–1048576Обязательный лимит выходных токенов с учётом ограничений модели.
temperaturenumber0–1Случайность генерации. Без значения выбор остаётся за моделью.
top_pnumber0–1Вероятностная масса выборки. Без значения выбор остаётся за моделью.
stop_sequencesarray≤ 16Массив строк, останавливающих генерацию.
systemstring | array—Системная инструкция: строка или текстовые блоки.
top_kinteger1–1048576Оставить K наиболее вероятных токенов при выборке. Передаётся модели без изменения; отсутствие не подменяется нулём.
streambooleanfalseПотоковая передача событий Server-Sent Events.
toolsarray≤ 128Объявления инструментов. input_schema — исходный объект JSON Schema размером до 65536 байт на инструмент.
tool_choiceobject{type: auto | any | none | tool}auto — выбор модели, any — обязательный вызов, none — запрет вызова, tool — указанный инструмент. name обязателен только для tool и запрещён для остальных режимов.

Используется нативный формат Messages. OpenAI-параметры frequency_penalty, presence_penalty, n, seed и response_format к нему не относятся. metadata, thinking, output_config и context_management принимаются, но не передаются модели и не входят в подтверждённую поддержку. То же относится к полям объявления инструмента eager_input_streaming, strict, defer_loading, allowed_callers, input_examples и max_uses; серверные инструменты не поддерживаются. input_schema инструмента передаётся как исходный объект JSON Schema. cache_control: {type: "ephemeral"} поддерживается на текстовых блоках и объявлениях инструментов; доступность кеширования зависит от модели.

Идентификаторы

Каноническое имя
anthropic/claude-sonnet-4-5-20250929
Псевдонимы
claude-sonnet-4-5, claude-sonnet-4-5-20250929
Код вендора
anthropic
Протоколы
anthropic_messages, chat_completions
Модальности
text_generation

Возможности

Протокол и модальностьСтримингИнструментыСтруктурированный выводСтрогие семантикиСтриминг структурированного
Anthropic Messages генерация текстаДаДаНе подтвержденоНе подтвержденоНе подтверждено
Chat Completions генерация текстаДаНе подтвержденоНе подтвержденоНе подтвержденоНе подтверждено
Chat Completions генерация текстаДаДаНе подтвержденоНе подтвержденоНе подтверждено
Chat Completions генерация текстаНе подтвержденоДаНе подтвержденоНе подтвержденоНе подтверждено

Строка описывает пару «протокол и модальность», а не модель целиком: возможность доказывается на конкретной поверхности, и на соседней ответ может быть другим.

Сравнение

МодельКонтекстМаксимум выводаВход $/млнВыход $/млнМодальности
Claude Sonnet 4.51M64K1.8 USD9 USDгенерация текста
Claude Sonnet 51M128K1.2 USD6 USDгенерация текста
Claude Opus 4.81M128K3 USD15 USDгенерация текста
Claude Fable 51M128K6 USD30 USDгенерация текста
Claude Fable 5.11M128K6 USD30 USDгенерация текста
Claude Haiku 4.5200K64K0.6 USD3 USDгенерация текста
Claude Opus 4.5200K64K3 USD15 USDгенерация текста
Claude Opus 4.61M128K3 USD15 USDгенерация текста
Claude Opus 4.71M128K3 USD15 USDгенерация текста
Claude Opus 5.51M128K2.2 USD11 USDгенерация текста
Claude Opus 51M128K3 USD15 USDгенерация текста
Claude Sonnet 4.61M128K1.8 USD9 USDгенерация текста
Gemini 3 Flash Preview1M65.5K0.3 USD1.8 USDгенерация текста
Gemini 3.1 Flash Lite1M65.5K0.2 USD0.9 USDгенерация текста
Gemini 3.6 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Gemini 3.7 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Gemini 3.8 Flash High1M65.5K0.5 USD2.3 USDгенерация текста
Codex Auto Review1.1M128K3 USD18 USDгенерация текста
GPT-5.3 Codex Spark128K32K1.1 USD8.4 USDгенерация текста
GPT-5.51.1M128K3 USD18 USDгенерация текста
GPT-5.6 Luna1.1M128K0.1 USD0.7 USDгенерация текста
GPT-5.6 Sol1.1M128K2.4 USD12 USDгенерация текста
GPT-6 Astra1.1M128K6 USD30 USDгенерация текста
GPT-5.6 Terra1.1M128K1.2 USD7.2 USDгенерация текста
GPT-6 Sol1.1M128K1.1 USD5.5 USDгенерация текста
Grok 4.5500K500K1.2 USD3.6 USDгенерация текста
Grok 4.6500K500K1.2 USD3.6 USDгенерация текста
Grok 4.7500K500K1.1 USD3.3 USDгенерация текста
GLM-5.21M131.1K0.8 USD2.6 USDгенерация текста
GLM-5.31M131.1K0.8 USD2.6 USDгенерация текста

Цены

ИзмерениеСтавка
Входные токены1.8 USD за 1 млн токенов
Запись в кеш2.3 USD за 1 млн токенов
Чтение из кеша0.2 USD за 1 млн токенов
Выходные токены9 USD за 1 млн токенов

Весь прайс-лист →

Интеграции

Каждая ссылка открывает свою инструкцию с уже выбранной здесь моделью.

Claude CodeТри переменные окружения — и Claude Code ходит через шлюз. Плюс вариант через settings.json, порядок приоритетов ключей и проверка одной командой.Codex CLIПровайдер в config.toml, ключ из переменной окружения — и Codex CLI работает через шлюз, не меняя ни одной вашей привычки.CursorСвой ключ и переопределённый base URL в настройках моделей Cursor — и чат редактора ходит через шлюз. Плюс честный список того, что через него не ходит.Расширения VS CodeCline, Roo Code и Continue — один и тот же OpenAI-совместимый провайдер: base URL, ключ, идентификатор модели. Где эти поля лежат у каждого.SDKОфициальные SDK OpenAI и Anthropic, Python и Node: установка, клиент с base URL шлюза и ключом из окружения, один вызов. Ваш код остаётся вашим кодом.ИнтеграцииНаправьте инструмент, который у вас уже стоит, на шлюз: base URL и ключ. Живые рецепты платформы, пошаговые гайды и промпт, которым настройку делает ваш агент.

Ошибки Лимиты Модели