Route Key
label
Демо-режим / 00:00:00
OpenAI-совместимый AI relay

Один AI-ключ. Все модели.

Описание для description.

Основные модели
Дешевые маршруты
Совместимые API-вызовы
developer eyebrow

developer title

Описание для stack description.

Экономияlabels.notAvailable
01quickstart
01
Создать ключ
Создайте или скопируйте API token в Dashboard.
02
Заменить Base URL
Направьте SDK на endpoint Route Key.
03
Отправить запрос
Выберите модель или доверьте выбор здоровой линии политике.
curl /v1/chat/completions \
  -H "Authorization: Bearer sk-route-key" \
  -d '{"model":"gpt-4o-mini","stream":true}'
02models eyebrow
gpt-4o-mini
OpenAI
chat
128KКонтекстlabels.notAvailableЗадержка
$0.000240/ M tokens
claude-3-5-sonnet
Anthropic
messages
200KКонтекстlabels.notAvailableЗадержка
$0.001800/ M tokens
gemini-1.5-pro
Google
generateContent
1MКонтекстlabels.notAvailableЗадержка
$0.001200/ M tokens
motion eyebrow

motion title

Сохраняйте формат запросов SDK, пока Route Key сравнивает маршруты, цены и состояние каналов.

routing image alt
core label
catalog label
policy label
savings label
compat label
readout labellabels.notAvailable
Доступ к моделям со скидкойlabels.notAvailable
Быстрое решение маршрутаlabels.notAvailable
Приватные огражденияОграничено
5
Модели
5
Вендоры
4
Endpoints
4
Группы
gpt-4o-mini
OpenAI
chat
$0.000240
Цена
128K
Контекст
labels.notAvailable
Задержка
claude-3-5-sonnet
Anthropic
messages
$0.001800
Цена
200K
Контекст
labels.notAvailable
Задержка
gemini-1.5-pro
Google
generateContent
$0.001200
Цена
1M
Контекст
labels.notAvailable
Задержка
01
Создать ключ
Создайте или скопируйте API token в Dashboard.
02
Заменить Base URL
Направьте SDK на endpoint Route Key.
03
Отправить запрос
Выберите модель или доверьте выбор здоровой линии политике.

Частые вопросы перед production-маршрутизацией

01Какие модели можно использовать?

Route Key показывает модели, включённые в pricing backend: GPT, Claude, Gemini, DeepSeek, Qwen и совместимые пользовательские каналы. На странице Models можно сравнить провайдера, длину контекста, endpoint, доступные группы и точный ID модели перед production-трафиком.

02Нужно ли переписывать SDK?

Обычно нет. Сохраните привычный OpenAI request body и SDK, замените base URL на совместимый endpoint Route Key, задайте API key Route Key и выберите поддерживаемый ID модели. Сначала отправьте короткий запрос без streaming, затем поэтапно добавляйте streaming, tools и длинный контекст.

03Как работает скидка?

Gateway сравнивает routes по group ratio, ценам входных и выходных токенов, кэшу, latency и health. Можно закрепить модель или позволить политике выбрать здоровый более дешёвый route. В Usage Logs сравнивайте модель, токены, группу и стоимость, чтобы видеть фактическую экономию.

04Что с API-ключами и логами?

Ключи маскируются в консоли. В зависимости от настроек приватности Usage Logs показывают статус, модель, стоимость, входные и выходные токены, latency и время. Отдельный ключ для каждого приложения или coding agent упрощает ротацию доступа и точное распределение расходов.

05Маршрутизация замедлит ответ?

Решение принимается до dispatch, поэтому неисправный канал можно исключить ещё до отправки запроса. Streaming endpoints сохраняют формат SSE. После запуска проверяйте latency и ошибки, а для сбоев провайдера задайте явный fallback вместо одинаковых бесконечных повторов в каждом клиенте.

06Это только для экспериментов?

Нет. Создайте отдельный ключ в Dashboard, настройте совместимый endpoint и точный ID модели, затем отправьте короткий тест. Проверьте ответ, quota, модель, токены, latency и стоимость в Usage Logs. После этого добавляйте streaming, concurrency, retries и fallback по одному, чтобы изменения оставались наблюдаемыми и обратимыми.