Route Key: OpenAI-совместимый AI API шлюз
Один AI-ключ. Все модели.
OpenAI-совместимый AI API шлюз
developer title
quickstart
Описание для quickstart desc.
Use Route Key with coding agentsCodex · Claude Code · Gemini CLI · CursorConfigure agentsУходите от нездоровых или дорогих маршрутов без изменения кода.
Сохраняйте SSE-ответы с низкой задержкой через выбор здорового канала.
Ниже стоимость, меньше интеграций, чище контроль
curl https://api.routekey.ai/v1/chat/completions \
-H "Authorization: Bearer sk-route-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"routing": {
"policy": "cost_latency_health",
"fallback": ["deepseek-chat", "gemini-1.5-pro"]
},
"stream": true,
"messages": [
{ "role": "user", "content": "Route this by cost and latency." }
]
}'Частые вопросы перед production-маршрутизацией
01Какие модели можно использовать?
Route Key показывает модели, включённые в pricing backend: GPT, Claude, Gemini, DeepSeek, Qwen и совместимые пользовательские каналы. На странице Models можно сравнить провайдера, длину контекста, endpoint, доступные группы и точный ID модели перед production-трафиком.
02Нужно ли переписывать SDK?
Обычно нет. Сохраните привычный OpenAI request body и SDK, замените base URL на совместимый endpoint Route Key, задайте API key Route Key и выберите поддерживаемый ID модели. Сначала отправьте короткий запрос без streaming, затем поэтапно добавляйте streaming, tools и длинный контекст.
03Как работает скидка?
Gateway сравнивает routes по group ratio, ценам входных и выходных токенов, кэшу, latency и health. Можно закрепить модель или позволить политике выбрать здоровый более дешёвый route. В Usage Logs сравнивайте модель, токены, группу и стоимость, чтобы видеть фактическую экономию.
04Что с API-ключами и логами?
Ключи маскируются в консоли. В зависимости от настроек приватности Usage Logs показывают статус, модель, стоимость, входные и выходные токены, latency и время. Отдельный ключ для каждого приложения или coding agent упрощает ротацию доступа и точное распределение расходов.
05Маршрутизация замедлит ответ?
Решение принимается до dispatch, поэтому неисправный канал можно исключить ещё до отправки запроса. Streaming endpoints сохраняют формат SSE. После запуска проверяйте latency и ошибки, а для сбоев провайдера задайте явный fallback вместо одинаковых бесконечных повторов в каждом клиенте.
06Это только для экспериментов?
Нет. Создайте отдельный ключ в Dashboard, настройте совместимый endpoint и точный ID модели, затем отправьте короткий тест. Проверьте ответ, quota, модель, токены, latency и стоимость в Usage Logs. После этого добавляйте streaming, concurrency, retries и fallback по одному, чтобы изменения оставались наблюдаемыми и обратимыми.
Один AI-ключ. Все модели.
Описание для description.
developer title
Описание для stack description.
curl /v1/chat/completions \
-H "Authorization: Bearer sk-route-key" \
-d '{"model":"gpt-4o-mini","stream":true}'motion title
Сохраняйте формат запросов SDK, пока Route Key сравнивает маршруты, цены и состояние каналов.

Частые вопросы перед production-маршрутизацией
01Какие модели можно использовать?
Route Key показывает модели, включённые в pricing backend: GPT, Claude, Gemini, DeepSeek, Qwen и совместимые пользовательские каналы. На странице Models можно сравнить провайдера, длину контекста, endpoint, доступные группы и точный ID модели перед production-трафиком.
02Нужно ли переписывать SDK?
Обычно нет. Сохраните привычный OpenAI request body и SDK, замените base URL на совместимый endpoint Route Key, задайте API key Route Key и выберите поддерживаемый ID модели. Сначала отправьте короткий запрос без streaming, затем поэтапно добавляйте streaming, tools и длинный контекст.
03Как работает скидка?
Gateway сравнивает routes по group ratio, ценам входных и выходных токенов, кэшу, latency и health. Можно закрепить модель или позволить политике выбрать здоровый более дешёвый route. В Usage Logs сравнивайте модель, токены, группу и стоимость, чтобы видеть фактическую экономию.
04Что с API-ключами и логами?
Ключи маскируются в консоли. В зависимости от настроек приватности Usage Logs показывают статус, модель, стоимость, входные и выходные токены, latency и время. Отдельный ключ для каждого приложения или coding agent упрощает ротацию доступа и точное распределение расходов.
05Маршрутизация замедлит ответ?
Решение принимается до dispatch, поэтому неисправный канал можно исключить ещё до отправки запроса. Streaming endpoints сохраняют формат SSE. После запуска проверяйте latency и ошибки, а для сбоев провайдера задайте явный fallback вместо одинаковых бесконечных повторов в каждом клиенте.
06Это только для экспериментов?
Нет. Создайте отдельный ключ в Dashboard, настройте совместимый endpoint и точный ID модели, затем отправьте короткий тест. Проверьте ответ, quota, модель, токены, latency и стоимость в Usage Logs. После этого добавляйте streaming, concurrency, retries и fallback по одному, чтобы изменения оставались наблюдаемыми и обратимыми.