3ステップで本番へ
クイックスタート
1つの API キーで OpenAI 互換のリクエストを使います。
Use Route Key with coding agentsCodex · Claude Code · Gemini CLI · CursorConfigure agentsアプリコードを変えずに、不健全または高価なルートから切り替えます。
健全なチャネル選択により、低レイテンシの SSE 応答を維持します。
低コスト、少ない統合作業、明快な制御
curl https://api.routekey.ai/v1/chat/completions \
-H "Authorization: Bearer sk-route-key" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4o-mini",
"routing": {
"policy": "cost_latency_health",
"fallback": ["deepseek-chat", "gemini-1.5-pro"]
},
"stream": true,
"messages": [
{ "role": "user", "content": "Route this by cost and latency." }
]
}'本番トラフィックを流す前のよくある質問
01どのモデルを使えますか?
Route Key は pricing backend で有効になったモデルを公開します。GPT、Claude、Gemini、DeepSeek、Qwen、互換カスタムチャネルなどが含まれます。Models ページでベンダー、コンテキスト長、対応 endpoint、利用グループ、正確なモデル ID を確認してから本番トラフィックを送れます。
02SDKコードを書き換える必要がありますか?
通常は不要です。既存の OpenAI 形式と SDK コードを保ち、base URL を Route Key 互換 endpoint に差し替え、Route Key API キーと対応モデル ID を設定します。まず短い非ストリーミングリクエストで確認し、その後 streaming、tools、長いコンテキストを追加してください。
03割引はどう機能しますか?
ゲートウェイはグループ倍率、入力・出力トークン価格、キャッシュ、レイテンシ、健全性で利用可能なルートを比較します。モデルを固定することも、健全で低コストなルートをポリシーに選ばせることもできます。利用ログでモデル、トークン、グループ、コストを確認し、削減効果を測定します。
04APIキーとログはどう扱われますか?
キーはコンソールでマスク表示されます。設定されたプライバシー制御に従い、利用ログではステータス、モデル、コスト、入出力トークン、レイテンシ、時刻を確認できます。アプリやコーディングエージェントごとにキーを分けると、権限のローテーションと利用状況の把握が容易です。
05ルーティングで応答は遅くなりますか?
ルーティング判定は dispatch 前に行われるため、送信前に異常なチャネルを避けられます。ストリーミング endpoint では SSE 形式を維持しながら健全なルートを選択します。本番後はレイテンシとエラーを確認し、プロバイダー障害に備えて明示的なフォールバックを設定してください。
06実験用途だけですか?
いいえ。Dashboard で専用 API キーを作成し、互換 endpoint と正確なモデル ID を設定して短いテストを送ります。応答、クォータ、モデル、トークン、レイテンシ、コストを利用ログで確認してから、streaming、同時実行、再試行、フォールバックを段階的に追加すると安全に本番化できます。
AIキーは1つ。すべてのモデルへ。
GPT、Claude、Gemini、DeepSeek、Qwen などを1つの互換・割引ゲートウェイから利用できます。
3ステップで本番へ
1つのアカウント、1つのキー、1つの課金面。モデル価格を比較し、コストとレイテンシでルーティングし、ストリーミング応答を保ち、コンソールから利用状況を監視できます。
curl /v1/chat/completions \
-H "Authorization: Bearer sk-route-key" \
-d '{"model":"gpt-4o-mini","stream":true}'キーを作成し、base URL を差し替え、通信を送信。
既存 SDK はリクエスト形式を維持できます。Route Key がカタログ参照、チャネル価格、ストリーミング、フォールバックをゲートウェイ内で処理します。

本番トラフィックを流す前のよくある質問
01どのモデルを使えますか?
Route Key は pricing backend で有効になったモデルを公開します。GPT、Claude、Gemini、DeepSeek、Qwen、互換カスタムチャネルなどが含まれます。Models ページでベンダー、コンテキスト長、対応 endpoint、利用グループ、正確なモデル ID を確認してから本番トラフィックを送れます。
02SDKコードを書き換える必要がありますか?
通常は不要です。既存の OpenAI 形式と SDK コードを保ち、base URL を Route Key 互換 endpoint に差し替え、Route Key API キーと対応モデル ID を設定します。まず短い非ストリーミングリクエストで確認し、その後 streaming、tools、長いコンテキストを追加してください。
03割引はどう機能しますか?
ゲートウェイはグループ倍率、入力・出力トークン価格、キャッシュ、レイテンシ、健全性で利用可能なルートを比較します。モデルを固定することも、健全で低コストなルートをポリシーに選ばせることもできます。利用ログでモデル、トークン、グループ、コストを確認し、削減効果を測定します。
04APIキーとログはどう扱われますか?
キーはコンソールでマスク表示されます。設定されたプライバシー制御に従い、利用ログではステータス、モデル、コスト、入出力トークン、レイテンシ、時刻を確認できます。アプリやコーディングエージェントごとにキーを分けると、権限のローテーションと利用状況の把握が容易です。
05ルーティングで応答は遅くなりますか?
ルーティング判定は dispatch 前に行われるため、送信前に異常なチャネルを避けられます。ストリーミング endpoint では SSE 形式を維持しながら健全なルートを選択します。本番後はレイテンシとエラーを確認し、プロバイダー障害に備えて明示的なフォールバックを設定してください。
06実験用途だけですか?
いいえ。Dashboard で専用 API キーを作成し、互換 endpoint と正確なモデル ID を設定して短いテストを送ります。応答、クォータ、モデル、トークン、レイテンシ、コストを利用ログで確認してから、streaming、同時実行、再試行、フォールバックを段階的に追加すると安全に本番化できます。