Route Key
AI API コストルーティング基盤
デモモード / 00:00:00
OpenAI互換 AI リレー

AIキーは1つ。すべてのモデルへ。

GPT、Claude、Gemini、DeepSeek、Qwen などを1つの互換・割引ゲートウェイから利用できます。

主要モデルを集約
割引ルート
差し替え可能なAPI
クイックスタート

3ステップで本番へ

1つのアカウント、1つのキー、1つの課金面。モデル価格を比較し、コストとレイテンシでルーティングし、ストリーミング応答を保ち、コンソールから利用状況を監視できます。

削減labels.notAvailable
01クイックスタート
01
キーを作成
Dashboard から API token を生成またはコピーします。
02
Base URL を差し替え
SDK を Route Key 互換 endpoint に向けます。
03
リクエストを送信
モデルを選ぶか、健全な割引レーンをルーティングに選ばせます。
curl /v1/chat/completions \
  -H "Authorization: Bearer sk-route-key" \
  -d '{"model":"gpt-4o-mini","stream":true}'
02モデルマトリクス
gpt-4o-mini
OpenAI
chat
128Kコンテキストlabels.notAvailableレイテンシ
$0.000240/ M tokens
claude-3-5-sonnet
Anthropic
messages
200Kコンテキストlabels.notAvailableレイテンシ
$0.001800/ M tokens
gemini-1.5-pro
Google
generateContent
1Mコンテキストlabels.notAvailableレイテンシ
$0.001200/ M tokens
3ステップで開始

キーを作成し、base URL を差し替え、通信を送信。

既存 SDK はリクエスト形式を維持できます。Route Key がカタログ参照、チャネル価格、ストリーミング、フォールバックをゲートウェイ内で処理します。

強調されたモデルレーンへリクエストがルーティングされるダッシュボード図
ゲートウェイ
カタログ
ポリシー
削減
互換
ルート差分labels.notAvailable
割引モデルアクセスlabels.notAvailable
高速なルート判定labels.notAvailable
プライバシーガード限定
5
モデル
5
ベンダー
4
エンドポイント
4
グループ
gpt-4o-mini
OpenAI
chat
$0.000240
価格
128K
コンテキスト
labels.notAvailable
レイテンシ
claude-3-5-sonnet
Anthropic
messages
$0.001800
価格
200K
コンテキスト
labels.notAvailable
レイテンシ
gemini-1.5-pro
Google
generateContent
$0.001200
価格
1M
コンテキスト
labels.notAvailable
レイテンシ
01
キーを作成
Dashboard から API token を生成またはコピーします。
02
Base URL を差し替え
SDK を Route Key 互換 endpoint に向けます。
03
リクエストを送信
モデルを選ぶか、健全な割引レーンをルーティングに選ばせます。

本番トラフィックを流す前のよくある質問

01どのモデルを使えますか?

Route Key は pricing backend で有効になったモデルを公開します。GPT、Claude、Gemini、DeepSeek、Qwen、互換カスタムチャネルなどが含まれます。Models ページでベンダー、コンテキスト長、対応 endpoint、利用グループ、正確なモデル ID を確認してから本番トラフィックを送れます。

02SDKコードを書き換える必要がありますか?

通常は不要です。既存の OpenAI 形式と SDK コードを保ち、base URL を Route Key 互換 endpoint に差し替え、Route Key API キーと対応モデル ID を設定します。まず短い非ストリーミングリクエストで確認し、その後 streaming、tools、長いコンテキストを追加してください。

03割引はどう機能しますか?

ゲートウェイはグループ倍率、入力・出力トークン価格、キャッシュ、レイテンシ、健全性で利用可能なルートを比較します。モデルを固定することも、健全で低コストなルートをポリシーに選ばせることもできます。利用ログでモデル、トークン、グループ、コストを確認し、削減効果を測定します。

04APIキーとログはどう扱われますか?

キーはコンソールでマスク表示されます。設定されたプライバシー制御に従い、利用ログではステータス、モデル、コスト、入出力トークン、レイテンシ、時刻を確認できます。アプリやコーディングエージェントごとにキーを分けると、権限のローテーションと利用状況の把握が容易です。

05ルーティングで応答は遅くなりますか?

ルーティング判定は dispatch 前に行われるため、送信前に異常なチャネルを避けられます。ストリーミング endpoint では SSE 形式を維持しながら健全なルートを選択します。本番後はレイテンシとエラーを確認し、プロバイダー障害に備えて明示的なフォールバックを設定してください。

06実験用途だけですか?

いいえ。Dashboard で専用 API キーを作成し、互換 endpoint と正確なモデル ID を設定して短いテストを送ります。応答、クォータ、モデル、トークン、レイテンシ、コストを利用ログで確認してから、streaming、同時実行、再試行、フォールバックを段階的に追加すると安全に本番化できます。