Route Key
AI API コストルーティング基盤
接続済み / 00:00:00
OpenAI互換 AI リレー

AIキーは1つ。すべてのモデルへ。

GPT、Claude、Gemini、DeepSeek、Qwen などを1つの互換・割引ゲートウェイから利用できます。

主要モデルを集約
割引ルート
差し替え可能なAPI
クイックスタート

3ステップで本番へ

1つのアカウント、1つのキー、1つの課金面。モデル価格を比較し、コストとレイテンシでルーティングし、ストリーミング応答を保ち、コンソールから利用状況を監視できます。

削減利用不可
01クイックスタート
01
キーを作成
Dashboard から API token を生成またはコピーします。
02
Base URL を差し替え
SDK を Route Key 互換 endpoint に向けます。
03
リクエストを送信
モデルを選ぶか、健全な割引レーンをルーティングに選ばせます。
curl /v1/chat/completions \
  -H "Authorization: Bearer sk-route-key" \
  -d '{"model":"gpt-4o-mini","stream":true}'
02モデルマトリクス
FLUX-1.1-pro
Custom
image-generation
128Kコンテキスト利用不可レイテンシ
$0.075000/ M tokens
FLUX.1-Kontext-pro
Custom
image-generation
128Kコンテキスト利用不可レイテンシ
$0.075000/ M tokens
Hunyuan3D-2
Tencent
openai
128Kコンテキスト利用不可レイテンシ
$0.075000/ M tokens
3ステップで開始

キーを作成し、base URL を差し替え、通信を送信。

既存 SDK はリクエスト形式を維持できます。Route Key がカタログ参照、チャネル価格、ストリーミング、フォールバックをゲートウェイ内で処理します。

強調されたモデルレーンへリクエストがルーティングされるダッシュボード図
ゲートウェイ
カタログ
ポリシー
削減
互換
ルート差分利用不可
割引モデルアクセス利用不可
高速なルート判定利用不可
プライバシーガード限定
967
モデル
18
ベンダー
6
エンドポイント
7
グループ
FLUX-1.1-pro
Custom
image-generation
$0.075000
価格
128K
コンテキスト
利用不可
レイテンシ
FLUX.1-Kontext-pro
Custom
image-generation
$0.075000
価格
128K
コンテキスト
利用不可
レイテンシ
Hunyuan3D-2
Tencent
openai
$0.075000
価格
128K
コンテキスト
利用不可
レイテンシ
01
キーを作成
Dashboard から API token を生成またはコピーします。
02
Base URL を差し替え
SDK を Route Key 互換 endpoint に向けます。
03
リクエストを送信
モデルを選ぶか、健全な割引レーンをルーティングに選ばせます。

本番トラフィックを流す前のよくある質問

01どのモデルを使えますか?

Route Key は pricing backend で有効になったモデルを公開します。GPT、Claude、Gemini、DeepSeek、Qwen、互換カスタムチャネルなどが含まれます。Models ページでベンダー、コンテキスト長、対応 endpoint、利用グループ、正確なモデル ID を確認してから本番トラフィックを送れます。

02SDKコードを書き換える必要がありますか?

通常は不要です。既存の OpenAI 形式と SDK コードを保ち、base URL を Route Key 互換 endpoint に差し替え、Route Key API キーと対応モデル ID を設定します。まず短い非ストリーミングリクエストで確認し、その後 streaming、tools、長いコンテキストを追加してください。

03割引はどう機能しますか?

ゲートウェイはグループ倍率、入力・出力トークン価格、キャッシュ、レイテンシ、健全性で利用可能なルートを比較します。モデルを固定することも、健全で低コストなルートをポリシーに選ばせることもできます。利用ログでモデル、トークン、グループ、コストを確認し、削減効果を測定します。

04APIキーとログはどう扱われますか?

キーはコンソールでマスク表示されます。設定されたプライバシー制御に従い、利用ログではステータス、モデル、コスト、入出力トークン、レイテンシ、時刻を確認できます。アプリやコーディングエージェントごとにキーを分けると、権限のローテーションと利用状況の把握が容易です。

05ルーティングで応答は遅くなりますか?

ルーティング判定は dispatch 前に行われるため、送信前に異常なチャネルを避けられます。ストリーミング endpoint では SSE 形式を維持しながら健全なルートを選択します。本番後はレイテンシとエラーを確認し、プロバイダー障害に備えて明示的なフォールバックを設定してください。

06実験用途だけですか?

いいえ。Dashboard で専用 API キーを作成し、互換 endpoint と正確なモデル ID を設定して短いテストを送ります。応答、クォータ、モデル、トークン、レイテンシ、コストを利用ログで確認してから、streaming、同時実行、再試行、フォールバックを段階的に追加すると安全に本番化できます。