Route Key示範模式
AI 流量控制

Route Key: OpenAI 相容 AI API 閘道

路由每一個 請求。

OpenAI 相容 AI API 閘道

整合面板

替換端點,保留工作流

快速開始

用一把 API 金鑰搭配 OpenAI 相容請求格式。

Use Route Key with coding agentsCodex · Claude Code · Gemini CLI · CursorConfigure agents
1簽發金鑰
2替換 Base URL
3路由流量
4用量記錄
冷備援通道4 條通道

不改應用程式碼,也能避開昂貴或不健康的路由。

串流SSE

閘道選擇健康通道時,仍保持 SSE 形式回應不中斷。

營運姿態

更少供應商漂移,更清晰流量控制

隱私防護邊界
API 金鑰會被遮罩,帳戶資料留在控制台後方,記錄聚焦於用量可視性。
亞秒級策略決策
閘道策略會在回應串流抵達應用前選擇健康通道。
帳戶隔離
使用者 Token、帳單與偏好都綁定在已登入帳戶。
Request console策略可優先選擇低成本且健康的通道,同時保留相容請求格式。
POST /chat/completions
curl https://api.routekey.ai/v1/chat/completions \
  -H "Authorization: Bearer sk-route-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-4o-mini",
    "routing": {
      "policy": "cost_latency_health",
      "fallback": ["deepseek-chat", "gemini-1.5-pro"]
    },
    "stream": true,
    "messages": [
      { "role": "user", "content": "Route this by cost and latency." }
    ]
  }'

請求進入閘道前的常見問題

01我可以使用哪些模型?

Route Key 會公開價格後端已啟用的模型,包含主流 GPT、Claude、Gemini、DeepSeek、Qwen,以及相容的自訂通道。前往模型頁面即可比較供應商、上下文長度、端點支援、可用群組與精確模型 ID,再決定要送出正式流量。

02需要重寫 SDK 程式碼嗎?

通常不需要。保留熟悉的 OpenAI 請求 body 與 SDK 程式碼,將 Base URL 換成 Route Key 相容端點,設定 API 金鑰並選擇支援的模型 ID。先用短小的非串流請求確認回應,再逐步加入串流、工具與長上下文,能較快定位整合問題。

03折扣如何運作?

閘道會依群組倍率、輸入與輸出 Token 價格、快取、延遲與健康度比較可用路由。需要一致性時可以固定模型,也可以讓策略挑選健康且成本較低的路由。請在用量記錄中比較模型、Token、群組與成本,確認節省是真實可量化的。

04API 金鑰與記錄會如何處理?

金鑰在控制台中以遮罩顯示。依照隱私設定,用量記錄可查看狀態、模型、成本、輸入輸出 Token、延遲與時間。為每個應用程式或 coding agent 使用獨立金鑰,方便輪替權限,也能清楚歸屬每個工作負載的用量。

05路由會拖慢回應嗎?

路由在派送前決定,因此可以在送出請求前避開異常通道。串流端點仍會維持 SSE 回應格式,同時由閘道選擇健康路由。上線後請觀察延遲與錯誤,並為供應商故障設定明確的備援策略,避免每個客戶端都無限制重試。

06這只適合實驗嗎?

不是。先在工作台建立獨立 API 金鑰,設定相容端點與精確模型 ID,再送出短小測試。於用量記錄確認回應、額度、模型、Token、延遲與成本,接著逐步加入串流、並行、重試與備援,讓正式環境的變更可觀察也可回復。