Route Key
label
데모 모드 / 00:00:00
OpenAI 호환 AI 릴레이

AI 키 하나. 모든 모델.

description에 대한 설명입니다.

주요 모델
할인 라우트
즉시 호환 API
빠른 시작

3단계로 실행

stack description에 대한 설명입니다.

절감labels.notAvailable
01quickstart
01
키 생성
Dashboard에서 API token을 생성하거나 복사합니다.
02
Base URL 교체
SDK를 Route Key 호환 endpoint로 지정합니다.
03
요청 전송
모델을 선택하거나 건전한 할인 레인을 자동 선택합니다.
curl /v1/chat/completions \
  -H "Authorization: Bearer sk-route-key" \
  -d '{"model":"gpt-4o-mini","stream":true}'
02모델 매트릭스
gpt-4o-mini
OpenAI
chat
128K컨텍스트labels.notAvailable지연
$0.000240/ M tokens
claude-3-5-sonnet
Anthropic
messages
200K컨텍스트labels.notAvailable지연
$0.001800/ M tokens
gemini-1.5-pro
Google
generateContent
1M컨텍스트labels.notAvailable지연
$0.001200/ M tokens
motion eyebrow

motion title

SDK 요청 형식은 유지하고 Route Key가 경로, 가격과 채널 상태를 비교합니다.

routing image alt
core label
catalog label
policy label
savings label
compat label
readout labellabels.notAvailable
할인된 모델 접근labels.notAvailable
빠른 라우트 결정labels.notAvailable
프라이버시 가드레일제한
5
모델
5
벤더
4
엔드포인트
4
그룹
gpt-4o-mini
OpenAI
chat
$0.000240
가격
128K
컨텍스트
labels.notAvailable
지연
claude-3-5-sonnet
Anthropic
messages
$0.001800
가격
200K
컨텍스트
labels.notAvailable
지연
gemini-1.5-pro
Google
generateContent
$0.001200
가격
1M
컨텍스트
labels.notAvailable
지연
01
키 생성
Dashboard에서 API token을 생성하거나 복사합니다.
02
Base URL 교체
SDK를 Route Key 호환 endpoint로 지정합니다.
03
요청 전송
모델을 선택하거나 건전한 할인 레인을 자동 선택합니다.

생산 트래픽 라우팅 전 자주 묻는 질문

01어떤 모델을 사용할 수 있나요?

Route Key는 가격 backend에서 활성화한 모델을 노출합니다. GPT, Claude, Gemini, DeepSeek, Qwen과 호환 커스텀 채널이 포함될 수 있습니다. Models 페이지에서 공급자, 컨텍스트 길이, endpoint, 사용 가능한 그룹과 정확한 모델 ID를 확인한 뒤 production traffic을 보내세요.

02SDK 코드를 다시 작성해야 하나요?

보통은 아닙니다. 기존 OpenAI 요청 본문과 SDK 코드를 유지하고 base URL을 Route Key 호환 endpoint로 바꾸며 Route Key API key와 지원 모델 ID를 설정하면 됩니다. 먼저 짧은 비스트리밍 요청을 확인한 다음 streaming, tools, 긴 컨텍스트를 단계적으로 추가하세요.

03할인은 어떻게 동작하나요?

Gateway는 그룹 비율, 입력·출력 토큰 가격, 캐시, 지연 시간과 상태를 비교합니다. 일관성이 필요하면 모델을 고정하고, 아니면 정책이 건강하고 저렴한 route를 고르게 할 수 있습니다. 사용 로그에서 모델, 토큰, 그룹과 비용을 확인해 실제 절감액을 검증하세요.

04API 키와 로그는 어떻게 처리되나요?

키는 콘솔에서 마스크됩니다. 설정된 privacy control에 따라 사용 로그에서 상태, 모델, 비용, 입출력 토큰, 지연 시간과 시각을 확인할 수 있습니다. 앱이나 코딩 에이전트마다 별도 키를 사용하면 권한 교체와 사용량 추적이 쉬워집니다.

05라우팅이 응답을 느리게 하나요?

라우팅은 dispatch 전에 결정되므로 요청을 보내기 전에 장애가 있는 채널을 피할 수 있습니다. Streaming endpoint는 SSE 응답 형식을 유지합니다. 배포 후 지연과 오류를 확인하고, provider 장애에는 클라이언트의 무분별한 재시도 대신 명시적인 fallback 정책을 사용하세요.

06실험용만인가요?

아닙니다. Dashboard에서 전용 API key를 만들고 호환 endpoint와 정확한 모델 ID를 설정한 뒤 짧은 테스트를 보내세요. 응답, 쿼터, 모델, 토큰, 지연과 비용을 사용 로그에서 확인한 후 streaming, 동시성, retry와 fallback을 하나씩 추가하면 production 변경을 관찰하고 되돌리기 쉽습니다.