도구 설정

OpenAI 호환 API 빠른 시작: Responses와 Chat Completions

sk-pool 키는 Claude 전용이 아닙니다. 같은 키와 선불 잔액으로 OpenAI 호환 엔드포인트를 통해 GPT-5 라인업을 사용할 수 있습니다 — 표준 Responses 및 Chat Completions 호출, 공식 OpenAI SDK, SSE 스트리밍, 동일한 50% 통일 할인.

·

첫 GPT 호출까지 세 단계

  1. 01무료 계정을 만들고 API 키 하나를 발급받으세요(sk-pool-… 형태) — 이 키는 이미 Claude 모델도 커버합니다.
  2. 02클라이언트를 https://router.apitoken.sale/v1 로 지정하고 Authorization: Bearer로 인증하세요 — x-api-key가 아닙니다. 그 헤더는 Anthropic 서피스 전용입니다.
  3. 03GET https://router.apitoken.sale/v1/models로 활성화된 모델을 확인하세요 — 통합 카탈로그는 ID를 제공자별로 구분합니다(anthropic/*, openai/*, google/*) — 그런 다음 Responses 요청을 보내세요.
curl https://router.apitoken.sale/v1/responses \
  -H "Authorization: Bearer $APITOKEN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "input": "Reply with exactly: connected"
  }'

함께 보기: GPT API 키 구매 방법

공식 OpenAI SDK 사용

공식 SDK는 그대로 동작합니다 — base_url과 키만 바뀝니다. 프로덕션에서는 키를 서버 측 환경 변수에 보관하세요.

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["APITOKEN_API_KEY"],
    base_url="https://router.apitoken.sale/v1",
)

response = client.responses.create(
    model="gpt-5.6-sol",
    input="Reply with exactly: connected",
)
print(response.output_text)

클라이언트가 필요로 한다면 같은 호스트에서 Chat Completions도 제공됩니다 — 모델 ID와 키는 동일합니다.

completion = client.chat.completions.create(
    model="gpt-5.6-sol",
    messages=[{"role": "user", "content": "Hello"}],
)
print(completion.choices[0].message.content)

사용 가능한 GPT 모델

제공되는 모델 세트는 엔진에 고정되어 가격이 매겨집니다. GET https://router.apitoken.sale/v1/models가 항상 최신 답변입니다. 현재 GPT-6 Astra, 세 가지 GPT-5.6 티어와 두 가지 이전 세대 모델을 제공합니다:

모델 ID티어공식 입력 / 출력($ / 1M)캐시 입력
gpt-6-astraGPT-6 Astra$10 / $50$1
gpt-5.6-sol(별칭: gpt-5.6)플래그십$4 / $20 (임시)$0.40
gpt-5.6-terra밸런스$2 / $12$0.20
gpt-5.6-luna고속$0.20 / $1.20$0.02
gpt-5.5이전 세대 플래그십$5 / $30$0.50
gpt-5.4이전 세대 밸런스$2.50 / $15$0.25
  • Sol의 임시 공식 input/cached/cache write/output 요금은 2026-11-21까지(당일 포함) $4/$0.40/$5/$20이며 50% 할인 후 $2/$0.20/$2.50/$10입니다. 2026-11-22 UTC부터 표준 $5 input/$30 output 요금으로 돌아갑니다.
  • 추론 강도는 요청마다 조절할 수 있습니다 — 모든 모델에서 none부터 xhigh까지, GPT-5.6 라인업은 max까지 지원합니다.
  • 모든 모델이 텍스트와 이미지 입력을 받고 Responses와 Chat Completions 모두에서 SSE로 스트리밍합니다.
  • 공식 tool_choice(none/auto/required/이름 있는 함수/hosted web_search·image_generation), false를 포함한 parallel_tool_calls, hosted web_search/image_generation이 전달됩니다. Chat Completions는 해당 hosted 도구를 같은 Responses 도구로 매핑합니다.
  • reasoning token은 output으로 청구되며, 프로모션 기간 Sol의 공식 output 요금은 100만 token당 $20입니다.
  • 272K 입력 토큰을 초과하는 요청은 OpenAI 장문 컨텍스트 요금으로 청구됩니다: 전체 요청에 입력 2배, 출력 1.5배. 프로모션 Sol에서 270K input + 2K output은 공식 $1.12이고, 273K input + 2K output은 $2.244입니다.
  • B2C 할인은 Claude 사용량과 정확히 동일하게 적용됩니다 — 하나의 잔액, 하나의 요율, 공식 사용량 대비 50% 할인.

모델별 전체 사양과 할인 가격

엔드포인트가 커버하는 범위

이것은 OpenAI Platform이 아닌 독립적인 OpenAI 호환 서비스입니다. 모델 카탈로그, 스트리밍 Responses와 Chat Completions, 해당 텍스트 라우트의 hosted web_search·image_generation뿐 아니라 GPT Image 2 전용 이미지 생성 및 편집 routes도 제공합니다. audio, files, realtime, assistants, batch, fine-tuning endpoints는 제공되지 않습니다.

  • tool_choice none/auto/required, 이름 있는 함수, hosted web_search/image_generation 전달(함수 name 누락은 400).
  • false를 포함한 parallel_tool_calls 전달; false면 native가 function_call을 직렬화합니다.
  • include:["web_search_call.action.sources"]는 완료된 search 항목에 sources를 반환합니다.
  • Responses image_generation은 output_format jpeg/webp와 partial_images 1..=3(SSE response.image_generation_call.partial_image)을 전달합니다. background=transparent는 opaque로 바꾸고 input_fidelity는 제거합니다 — 이 ChatGPT image tool에서는 해당 필드가 400입니다. 별도 GPT Image 2 /v1/images/* 라우트는 여전히 PNG 출력만 받습니다.
  • 네이티브 max_output_tokens/max_tokens는 ChatGPT 와이어에서 400입니다. 어댑터가 전달 텍스트를 로컬에서 자르고(~4자/토큰) Responses에 incomplete_details.reason=max_output_tokens를 설정합니다.

오류는 OpenAI 봉투로 반환됩니다 — {"error":{"message","type","param","code"}}. 401은 키 또는 인증 헤더 오류(Bearer 사용, x-api-key 아님), 400 documented_limitation / unsupported_parameter는 이 endpoint가 수행할 수 없는 공식 필드, 402 insufficient_quota는 공유 선불 잔액(HTTP 402, 429 아님), 404는 모델 ID 미활성화를 의미합니다 — GET https://router.apitoken.sale/v1/models를 확인하세요.

GPT-6 Astra: 최신 GPT 모델

GPT-6 Astra는 이 모델 목록의 최신 GPT 모델입니다. 100만 token당 공식 fresh input/cached input/cache write/output 요금은 $10/$1/$12.50/$50이며 B2C 50% 할인 후 $5/$0.50/$6.25/$25입니다. Codex 최대 context는 872K, 보수적 input 한도는 744K, output 한도는 128K입니다. reasoning effort는 low, medium, high, xhigh, max를 지원합니다. input이 272K를 넘으면 input/cache 요금은 2배, output은 1.5배이며 Fast는 적용 요금을 2배로 합니다. 아래 GPT-5.6 예시는 각 모델의 요금을 유지합니다.

GPT-6 Astra

자주 묻는 질문

같은 키를 GPT 외의 모델에도 쓸 수 있나요?

네. 하나의 sk-pool 키와 잔액으로 지원되는 Claude, Gemini, Kimi도 이용할 수 있습니다. 각 프로바이더에 맞는 프로토콜과 인증 헤더를 사용하세요.

OpenAI 호환 엔드포인트는 어떤 인증 헤더를 쓰나요?

Authorization: Bearer sk-pool-… 입니다. x-api-key 헤더는 Anthropic 서피스 전용입니다 — OpenAI 엔드포인트에내면 401이 반환됩니다.

Responses와 Chat Completions 중 무엇을 쓰나요?

둘 다 SSE 스트리밍으로 제공됩니다. 새 코드와 공식 SDK에는 Responses를, 클래식 형태를 기대하는 클라이언트와 프레임워크에는 Chat Completions를 사용하세요.

tool_choice, parallel_tool_calls, hosted web_search/image_generation이 동작하나요?

네. 공식 tool_choice(required·이름 있는 도구 포함), false를 포함한 parallel_tool_calls, hosted web_search/image_generation이 Responses에서 전달됩니다. Chat Completions는 해당 hosted 도구를 같은 Responses 도구로 매핑합니다. 검색 sources가 필요하면 include:["web_search_call.action.sources"]를 요청하세요. 네이티브 max_output_tokens는 ChatGPT 와이어가 거부하므로 로컬에서 잘립니다.

GPT 사용량은 어떻게 과금되나요?

캐시 입력과 장문 컨텍스트 가격을 포함한 공식 OpenAI 요금으로 토큰당 과금된 후, 50% B2C 통일 할인이 차감되어 선불 잔액에서 청구됩니다 — Claude 사용량과 정확히 같습니다.

Google 또는 GitHub로 계정을 만들고 $5 플랫폼 웰컴 보너스 크레딧으로 충전 전에 설정을 확인하세요.