LLM API

LLM API — OpenAI 호환

OpenAI 호환 endpoint 하나로 Claude, GPT, Gemini, DeepSeek, Grok에 액세스하세요. /v1/chat/completions, /v1/messages, /v1/responses 지원.

67개 모델 base_url만 바꾸면 바로 사용 토큰당 요금

67
LLM 모델
15-25%
공식보다 저렴
2줄
마이그레이션하려면

플레이그라운드

실시간
모델
메시지
Refactor this handler to stream partial results and return a typed error on timeout.
최대 토큰 수
integer | null
온도
number | null
스트림
false
Endpoint
/v1/chat/completions
예상 비용
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
예시

멀티 모델 비교

프롬프트 양자 컴퓨팅을 한 문장으로 설명하세요

Claude/claude-fable-5

/v1/messages를 통해 Claude/claude-fable-5을 호출합니다.
동일한 RunAPI 키와 요청 형식을 유지하면서 출력 결과를 비교하세요.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

/v1/messages를 통해 Claude/claude-fable-5-1을 호출합니다.
동일한 RunAPI 키와 요청 형식을 유지하면서 출력 결과를 비교하세요.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

/v1/messages를 통해 Claude/claude-haiku-4-5-20251001을 호출합니다.
동일한 RunAPI 키와 요청 형식을 유지하면서 출력 결과를 비교하세요.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

endpoint 형식 4개, 키 하나

Chat completion

모든 SDK가 지원하는 OpenAI 형식. base_url만 바꾸고 기존 요청 코드를 그대로 사용하세요.

Message

시스템 프롬프트, 도구 사용, 구조화된 콘텐츠 블록을 위한 Messages API 형식.

Response

서버 측 대화 처리를 통한 멀티 턴 에이전트 루프를 위한 상태 저장 형식.

Embedding

검색을 위한 벡터 임베딩. 동일한 RunAPI 키로 토큰당 요금이 부과됩니다.

키 하나로 모든 LLM

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

LLM 모델 전체 67개 보기
빠른 시작

OpenAI 형식으로 모든 모델 호출

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
작동 방식

첫 생성을 위한 네 단계

  1. API 키 받기

    RunAPI 계정용 키 하나를 만듭니다.

  2. OpenAI 형식 사용

    문서화된 OpenAI 호환 엔드포인트로 요청을 보냅니다.

  3. 스마트 라우팅

    RunAPI가 요청에 맞는 지원 경로를 선택합니다.

  4. 응답 스트리밍

    선택한 엔드포인트가 SSE를 지원하면 스트리밍 출력을 받습니다.

개발자들이 RunAPI를 선택하는 이유

하나의 키, 모든 모델

API 키 관리에서 해방되세요. 하나의 통합으로 모든 제공업체의 230+개 모델에 액세스할 수 있습니다.

15~25% 비용 절감

공급자와의 대량 계약으로 직접 이용 시보다 낮은 가격을 제공합니다. 추가 마진 없음.

자동 장애 조치

공급자 장애 시 차선의 옵션으로 자동 라우팅합니다. 서비스 중단 없이 앱을 유지하세요.

OpenAI 호환

OpenAI SDK의 드롭인 대체재. 코드 한 줄만 바꿔 모든 모델에 액세스하세요.

실시간 청구

사용한 만큼만 요금을 지불하세요. 최소 금액 없이 요청당 요금제. 모델별, 프로젝트별 비용을 추적하세요.

데이터 보호

개인정보 처리방침에서 요청 데이터와 생성된 콘텐츠의 처리 및 보관 방법을 확인할 수 있습니다.

팀에서 활용하는 방법

코딩 에이전트

계획은 Opus에, 편집은 저렴한 모델에 라우팅하되, 키 하나와 청구서 하나로 관리하세요.

RAG 파이프라인

동일한 endpoint에서 임베딩과 생성을 처리하여 검색과 응답이 예산을 공유합니다.

콘텐츠 생성

여러 모델에 초안을 분산 생성하고 최선의 결과를 채택하세요. 공급자 계약 다섯 개 필요 없이.

멀티 모델 비교

문자열 하나만 바꿔 Claude, GPT, Gemini에 동일한 프롬프트를 A/B 테스트하세요.

RunAPI vs 대안 서비스

기능 RunAPI OpenRouter 직접 API
LLM 모델 66 300+ 공급자 1개
기타 모달리티 비디오, 이미지, 음악, 오디오 아니오 제공업체별
요금제 공식가 대비 15~25% 저렴 시장 요금 공식 요금
네이티브 Messages API 아니오
통합 크레딧 아니오
MCP server + CLI 아니오 아니오

LLM API 자주 묻는 질문

OpenAI 호환 클라이언트에서 어떻게 마이그레이션하나요?

클라이언트가 RunAPI 기본 URL을 가리키도록 설정하고 RunAPI 키를 사용하세요. 선택한 endpoint가 지원하는 요청 형식을 유지하세요.

스트리밍을 지원하나요?

선택한 모델과 endpoint가 스트리밍 응답을 제공하는 경우 스트리밍을 사용할 수 있습니다.

도구 호출이 작동하나요?

도구 호출은 런타임 계약에서 도구 지원을 선언한 모델 및 endpoint 형식에서 사용할 수 있습니다.

토큰은 어떻게 청구되나요?

입력 및 출력 요금은 모델 카탈로그에 표시됩니다. 요청에 대해 보고된 토큰 수를 기준으로 사용량이 청구됩니다.

어떤 endpoint를 사용해야 하나요?

기존 클라이언트와 요청에 필요한 기능에 맞는 endpoint 형식을 선택하세요.

라우트를 사용할 수 없는 경우 어떻게 되나요?

API는 문서화된 응답 계약을 통해 요청 상태를 반환하므로 애플리케이션이 재시도하거나 지원되는 다른 모델을 선택할 수 있습니다.

두 줄만 바꾸면 기존 코드 그대로

이미 사용 중인 OpenAI 형식으로 67개 모델 지원. 신용카드 없이 무료로 시작하세요.