본문으로 건너뛰기
가이드
가이드

빠른 시작

지원되는 동기 또는 스트리밍 프로토콜을 통해 RunAPI 언어 모델을 호출합니다.

RunAPI는 친숙한 공개 프로토콜 형태를 통해 언어 모델을 노출합니다. 기존의 호환 가능한 클라이언트를 https://runapi.ai로 지정하고 RunAPI 모델 식별자를 사용하며 표준 API 키로 인증하세요.

프로토콜 선택

  • OpenAI 호환 Chat Completions는 POST /v1/chat/completions를 사용합니다.
  • OpenAI 호환 Responses는 POST /v1/responses를 사용합니다.
  • Anthropic 호환 Messages는 POST /v1/messages를 사용합니다.
  • Gemini 호환 콘텐츠 생성은 /v1beta/models/{model}:generateContent 또는 :streamGenerateContent를 사용합니다.

기존 클라이언트 및 애플리케이션 흐름에 가장 적합한 프로토콜을 선택하십시오. 모델 카탈로그는 각 모델이 지원하는 공개 프로토콜을 식별합니다.

요청 전송

이 Chat Completions 요청은 하나의 동기 응답을 반환합니다:

SHELL
curl "https://runapi.ai/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.4",
    "messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
  }'

요청과 응답을 선택한 프로토콜 형식으로 유지하세요. 정확한 필드, 도구 호출, 구조화된 출력 및 모델별 제약 조건에 대해서는 작업의 API 참조를 사용하세요.

스트림 출력

프로토콜의 스트리밍 옵션을 설정하고 반환된 서버 전송 이벤트를 증분 방식으로 소비하세요. Chat Completions의 경우 "stream": true를 추가하고, Gemini 호환 호출의 경우 :streamGenerateContent 작업을 사용하세요. 클라이언트가 프로토콜의 종료 이벤트를 수신하면 스트림을 닫으세요.

전송 정확도 검사

모든 허용된 LLM 응답에는 X-RunAPI-Fidelity가 포함됩니다. 값이 full이면 요청이 누락 없이 전달되었음을 의미합니다. 값이 lossy이면 RunAPI가 요청을 완료하기 위해 선택적 제어를 생략했음을 의미하며, X-RunAPI-Omitted-Fields에 쉼표로 구분된 필드 이름이 포함됩니다. 필수 라이프사이클, 연속, 도구, 또는 타입된 항목 의미론을 보존할 수 없는 요청은 Task 생성 전에 거부됩니다.

두 헤더 모두 CORS를 통해 노출되므로 브라우저 클라이언트에서 검사할 수 있습니다. 정확한 전달 동작이 애플리케이션에 중요한 경우 요청 식별자와 함께 로깅하십시오.

오류 및 사용량 처리

401은 인증 실패로, 4xx 응답은 요청 또는 정책 문제로 처리하고, 일시적인 서버 또는 네트워크 오류만 재시도하세요. 선택한 프로토콜 형식의 최종 응답 또는 터미널 스트림 이벤트에서 토큰 사용량을 읽고, 지원을 위해 애플리케이션 로그에 요청 식별자를 보관하세요.