하나의 API key
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
It looks like you may prefer a different language. Switch anytime.
RunAPI를 통해 모델 스킬, 통합 인증, 종량제 요금으로 Kimi API를 사용하세요.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요." }]
});
Kimi 시리즈의 현재 플래그십은 kimi-k3이며 추론이 항상 활성화됩니다. RunAPI의 첫 제공은 kimi-k3의 기본 텍스트 동기식 및 SSE이고, kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE 아키텍처이며 K2.6은 SWE-bench Pro 58.6%를 기록합니다.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| 변형 | 과금 | 요금 | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | 보기 → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | 보기 → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | 보기 → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 보기 → |
| endpoint | 해상도 | 길이 | 가격 | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens |
kimi-k2.5 기준 요금입니다. 다른 변형은 각자의 endpoint 요금이 적용됩니다.
출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.
모든 지원 모델에 RunAPI key를 사용합니다.
기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.
task ID로 조회하거나 생성 완료 시 callback을 처리합니다.
kimi-k3는 Kimi의 현재 플래그십으로 추론이 항상 활성화되며, 첫 제공은 기본 텍스트 동기식 및 SSE로 한정됩니다. kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. 256K 컨텍스트, 네이티브 멀티모달 입력, SWE-bench Pro 등은 해당 K2 버전에만 적용됩니다. OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스로 호출할 수 있습니다.
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.
호출 전에 사용량 기반 가격을 확인할 수 있습니다.
kimi-k3입니다. 추론이 항상 활성화되며 RunAPI의 첫 제공은 기본 텍스트 동기식 및 SSE입니다.
둘 다 K2 아키텍처입니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE입니다. kimi-k2.5는 256K 컨텍스트와 네이티브 멀티모달 입력을 제공하고, kimi-k2.6은 SWE-bench Pro 58.6%를 기록합니다. 이 K2 정보는 kimi-k3에 적용되지 않습니다.
OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스를 사용하고 선택한 Kimi 모델 ID를 전달하세요.
각 Kimi 모델의 현재 가격은 RunAPI catalog의 해당 모델 페이지에서 확인하세요.
model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.
실패한 생성은 과금되지 않습니다