Kimi API
RunAPI를 통한 Moonshot AI Kimi API 액세스. 현재 플래그십 kimi-k3는 추론이 항상 활성화되며, 첫 제공은 기본 텍스트 동기식 및 SSE입니다.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요." }]
});
Kimi 시리즈의 현재 플래그십은 kimi-k3이며 추론이 항상 활성화됩니다. RunAPI의 첫 제공은 kimi-k3의 기본 텍스트 동기식 및 SSE이고, kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE 아키텍처이며 K2.6은 SWE-bench Pro 58.6%를 기록합니다.
- 품질과 지연 시간 목표에 맞춘 모델 변형
- 통합 API key
- Model skill에 docs, schema, 설정 메모 포함
- 실패한 생성은 과금되지 않습니다
변형
| Variant | Billing | Pricing | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | 보기 → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | 보기 → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | 보기 → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 보기 → |
Kimi API 엔드포인트
RunAPI 키로 OpenAI 또는 Anthropic SDK를 사용하세요. 추가 SDK가 필요 없습니다.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
이 model skill로 구현하는 방법
모델 선택
출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.
한 번 인증
모든 지원 모델에 RunAPI key를 사용합니다.
skill 설치
기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.
결과 받기
task ID로 조회하거나 생성 완료 시 callback을 처리합니다.
Kimi의 위치
kimi-k3는 Kimi의 현재 플래그십으로 추론이 항상 활성화되며, 첫 제공은 기본 텍스트 동기식 및 SSE로 한정됩니다. kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. 256K 컨텍스트, 네이티브 멀티모달 입력, SWE-bench Pro 등은 해당 K2 버전에만 적용됩니다. OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스로 호출할 수 있습니다.
RunAPI로 Kimi을 쓰는 이유
하나의 API key
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
Skill-ready
model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.
예측 가능한 과금
호출 전에 사용량 기반 가격을 확인할 수 있습니다.
자주 묻는 질문
현재 Kimi 플래그십은 무엇인가요?
kimi-k3입니다. 추론이 항상 활성화되며 RunAPI의 첫 제공은 기본 텍스트 동기식 및 SSE입니다.
kimi-k2.5와 kimi-k2.6의 차이점은 무엇인가요?
둘 다 K2 아키텍처입니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE입니다. kimi-k2.5는 256K 컨텍스트와 네이티브 멀티모달 입력을 제공하고, kimi-k2.6은 SWE-bench Pro 58.6%를 기록합니다. 이 K2 정보는 kimi-k3에 적용되지 않습니다.
어떤 SDK로 RunAPI에서 Kimi를 호출할 수 있나요?
OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스를 사용하고 선택한 Kimi 모델 ID를 전달하세요.
Kimi는 어떻게 과금되나요?
각 Kimi 모델의 현재 가격은 RunAPI catalog의 해당 모델 페이지에서 확인하세요.
이 모델은 어떻게 호출하나요?
model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.
실패한 생성도 비용이 드나요?
실패한 생성은 과금되지 않습니다
애플리케이션에서 호출할 수 있나요?
네. 코딩 워크스페이스에 model skill을 설치하고 모델 기능을 추가할 때 사용하세요.