Text · Moonshot AI

Kimi API

RunAPI를 통한 Moonshot AI Kimi API 액세스. 현재 플래그십 kimi-k3는 추론이 항상 활성화되며, 첫 제공은 기본 텍스트 동기식 및 SSE입니다.

운영 중 · 4 variants · 최저 $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "작은 CLI 도구를 계획하고 구현하세요. 프로젝트를 스캐폴드하고, 명령을 작성하고, 테스트를 추가한 뒤 통과할 때까지 실행하세요." }]
});
https://runapi.ai 5 endpoints
개요

Kimi 시리즈의 현재 플래그십은 kimi-k3이며 추론이 항상 활성화됩니다. RunAPI의 첫 제공은 kimi-k3의 기본 텍스트 동기식 및 SSE이고, kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE 아키텍처이며 K2.6은 SWE-bench Pro 58.6%를 기록합니다.

  • 품질과 지연 시간 목표에 맞춘 모델 변형
  • 통합 API key
  • Model skill에 docs, schema, 설정 메모 포함
  • 실패한 생성은 과금되지 않습니다
변형

변형

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens 보기 →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens 보기 →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens 보기 →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens 보기 →
API

Kimi API 엔드포인트

RunAPI 키로 OpenAI 또는 Anthropic SDK를 사용하세요. 추가 SDK가 필요 없습니다.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
작동 방식

이 model skill로 구현하는 방법

01

모델 선택

출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.

02

한 번 인증

모든 지원 모델에 RunAPI key를 사용합니다.

03

skill 설치

기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.

04

결과 받기

task ID로 조회하거나 생성 완료 시 callback을 처리합니다.

컨텍스트

Kimi의 위치

kimi-k3는 Kimi의 현재 플래그십으로 추론이 항상 활성화되며, 첫 제공은 기본 텍스트 동기식 및 SSE로 한정됩니다. kimi-k2.5와 kimi-k2.6도 계속 사용할 수 있습니다. 256K 컨텍스트, 네이티브 멀티모달 입력, SWE-bench Pro 등은 해당 K2 버전에만 적용됩니다. OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스로 호출할 수 있습니다.

Provider
Moonshot AI
Modality
Text
RUNAPI를 선택하는 이유

RunAPI로 Kimi을 쓰는 이유

하나의 API key

모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.

Skill-ready

model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.

예측 가능한 과금

호출 전에 사용량 기반 가격을 확인할 수 있습니다.

FAQ

자주 묻는 질문

현재 Kimi 플래그십은 무엇인가요?

kimi-k3입니다. 추론이 항상 활성화되며 RunAPI의 첫 제공은 기본 텍스트 동기식 및 SSE입니다.

kimi-k2.5와 kimi-k2.6의 차이점은 무엇인가요?

둘 다 K2 아키텍처입니다. K2는 총 1조 파라미터, 토큰당 32B 활성 파라미터, 레이어당 384개 전문가의 MoE입니다. kimi-k2.5는 256K 컨텍스트와 네이티브 멀티모달 입력을 제공하고, kimi-k2.6은 SWE-bench Pro 58.6%를 기록합니다. 이 K2 정보는 kimi-k3에 적용되지 않습니다.

어떤 SDK로 RunAPI에서 Kimi를 호출할 수 있나요?

OpenAI Chat Completions, OpenAI Responses, Anthropic Messages, Gemini native 인터페이스를 사용하고 선택한 Kimi 모델 ID를 전달하세요.

Kimi는 어떻게 과금되나요?

각 Kimi 모델의 현재 가격은 RunAPI catalog의 해당 모델 페이지에서 확인하세요.

이 모델은 어떻게 호출하나요?

model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.

실패한 생성도 비용이 드나요?

실패한 생성은 과금되지 않습니다

애플리케이션에서 호출할 수 있나요?

네. 코딩 워크스페이스에 model skill을 설치하고 모델 기능을 추가할 때 사용하세요.

지금 시작

Kimi로 개발을 시작하세요.