Ein API Key
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Nutze die Kimi API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen." }]
});
Kimi umfasst kimi-k3, das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning, sowie kimi-k2.5 und kimi-k2.6. Die älteren K2-Modelle nutzen eine 1T-Parameter-Mixture-of-Experts-Architektur; kimi-k2.5 ergänzte native multimodale Eingabe und kimi-k2.6 erreichte 58,6 % auf SWE-bench Pro. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Abrechnung | Preise | |
|---|---|---|---|
| kimi-k2.5 | 1K-Token | Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens | Ansehen → |
| kimi-k2.6 | 1K-Token | Eingabe $0.95 / 1 Mio. Tokens | Ausgabe $4.00 / 1 Mio. Tokens | Ansehen → |
| kimi-k2.7-code | 1K-Token | Eingabe $0.57 / 1 Mio. Tokens | Ausgabe $2.40 / 1 Mio. Tokens | Ansehen → |
| kimi-k3 | 1K-Token | Eingabe $3.00 / 1 Mio. Tokens | Ausgabe $15.00 / 1 Mio. Tokens | Ansehen → |
| Endpoint | Auflösung | Dauer | Preis | |
|---|---|---|---|---|
| chat_completion | — | — | Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens |
Preise für kimi-k2.5 angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.
Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.
Nutze deinen RunAPI Key für jedes unterstützte Modell.
Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.
Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.
kimi-k3 ist Kimis aktuelles Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben verfügbar; ihre ältere K2-Architektur hat 1T Parameter und 256K Kontext, und 58,6 % auf SWE-bench Pro gehören zu kimi-k2.6. Kimi ist über OpenAI Chat Completions, OpenAI Responses, Anthropic Messages und Gemini Native APIs verfügbar. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.
Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.
Beginne mit kimi-k3, Kimis aktuellem Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben für bestehende K2-Anwendungsfälle verfügbar.
Beide sind ältere K2-Modelle mit derselben 1T-MoE-Architektur. kimi-k2.5 fügte native multimodale Eingabe hinzu; kimi-k2.6 verbesserte das Post-Training und erreichte 58,6 % auf SWE-bench Pro. kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning.
Verwende OpenAI Chat Completions, OpenAI Responses, Anthropic Messages oder Gemini Native APIs mit einer Kimi-Modell-ID. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
Aktuelle Preise finden Sie auf der RunAPI-Katalogseite des jeweiligen Kimi-Modells.
Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.
Fehlgeschlagene Generierungen werden nicht berechnet