Kimi API
Moonshot AI Kimi API-Zugang über RunAPI — kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning; kimi-k2.5 und kimi-k2.6 bleiben verfügbar.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen." }]
});
Kimi umfasst kimi-k3, das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning, sowie kimi-k2.5 und kimi-k2.6. Die älteren K2-Modelle nutzen eine 1T-Parameter-Mixture-of-Experts-Architektur; kimi-k2.5 ergänzte native multimodale Eingabe und kimi-k2.6 erreichte 58,6 % auf SWE-bench Pro. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
- Modellvarianten für verschiedene Qualitäts- und Latenzziele
- Einheitlicher API Key
- Model Skill enthält Docs, Schemas und Setup-Hinweise
- Fehlgeschlagene Generierungen werden nicht berechnet
Varianten
| Variant | Billing | Pricing | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | Ansehen → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | Ansehen → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | Ansehen → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | Ansehen → |
Kimi API-Endpunkte
Nutze das OpenAI- oder Anthropic-SDK mit deinem RunAPI-Key. Kein zusätzliches SDK nötig.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
Mit diesem Model Skill bauen
Modell wählen
Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.
Einmal authentifizieren
Nutze deinen RunAPI Key für jedes unterstützte Modell.
Skill installieren
Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.
Ergebnis empfangen
Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.
Wo Kimi passt
kimi-k3 ist Kimis aktuelles Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben verfügbar; ihre ältere K2-Architektur hat 1T Parameter und 256K Kontext, und 58,6 % auf SWE-bench Pro gehören zu kimi-k2.6. Kimi ist über OpenAI Chat Completions, OpenAI Responses, Anthropic Messages und Gemini Native APIs verfügbar. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
Warum Kimi über RunAPI nutzen
Ein API Key
Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.
Skill-ready
Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.
Planbare Abrechnung
Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.
Häufige Fragen
Mit welchem Kimi-Modell sollte ich beginnen?
Beginne mit kimi-k3, Kimis aktuellem Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben für bestehende K2-Anwendungsfälle verfügbar.
Was ist der Unterschied zwischen kimi-k2.5 und kimi-k2.6?
Beide sind ältere K2-Modelle mit derselben 1T-MoE-Architektur. kimi-k2.5 fügte native multimodale Eingabe hinzu; kimi-k2.6 verbesserte das Post-Training und erreichte 58,6 % auf SWE-bench Pro. kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning.
Welche APIs können Kimi über RunAPI aufrufen?
Verwende OpenAI Chat Completions, OpenAI Responses, Anthropic Messages oder Gemini Native APIs mit einer Kimi-Modell-ID. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.
Wie wird Kimi abgerechnet?
Aktuelle Preise finden Sie auf der RunAPI-Katalogseite des jeweiligen Kimi-Modells.
Wie rufe ich dieses Modell auf?
Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.
Kosten fehlgeschlagene Generierungen Geld?
Fehlgeschlagene Generierungen werden nicht berechnet
Kann ich es aus meiner Anwendung aufrufen?
Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.