Text · Moonshot AI

Kimi API

Moonshot AI Kimi API-Zugang über RunAPI — kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning; kimi-k2.5 und kimi-k2.6 bleiben verfügbar.

Betriebsbereit · 4 variants · ab $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen." }]
});
https://runapi.ai 5 endpoints
ÜBERBLICK

Kimi umfasst kimi-k3, das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning, sowie kimi-k2.5 und kimi-k2.6. Die älteren K2-Modelle nutzen eine 1T-Parameter-Mixture-of-Experts-Architektur; kimi-k2.5 ergänzte native multimodale Eingabe und kimi-k2.6 erreichte 58,6 % auf SWE-bench Pro. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

  • Modellvarianten für verschiedene Qualitäts- und Latenzziele
  • Einheitlicher API Key
  • Model Skill enthält Docs, Schemas und Setup-Hinweise
  • Fehlgeschlagene Generierungen werden nicht berechnet
VARIANTEN

Varianten

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Ansehen →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Ansehen →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Ansehen →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Ansehen →
API

Kimi API-Endpunkte

Nutze das OpenAI- oder Anthropic-SDK mit deinem RunAPI-Key. Kein zusätzliches SDK nötig.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
SO FUNKTIONIERT ES

Mit diesem Model Skill bauen

01

Modell wählen

Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

02

Einmal authentifizieren

Nutze deinen RunAPI Key für jedes unterstützte Modell.

03

Skill installieren

Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

04

Ergebnis empfangen

Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo Kimi passt

kimi-k3 ist Kimis aktuelles Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben verfügbar; ihre ältere K2-Architektur hat 1T Parameter und 256K Kontext, und 58,6 % auf SWE-bench Pro gehören zu kimi-k2.6. Kimi ist über OpenAI Chat Completions, OpenAI Responses, Anthropic Messages und Gemini Native APIs verfügbar. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Provider
Moonshot AI
Modality
Text
WARUM RUNAPI

Warum Kimi über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

FAQ

Häufige Fragen

Mit welchem Kimi-Modell sollte ich beginnen?

Beginne mit kimi-k3, Kimis aktuellem Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben für bestehende K2-Anwendungsfälle verfügbar.

Was ist der Unterschied zwischen kimi-k2.5 und kimi-k2.6?

Beide sind ältere K2-Modelle mit derselben 1T-MoE-Architektur. kimi-k2.5 fügte native multimodale Eingabe hinzu; kimi-k2.6 verbesserte das Post-Training und erreichte 58,6 % auf SWE-bench Pro. kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning.

Welche APIs können Kimi über RunAPI aufrufen?

Verwende OpenAI Chat Completions, OpenAI Responses, Anthropic Messages oder Gemini Native APIs mit einer Kimi-Modell-ID. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Wie wird Kimi abgerechnet?

Aktuelle Preise finden Sie auf der RunAPI-Katalogseite des jeweiligen Kimi-Modells.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

Kosten fehlgeschlagene Generierungen Geld?

Fehlgeschlagene Generierungen werden nicht berechnet

Kann ich es aus meiner Anwendung aufrufen?

Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.

JETZT STARTEN

Mit Kimi bauen.