Text Moonshot AI

Kimi API

Nutze die Kimi API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen." }]
});
https://runapi.ai 5 endpoints
ÜBERBLICK

Über Kimi

Kimi umfasst kimi-k3, das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning, sowie kimi-k2.5 und kimi-k2.6. Die älteren K2-Modelle nutzen eine 1T-Parameter-Mixture-of-Experts-Architektur; kimi-k2.5 ergänzte native multimodale Eingabe und kimi-k2.6 erreichte 58,6 % auf SWE-bench Pro. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Anbieter
Moonshot AI
Modalität
Text

Kimi API-Endpunkte

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Varianten

Variante Abrechnung Preise
kimi-k2.5 1K-Token Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens Ansehen →
kimi-k2.6 1K-Token Eingabe $0.95 / 1 Mio. Tokens | Ausgabe $4.00 / 1 Mio. Tokens Ansehen →
kimi-k2.7-code 1K-Token Eingabe $0.57 / 1 Mio. Tokens | Ausgabe $2.40 / 1 Mio. Tokens Ansehen →
kimi-k3 1K-Token Eingabe $3.00 / 1 Mio. Tokens | Ausgabe $15.00 / 1 Mio. Tokens Ansehen →
PREISE

Kimi-Preise

Endpoint Auflösung Dauer Preis
chat_completion — — Eingabe $0.60 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens

Preise für kimi-k2.5 angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.

Agent-Integration

Kimi mit einem Agenten ausführen

SO FUNKTIONIERT ES

Mit Kimi starten

  1. Modell wählen

    Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

  2. Einmal authentifizieren

    Nutze deinen RunAPI Key für jedes unterstützte Modell.

  3. Skill installieren

    Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

  4. Ergebnis empfangen

    Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo Kimi passt

kimi-k3 ist Kimis aktuelles Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben verfügbar; ihre ältere K2-Architektur hat 1T Parameter und 256K Kontext, und 58,6 % auf SWE-bench Pro gehören zu kimi-k2.6. Kimi ist über OpenAI Chat Completions, OpenAI Responses, Anthropic Messages und Gemini Native APIs verfügbar. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Anbieter
Moonshot AI
Alle ansehen →
Modalität
Text
Modelle durchsuchen →

Warum Kimi über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

Kimi-Fragen

Mit welchem Kimi-Modell sollte ich beginnen?

Beginne mit kimi-k3, Kimis aktuellem Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben für bestehende K2-Anwendungsfälle verfügbar.

Was ist der Unterschied zwischen kimi-k2.5 und kimi-k2.6?

Beide sind ältere K2-Modelle mit derselben 1T-MoE-Architektur. kimi-k2.5 fügte native multimodale Eingabe hinzu; kimi-k2.6 verbesserte das Post-Training und erreichte 58,6 % auf SWE-bench Pro. kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning.

Welche APIs können Kimi über RunAPI aufrufen?

Verwende OpenAI Chat Completions, OpenAI Responses, Anthropic Messages oder Gemini Native APIs mit einer Kimi-Modell-ID. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Wie wird Kimi abgerechnet?

Aktuelle Preise finden Sie auf der RunAPI-Katalogseite des jeweiligen Kimi-Modells.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

Kosten fehlgeschlagene Generierungen Geld?

Fehlgeschlagene Generierungen werden nicht berechnet

ÄHNLICHE MODELLE

Ähnliche Modelle wie Kimi

Mit Kimi bauen.