Tekst Moonshot AI

Kimi API

Gebruik de Kimi API via RunAPI met een modelskill, uniforme auth en pay-as-you-go prijzen.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Over Kimi

Kimi is Moonshot AI's familie van taalmodellen. kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie ondersteunt eenvoudige tekstverzoeken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar; de 1T MoE-architectuur en bijbehorende benchmarks behoren specifiek bij de oudere K2-modellen.

Provider
Moonshot AI
Modaliteit
Tekst

Kimi API-endpoints

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Vergelijk alle API-varianten

Variant Facturering Prijzen
kimi-k2.5 1K tokens Invoer $0.60 / 1M tokens | Uitvoer $3.00 / 1M tokens Bekijken →
kimi-k2.6 1K tokens Invoer $0.95 / 1M tokens | Uitvoer $4.00 / 1M tokens Bekijken →
kimi-k2.7-code 1K tokens Invoer $0.57 / 1M tokens | Uitvoer $2.40 / 1M tokens Bekijken →
kimi-k3 1K tokens Invoer $3.00 / 1M tokens | Uitvoer $15.00 / 1M tokens Bekijken →
PRICING

Kimi-prijzen

Endpoint Resolutie Duur Prijs
chat_completion — — Invoer $0.60 / 1M tokens | Uitvoer $3.00 / 1M tokens

Prijzen getoond voor kimi-k2.5. Andere varianten behouden hun eigen endpoint-prijzen.

Agentintegratie

Gebruik Kimi vanuit een agent

HOE HET WERKT

Aan de slag met Kimi

  1. Kies het model

    Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.

  2. Configureren

    Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.

  3. Bouwen

    Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.

  4. Ontvangen

    Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.

CONTEXT

Wat is de Kimi API?

kimi-k3 is het huidige Kimi-vlaggenschip met altijd ingeschakeld redeneren. In de eerste RunAPI-versie is het beschikbaar voor eenvoudige tekstverzoeken, synchroon of via SSE. Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met dezelfde RunAPI-sleutel; kimi-k2.5 en kimi-k2.6 blijven eveneens beschikbaar.

Provider
Moonshot AI
Alles bekijken →
Modaliteit
Tekst
Modellen bekijken →

Waarom de Kimi API via RunAPI gebruiken

Eén auth, elke provider

Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.

Uniforme prijzen & billing

Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.

Skill met schema's

Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.

Vragen over Kimi

Waarvoor is Kimi geoptimaliseerd?

kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie is gericht op eenvoudige teksttaken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar voor bestaande K2-gebruiksscenario's.

Wat is het verschil tussen kimi-k2.5 en kimi-k2.6?

Dezelfde 1T MoE-architectuur. kimi-k2.5 voegde native multimodale input toe, vision plus tekst. kimi-k2.6 is een post-training verfijning met sterkere stabiliteit over lange trajecten, waarbij SWE-bench Pro stijgt van 50,7% naar 58,6% en Agent Swarm schaalt van 100 naar 300 subagents.

Welke SDKs kunnen Kimi via RunAPI aanroepen?

Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met je RunAPI-sleutel en de Kimi-model-id, waaronder kimi-k3.

Hoe wordt Kimi gefactureerd?

Bekijk de RunAPI-cataloguspagina van elk Kimi-model, waaronder kimi-k3, voor actuele factureringsinformatie.

Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

Is er een gratis tier?

Een account en API-sleutel aanmaken is gratis. API-aanroepen worden naar gebruik van je vooraf betaalde saldo afgeschreven; voeg saldo toe voordat je verzoeken verstuurt.

VERGELIJKBARE MODELLEN

Als je de Kimi API goed vindt, probeer deze dan eens

Begin met bouwen met de Kimi API.