Text · Moonshot AI

Kimi API

Moonshot AI Kimi API-toegang via RunAPI, met kimi-k3 als huidig vlaggenschip met altijd ingeschakeld redeneren.

Operationeel · 4 variants · vanaf $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Kimi is Moonshot AI's familie van taalmodellen. kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie ondersteunt eenvoudige tekstverzoeken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar; de 1T MoE-architectuur en bijbehorende benchmarks behoren specifiek bij de oudere K2-modellen.

  • Meerdere varianten voor verschillende snelheid-/kwaliteitsniveaus
  • Modelskill bevat docs, schema's en setupnotities
  • Werkt met appgerichte codeerworkflows
  • Mislukte generaties worden niet in rekening gebracht
VARIANTS

Vergelijk alle API-varianten

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Bekijken →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Bekijken →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Bekijken →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Bekijken →
API

Kimi API-endpoints

Gebruik de OpenAI- of Anthropic-SDK met je RunAPI-sleutel. Geen extra SDK nodig.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
HOE HET WERKT

Van modelskill naar eerste resultaat in vier stappen

01

Kies het model

Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.

02

Configureren

Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.

03

Bouwen

Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.

04

Ontvangen

Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.

CONTEXT

Wat is de Kimi API?

kimi-k3 is het huidige Kimi-vlaggenschip met altijd ingeschakeld redeneren. In de eerste RunAPI-versie is het beschikbaar voor eenvoudige tekstverzoeken, synchroon of via SSE. Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met dezelfde RunAPI-sleutel; kimi-k2.5 en kimi-k2.6 blijven eveneens beschikbaar.

Provider
Moonshot AI
Modality
Text
WAAROM RUNAPI

Waarom de Kimi API via RunAPI gebruiken

Eén auth, elke provider

Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.

Uniforme prijzen & billing

Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.

Skill met schema's

Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.

FAQ

Veelgestelde vragen

Waarvoor is Kimi geoptimaliseerd?

kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie is gericht op eenvoudige teksttaken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar voor bestaande K2-gebruiksscenario's.

Wat is het verschil tussen kimi-k2.5 en kimi-k2.6?

Dezelfde 1T MoE-architectuur. kimi-k2.5 voegde native multimodale input toe, vision plus tekst. kimi-k2.6 is een post-training verfijning met sterkere stabiliteit over lange trajecten, waarbij SWE-bench Pro stijgt van 50,7% naar 58,6% en Agent Swarm schaalt van 100 naar 300 subagents.

Welke SDKs kunnen Kimi via RunAPI aanroepen?

Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met je RunAPI-sleutel en de Kimi-model-id, waaronder kimi-k3.

Hoe wordt Kimi gefactureerd?

Bekijk de RunAPI-cataloguspagina van elk Kimi-model, waaronder kimi-k3, voor actuele factureringsinformatie.

Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

Is er een gratis tier?

Nieuwe accounts krijgen de eerste calls gratis op elk model. Daarna betaal je per call.

Streamen jullie resultaten?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Hoe worden mislukkingen gefactureerd?

Mislukte generations worden niet in rekening gebracht.

Worden outputs gecachet?

Gegenereerde outputs worden opgeslagen en zijn op te vragen via task-ID. Inputs worden niet gecachet.

Mag ik het commercieel gebruiken?

Ja — commercieel gebruik is inbegrepen voor elke variant, tenzij een modellicentie het expliciet beperkt. Dat staat aangegeven op de variantpagina.

Hoe zit het met rate limits?

Rate limits per key schalen mee met je usage tier. Zie de prijzenpagina voor de actuele limieten.

Waar kan ik problemen melden?

Open een issue in de publieke GitHub-repo of mail support.

VERGELIJKBARE MODELLEN

Als je de Kimi API goed vindt, probeer deze dan eens

NU BEGINNEN

Begin met bouwen met de Kimi API.