Eén auth, elke provider
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Gebruik de Kimi API via RunAPI met een modelskill, uniforme auth en pay-as-you-go prijzen.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Plan en implementeer een kleine CLI-tool, scaffold het project, schrijf de commands, voeg tests toe en voer ze uit tot ze slagen." }]
});
Kimi is Moonshot AI's familie van taalmodellen. kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie ondersteunt eenvoudige tekstverzoeken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar; de 1T MoE-architectuur en bijbehorende benchmarks behoren specifiek bij de oudere K2-modellen.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variant | Facturering | Prijzen | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Invoer $0.60 / 1M tokens | Uitvoer $3.00 / 1M tokens | Bekijken → |
| kimi-k2.6 | 1K tokens | Invoer $0.95 / 1M tokens | Uitvoer $4.00 / 1M tokens | Bekijken → |
| kimi-k2.7-code | 1K tokens | Invoer $0.57 / 1M tokens | Uitvoer $2.40 / 1M tokens | Bekijken → |
| kimi-k3 | 1K tokens | Invoer $3.00 / 1M tokens | Uitvoer $15.00 / 1M tokens | Bekijken → |
| Endpoint | Resolutie | Duur | Prijs | |
|---|---|---|---|---|
| chat_completion | — | — | Invoer $0.60 / 1M tokens | Uitvoer $3.00 / 1M tokens |
Prijzen getoond voor kimi-k2.5. Andere varianten behouden hun eigen endpoint-prijzen.
Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.
Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.
Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.
Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.
kimi-k3 is het huidige Kimi-vlaggenschip met altijd ingeschakeld redeneren. In de eerste RunAPI-versie is het beschikbaar voor eenvoudige tekstverzoeken, synchroon of via SSE. Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met dezelfde RunAPI-sleutel; kimi-k2.5 en kimi-k2.6 blijven eveneens beschikbaar.
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.
Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.
kimi-k3 is het huidige vlaggenschip en redeneert altijd. De eerste RunAPI-versie is gericht op eenvoudige teksttaken, synchroon of via SSE. kimi-k2.5 en kimi-k2.6 blijven beschikbaar voor bestaande K2-gebruiksscenario's.
Dezelfde 1T MoE-architectuur. kimi-k2.5 voegde native multimodale input toe, vision plus tekst. kimi-k2.6 is een post-training verfijning met sterkere stabiliteit over lange trajecten, waarbij SWE-bench Pro stijgt van 50,7% naar 58,6% en Agent Swarm schaalt van 100 naar 300 subagents.
Gebruik OpenAI Chat Completions, OpenAI Responses, Anthropic Messages of Gemini native met je RunAPI-sleutel en de Kimi-model-id, waaronder kimi-k3.
Bekijk de RunAPI-cataloguspagina van elk Kimi-model, waaronder kimi-k3, voor actuele factureringsinformatie.
Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.
Een account en API-sleutel aanmaken is gratis. API-aanroepen worden naar gebruik van je vooraf betaalde saldo afgeschreven; voeg saldo toe voordat je verzoeken verstuurt.