Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Utilisez l'API Kimi via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent." }]
});
Kimi inclut kimi-k3, le modèle phare actuel avec raisonnement toujours actif, ainsi que kimi-k2.5 et kimi-k2.6. Les anciens modèles K2 utilisent une architecture Mixture-of-Experts de 1T paramètres ; kimi-k2.5 a ajouté l'entrée multimodale native et kimi-k2.6 a atteint 58,6 % sur SWE-bench Pro. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Facturation | Tarifs | |
|---|---|---|---|
| kimi-k2.5 | 1 000 jetons | Entrée $0.60 / 1M de tokens | Sortie $3.00 / 1M de tokens | Voir → |
| kimi-k2.6 | 1 000 jetons | Entrée $0.95 / 1M de tokens | Sortie $4.00 / 1M de tokens | Voir → |
| kimi-k2.7-code | 1 000 jetons | Entrée $0.57 / 1M de tokens | Sortie $2.40 / 1M de tokens | Voir → |
| kimi-k3 | 1 000 jetons | Entrée $3.00 / 1M de tokens | Sortie $15.00 / 1M de tokens | Voir → |
| Endpoint | Résolution | Durée | Prix | |
|---|---|---|---|---|
| chat_completion | — | — | Entrée $0.60 / 1M de tokens | Sortie $3.00 / 1M de tokens |
Prix affichés pour kimi-k2.5. Les autres variantes conservent leurs propres tarifs par endpoint.
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Interrogez par task ID ou traitez le callback quand la génération se termine.
kimi-k3 est le modèle phare actuel de Kimi avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles ; leur ancienne architecture K2 a 1T paramètres et un contexte 256K, et le résultat de 58,6 % sur SWE-bench Pro appartient à kimi-k2.6. Kimi est disponible via OpenAI Chat Completions, OpenAI Responses, Anthropic Messages et Gemini native APIs. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Les tarifs à l'usage sont visibles avant l'appel.
Commencez par kimi-k3, le modèle phare actuel avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles pour les usages K2 existants.
Même architecture MoE 1T. kimi-k2.5 a ajouté l'entrée multimodale native (vision + texte). kimi-k2.6 est un affinage post-training avec une stabilité longue durée renforcée — SWE-bench Pro passe de 50,7 % à 58,6 %, et Agent Swarm passe de 100 à 300 sous-agents.
Utilisez OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou les API Gemini native avec un identifiant de modèle Kimi. La première version de kimi-k3 prend en charge le texte basique avec réponses synchrones et streaming SSE.
Consultez la page du catalogue RunAPI de chaque modèle Kimi pour connaître les prix actuels.
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.
Les générations échouées ne sont pas facturées