Text · Moonshot AI

Kimi API

Accès API Moonshot AI Kimi via RunAPI — kimi-k3 est le modèle phare actuel avec raisonnement toujours actif ; kimi-k2.5 et kimi-k2.6 restent disponibles.

Opérationnel · 4 variants · à partir de $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent." }]
});
https://runapi.ai 5 endpoints
APERÇU

Kimi inclut kimi-k3, le modèle phare actuel avec raisonnement toujours actif, ainsi que kimi-k2.5 et kimi-k2.6. Les anciens modèles K2 utilisent une architecture Mixture-of-Experts de 1T paramètres ; kimi-k2.5 a ajouté l'entrée multimodale native et kimi-k2.6 a atteint 58,6 % sur SWE-bench Pro. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.

  • Variantes de modèle pour différents objectifs de qualité et de latence
  • API key unifiée
  • Le model skill inclut docs, schémas et notes de setup
  • Les générations échouées ne sont pas facturées
VARIANTES

Variantes

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Voir →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Voir →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Voir →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Voir →
API

Points d'accès API Kimi

Utilisez le SDK OpenAI ou Anthropic avec votre clé RunAPI. Aucun SDK supplémentaire requis.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
FONCTIONNEMENT

Construire avec ce model skill

01

Choisir le modèle

Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

02

S'authentifier une fois

Utilisez votre clé RunAPI pour tous les modèles pris en charge.

03

Installer le skill

Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

04

Recevoir la sortie

Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser Kimi

kimi-k3 est le modèle phare actuel de Kimi avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles ; leur ancienne architecture K2 a 1T paramètres et un contexte 256K, et le résultat de 58,6 % sur SWE-bench Pro appartient à kimi-k2.6. Kimi est disponible via OpenAI Chat Completions, OpenAI Responses, Anthropic Messages et Gemini native APIs. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.

Provider
Moonshot AI
Modality
Text
POURQUOI RUNAPI

Pourquoi utiliser Kimi via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

FAQ

Questions fréquentes

Par quel modèle Kimi commencer ?

Commencez par kimi-k3, le modèle phare actuel avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles pour les usages K2 existants.

Quelle est la différence entre kimi-k2.5 et kimi-k2.6 ?

Même architecture MoE 1T. kimi-k2.5 a ajouté l'entrée multimodale native (vision + texte). kimi-k2.6 est un affinage post-training avec une stabilité longue durée renforcée — SWE-bench Pro passe de 50,7 % à 58,6 %, et Agent Swarm passe de 100 à 300 sous-agents.

Quelles API peuvent appeler Kimi via RunAPI ?

Utilisez OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou les API Gemini native avec un identifiant de modèle Kimi. La première version de kimi-k3 prend en charge le texte basique avec réponses synchrones et streaming SSE.

Comment Kimi est-il facturé ?

Consultez la page du catalogue RunAPI de chaque modèle Kimi pour connaître les prix actuels.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

Les générations échouées coûtent-elles quelque chose ?

Les générations échouées ne sont pas facturées

Puis-je l'appeler depuis mon application ?

Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.

COMMENCER

Commencez à construire avec Kimi.