Texte Moonshot AI

Kimi API

Utilisez l'API Kimi via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent." }]
});
https://runapi.ai 5 endpoints
APERÇU

À propos de Kimi

Kimi inclut kimi-k3, le modèle phare actuel avec raisonnement toujours actif, ainsi que kimi-k2.5 et kimi-k2.6. Les anciens modèles K2 utilisent une architecture Mixture-of-Experts de 1T paramètres ; kimi-k2.5 a ajouté l'entrée multimodale native et kimi-k2.6 a atteint 58,6 % sur SWE-bench Pro. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.

Fournisseur
Moonshot AI
Modalité
Texte

Points d'accès API Kimi

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Variantes

Variante Facturation Tarifs
kimi-k2.5 1 000 jetons Entrée $0.60 / 1M de tokens | Sortie $3.00 / 1M de tokens Voir →
kimi-k2.6 1 000 jetons Entrée $0.95 / 1M de tokens | Sortie $4.00 / 1M de tokens Voir →
kimi-k2.7-code 1 000 jetons Entrée $0.57 / 1M de tokens | Sortie $2.40 / 1M de tokens Voir →
kimi-k3 1 000 jetons Entrée $3.00 / 1M de tokens | Sortie $15.00 / 1M de tokens Voir →
TARIFS

Tarifs Kimi

Endpoint Résolution Durée Prix
chat_completion — — Entrée $0.60 / 1M de tokens | Sortie $3.00 / 1M de tokens

Prix affichés pour kimi-k2.5. Les autres variantes conservent leurs propres tarifs par endpoint.

Intégration d'agents

Exécutez Kimi depuis un agent

FONCTIONNEMENT

Démarrer avec Kimi

  1. Choisir le modèle

    Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

  2. S'authentifier une fois

    Utilisez votre clé RunAPI pour tous les modèles pris en charge.

  3. Installer le skill

    Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

  4. Recevoir la sortie

    Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser Kimi

kimi-k3 est le modèle phare actuel de Kimi avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles ; leur ancienne architecture K2 a 1T paramètres et un contexte 256K, et le résultat de 58,6 % sur SWE-bench Pro appartient à kimi-k2.6. Kimi est disponible via OpenAI Chat Completions, OpenAI Responses, Anthropic Messages et Gemini native APIs. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.

Fournisseur
Moonshot AI
Tout voir →
Modalité
Texte
Parcourir les modèles →

Pourquoi utiliser Kimi via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

Questions sur Kimi

Par quel modèle Kimi commencer ?

Commencez par kimi-k3, le modèle phare actuel avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles pour les usages K2 existants.

Quelle est la différence entre kimi-k2.5 et kimi-k2.6 ?

Même architecture MoE 1T. kimi-k2.5 a ajouté l'entrée multimodale native (vision + texte). kimi-k2.6 est un affinage post-training avec une stabilité longue durée renforcée — SWE-bench Pro passe de 50,7 % à 58,6 %, et Agent Swarm passe de 100 à 300 sous-agents.

Quelles API peuvent appeler Kimi via RunAPI ?

Utilisez OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou les API Gemini native avec un identifiant de modèle Kimi. La première version de kimi-k3 prend en charge le texte basique avec réponses synchrones et streaming SSE.

Comment Kimi est-il facturé ?

Consultez la page du catalogue RunAPI de chaque modèle Kimi pour connaître les prix actuels.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

Les générations échouées coûtent-elles quelque chose ?

Les générations échouées ne sont pas facturées

MODÈLES SIMILAIRES

Modèles similaires à Kimi

Commencez à construire avec Kimi.