Versions et endpoints publics
| ID du modèle | Endpoints | Prix de départ | Catalogue |
|---|---|---|---|
kimi-k2.5
|
/v1/chat/completions
|
$0.60 / 1M de tokens | Détail du modèle |
kimi-k2.6
|
/v1/chat/completions
|
$0.95 / 1M de tokens | Détail du modèle |
kimi-k2.7-code
|
/v1/chat/completions
|
$0.57 / 1M de tokens | Détail du modèle |
kimi-k3
|
/v1/chat/completions
|
$3.00 / 1M de tokens | Détail du modèle |
Vérification
Interrogez jusqu’à ce que la tâche atteigne un état final
Sélectionnez <model-id> pour générer les commandes de vérification.
Configuration
Endpoint du guide: <endpoint>
Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Démarrer en 3 étapes
-
Choisir un ID de modèle
Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.
-
Configurer RunAPI
Ajoutez la configuration du fournisseur pour cet agent.
-
Vérifier le résultat
Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.
Ce que vous pouvez créer avec Hermes Agent + Kimi
-
Code et raisonnement avec un agent
Laissez votre agent planifier, écrire et relire du code, ou résoudre des problèmes en plusieurs étapes grâce au raisonnement du modèle.
-
Analyse et extraction de longs documents
Résumez des rapports, des contrats ou des bases de code et extrayez des champs structurés de longs documents.
-
Workflows avec appels d'outils
Reliez le modèle à des fonctions et des API pour que votre agent consulte des données et agisse entre deux réponses.
Pourquoi utiliser Kimi avec RunAPI + Hermes Agent
-
4 variantes, une clé API
Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.
-
Des tarifs d'utilisation clairs
Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.
-
Réponses directes
Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.
Questions sur Hermes Agent + Kimi
Par quel modèle Kimi commencer ?
Commencez par kimi-k3, le modèle phare actuel avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles pour les usages K2 existants.
Quelle est la différence entre kimi-k2.5 et kimi-k2.6 ?
Même architecture MoE 1T. kimi-k2.5 a ajouté l'entrée multimodale native (vision + texte). kimi-k2.6 est un affinage post-training avec une stabilité longue durée renforcée — SWE-bench Pro passe de 50,7 % à 58,6 %, et Agent Swarm passe de 100 à 300 sous-agents.
Quelles API peuvent appeler Kimi via RunAPI ?
Utilisez OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou les API Gemini native avec un identifiant de modèle Kimi. La première version de kimi-k3 prend en charge le texte basique avec réponses synchrones et streaming SSE.
Comment Kimi est-il facturé ?
Consultez la page du catalogue RunAPI de chaque modèle Kimi pour connaître les prix actuels.
Quel ID de modèle utiliser ?
Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.
Ce guide configure-t-il un modèle de chat ?
Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.