Moonshot AI · Text
Hermes Agent x Kimi
kimi-k3 est le modèle phare actuel de Kimi avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles ; leur ancienne architecture K2 a 1T paramètres et un contexte 256K, et le résultat de 58,6 % sur SWE-bench Pro appartient à kimi-k2.6. Kimi est disponible via OpenAI Chat Completions, OpenAI Responses, Anthropic Messages et Gemini native APIs. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.
Versions et endpoints publics
| ID du modèle | Version | Endpoints | Prix de départ | Catalogue |
|---|---|---|---|---|
kimi-k2.5 | 1T / 32B actifs ; contexte 256K ; entrée multimodale native | /v1/chat/completions | $0.0006 | Détail du modèle |
kimi-k2.6 | 1T / 32B actifs ; contexte 256K ; 58,6 % SWE-bench Pro ; swarm 300 agents | /v1/chat/completions | $0.0026 | Détail du modèle |
kimi-k2.7-code | Modèle dédié au code ; raisonnement toujours actif ; contexte 256K | /v1/chat/completions | $0.0006 | Détail du modèle |
kimi-k3 | Modèle phare actuel de Kimi avec raisonnement toujours actif | /v1/chat/completions | $0.0018 | Détail du modèle |
Configuration
Endpoint du guide: <endpoint>
Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.Vérification
Sélectionnez <model-id> pour générer les commandes de vérification.Fonctionnement
- 1. Choisir un ID de modèle
Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.
- 2. Configurer RunAPI
Ajoutez la configuration du fournisseur pour cet agent.
- 3. Vérifier le résultat
Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.
FAQ
Quel ID de modèle utiliser ?
Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.
Ce guide configure-t-il un modèle de chat ?
Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.