Moonshot AI · Texte

Hermes Agent x Kimi

kimi-k3 est le modèle phare actuel de Kimi avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles ; leur ancienne architecture K2 a 1T paramètres et un contexte 256K, et le résultat de 58,6 % sur SWE-bench Pro appartient à kimi-k2.6. Kimi est disponible via OpenAI Chat Completions, OpenAI Responses, Anthropic Messages et Gemini native APIs. La première version RunAPI de kimi-k3 prend en charge les requêtes texte basiques avec réponses synchrones et streaming SSE.

4 variants à partir de $0.57 / 1M de tokens Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez kimi-k2.5 lorsqu'il correspond à la tâche : 1T / 32B actifs ; contexte 256K ; entrée multimodale native.

You have access to RunAPI chat models for Kimi.

Available Kimi models:
- kimi-k2.5: 1T / 32B actifs ; contexte 256K ; entrée multimodale native
  chat endpoints: /v1/chat/completions
- kimi-k2.6: 1T / 32B actifs ; contexte 256K ; 58,6 % SWE-bench Pro ; swarm 300 agents
  chat endpoints: /v1/chat/completions
- kimi-k2.7-code: Modèle dédié au code ; raisonnement toujours actif ; contexte 256K
  chat endpoints: /v1/chat/completions
- kimi-k3: Modèle phare actuel de Kimi avec raisonnement toujours actif
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Planifiez et implémentez un petit outil CLI, créez la structure du projet, écrivez les commandes, ajoutez des tests et exécutez-les jusqu'à ce qu'ils passent.
Verify the active model with: hermes model;hermes doctor

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
kimi-k2.5
/v1/chat/completions
$0.60 / 1M de tokens Détail du modèle
kimi-k2.6
/v1/chat/completions
$0.95 / 1M de tokens Détail du modèle
kimi-k2.7-code
/v1/chat/completions
$0.57 / 1M de tokens Détail du modèle
kimi-k3
/v1/chat/completions
$3.00 / 1M de tokens Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Ajoutez la configuration du fournisseur pour cet agent.

  3. Vérifier le résultat

    Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.

Ce que vous pouvez créer avec Hermes Agent + Kimi

  • Code et raisonnement avec un agent

    Laissez votre agent planifier, écrire et relire du code, ou résoudre des problèmes en plusieurs étapes grâce au raisonnement du modèle.

  • Analyse et extraction de longs documents

    Résumez des rapports, des contrats ou des bases de code et extrayez des champs structurés de longs documents.

  • Workflows avec appels d'outils

    Reliez le modèle à des fonctions et des API pour que votre agent consulte des données et agisse entre deux réponses.

Pourquoi utiliser Kimi avec RunAPI + Hermes Agent

  • 4 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur Hermes Agent + Kimi

Par quel modèle Kimi commencer ?

Commencez par kimi-k3, le modèle phare actuel avec raisonnement toujours actif. kimi-k2.5 et kimi-k2.6 restent disponibles pour les usages K2 existants.

Quelle est la différence entre kimi-k2.5 et kimi-k2.6 ?

Même architecture MoE 1T. kimi-k2.5 a ajouté l'entrée multimodale native (vision + texte). kimi-k2.6 est un affinage post-training avec une stabilité longue durée renforcée — SWE-bench Pro passe de 50,7 % à 58,6 %, et Agent Swarm passe de 100 à 300 sous-agents.

Quelles API peuvent appeler Kimi via RunAPI ?

Utilisez OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou les API Gemini native avec un identifiant de modèle Kimi. La première version de kimi-k3 prend en charge le texte basique avec réponses synchrones et streaming SSE.

Comment Kimi est-il facturé ?

Consultez la page du catalogue RunAPI de chaque modèle Kimi pour connaître les prix actuels.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.

Commencer à utiliser Kimi avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter