MiniMax · Texte

Hermes Agent x MiniMax

Les modèles texte MiniMax série M sont des LLM MoE sparse avec contexte 200K–1M, livrant des scores de code frontier pour une fraction du coût des modèles denses. Via RunAPI, ils partagent une seule clé API avec facturation au token à l'usage, et sont appelables depuis OpenAI Chat Completions, OpenAI Responses et Anthropic Messages. Ce sont les modèles texte de MiniMax, distincts de la génération vidéo MiniMax Hailuo.

7 variants à partir de $0.18 / 1M de tokens Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez MiniMax-M2 lorsqu'il correspond à la tâche : 230B / 10B actifs ; contexte 200K ; modèle de code baseline série M.

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 10B actifs ; contexte 200K ; modèle de code baseline série M
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: Contexte 200K ; programmation polyglotte ; 74 % SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: Contexte 200K ; appels d'outils agentiques et recherche renforcés
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: M2.5 à ~100 tokens/sec ; mêmes poids, débit supérieur
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: Contexte 200K ; 56,2 % SWE-bench Pro ; entraînement auto-évolutif
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: M2.7 à ~100 tokens/sec ; mêmes poids, débit supérieur
  chat endpoints: /v1/chat/completions
- MiniMax-M3: Contexte 1M ; 80,5 % SWE-bench Verified ; code frontier open-weight + long contexte
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: À partir de cette spécification API, générez un client typé, écrivez des tests d'intégration contre un serveur mock et itérez jusqu'à ce qu'ils passent.
Verify the active model with: hermes model;hermes doctor

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
MiniMax-M2
/v1/chat/completions
$0.19 / 1M de tokens Détail du modèle
MiniMax-M2.1
/v1/chat/completions
$0.19 / 1M de tokens Détail du modèle
MiniMax-M2.5
/v1/chat/completions
$0.19 / 1M de tokens Détail du modèle
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 1M de tokens Détail du modèle
MiniMax-M2.7
/v1/chat/completions
$0.19 / 1M de tokens Détail du modèle
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 1M de tokens Détail du modèle
MiniMax-M3
/v1/chat/completions
$0.18 / 1M de tokens Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Ajoutez la configuration du fournisseur pour cet agent.

  3. Vérifier le résultat

    Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.

Ce que vous pouvez créer avec Hermes Agent + MiniMax

  • Code et raisonnement avec un agent

    Laissez votre agent planifier, écrire et relire du code, ou résoudre des problèmes en plusieurs étapes grâce au raisonnement du modèle.

  • Analyse et extraction de longs documents

    Résumez des rapports, des contrats ou des bases de code et extrayez des champs structurés de longs documents.

  • Workflows avec appels d'outils

    Reliez le modèle à des fonctions et des API pour que votre agent consulte des données et agisse entre deux réponses.

Pourquoi utiliser MiniMax avec RunAPI + Hermes Agent

  • 7 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur Hermes Agent + MiniMax

S'agit-il des mêmes modèles que MiniMax Hailuo vidéo ?

Non. Ce sont les modèles de langage texte de MiniMax pour le code et le chat ; Hailuo est la ligne séparée de génération vidéo de MiniMax.

Quel modèle texte MiniMax choisir ?

MiniMax-M3 est le plus fort — contexte 1M, 80,5 % SWE-bench Verified, et le premier modèle open-weight combinant code frontier et contexte million-token. M2.7 est la meilleure option à contexte 200K. Les variantes Highspeed (M2.5 et M2.7) exécutent les mêmes poids à ~100 tokens/sec pour une latence réduite à un coût token plus élevé.

Quels SDKs peuvent appeler MiniMax texte via RunAPI ?

Utilisez le SDK OpenAI (Chat Completions ou Responses) ou le SDK Anthropic Messages avec RunAPI et l'identifiant de modèle MiniMax ; le proxy adapte le protocole.

Comment MiniMax texte est-il facturé ?

Au token selon les tarifs d'entrée et de sortie publiés par RunAPI pour chaque modèle, à l'usage. Les variantes Highspeed sont facturées selon leurs propres tarifs publiés, avec la même qualité de sortie et un débit plus élevé.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.

Commencer à utiliser MiniMax avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter