MiniMax · Text

Hermes Agent x MiniMax

MiniMax-M-Series-Textmodelle sind sparse MoE-LLMs mit 200K–1M Kontext und liefern Frontier-Coding-Scores zu einem Bruchteil der Kosten dichter Modelle. Über RunAPI teilen sie einen gemeinsamen API-Key mit nutzungsbasierter Token-Abrechnung und sind über OpenAI Chat Completions, OpenAI Responses und Anthropic Messages aufrufbar. Dies sind MiniMax-Textmodelle, getrennt von MiniMax Hailuo Videogenerierung.

7 variants ab $0.18 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende MiniMax-M2, wenn es zur Aufgabe passt: 230B / 10B aktiv; 200K Kontext; Baseline-Coding-Modell der M-Serie.

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 10B aktiv; 200K Kontext; Baseline-Coding-Modell der M-Serie
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: 200K Kontext; polyglotte Programmierung; 74 % SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: 200K Kontext; stärkeres agentisches Tool Calling und Suche
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: M2.5 mit ~100 tokens/sec; gleiche Gewichte, höherer Durchsatz
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: 200K Kontext; 56,2 % SWE-bench Pro; selbstentwickelndes Training
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: M2.7 mit ~100 tokens/sec; gleiche Gewichte, höherer Durchsatz
  chat endpoints: /v1/chat/completions
- MiniMax-M3: 1M Kontext; 80,5 % SWE-bench Verified; Frontier-Open-Weight-Coding + langer Kontext
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Generiere aus dieser API-Spezifikation einen typisierten Client, schreibe Integrationstests gegen einen Mock-Server und iteriere, bis sie bestehen.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
MiniMax-M2
/v1/chat/completions
$0.19 / 1 Mio. Tokens Modelldetails
MiniMax-M2.1
/v1/chat/completions
$0.19 / 1 Mio. Tokens Modelldetails
MiniMax-M2.5
/v1/chat/completions
$0.19 / 1 Mio. Tokens Modelldetails
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 1 Mio. Tokens Modelldetails
MiniMax-M2.7
/v1/chat/completions
$0.19 / 1 Mio. Tokens Modelldetails
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 1 Mio. Tokens Modelldetails
MiniMax-M3
/v1/chat/completions
$0.18 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + MiniMax bauen kannst

  • Coding und Reasoning mit Agenten

    Lass deinen Agenten Code planen, schreiben und prüfen oder mehrstufige Probleme mit dem Reasoning des Modells lösen.

  • Analyse und Extraktion langer Dokumente

    Fasse Berichte, Verträge oder Codebasen zusammen und extrahiere strukturierte Felder aus langen Dokumenten.

  • Workflows mit Tool-Aufrufen

    Verbinde das Modell mit Funktionen und APIs, damit dein Agent zwischen Antworten Daten abrufen und Aktionen ausführen kann.

Warum MiniMax über RunAPI + Hermes Agent nutzen

  • 7 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Direkte Antworten

    Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.

Fragen zu Hermes Agent + MiniMax

Sind das dieselben Modelle wie MiniMax Hailuo Video?

Nein. Dies sind MiniMaxs Text-Sprachmodelle für Coding und Chat; Hailuo ist MiniMaxs separate Videogenerierungslinie.

Welches MiniMax-Textmodell sollte ich wählen?

MiniMax-M3 ist das stärkste — 1M Kontext, 80,5 % SWE-bench Verified und das erste Open-Weight-Modell, das Frontier-Coding mit Million-Token-Kontext kombiniert. M2.7 ist die beste Option mit 200K Kontext. Highspeed-Varianten (M2.5 und M2.7) nutzen dieselben Gewichte mit ca. 100 tokens/sec für niedrigere Latenz zu höherem Tokenpreis.

Welche SDKs können MiniMax Text über RunAPI aufrufen?

Verwende das OpenAI SDK (Chat Completions oder Responses) oder das Anthropic Messages SDK gegen RunAPI mit der MiniMax-Modell-ID; der Proxy passt das Protokoll an.

Wie wird MiniMax Text abgerechnet?

Pro Token zu RunAPIs veröffentlichten Input- und Output-Raten für jedes Modell, nutzungsbasiert. Highspeed-Varianten werden zu ihren eigenen veröffentlichten Raten abgerechnet, bei gleicher Ausgabequalität und höherem Durchsatz.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

MiniMax mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen