MiniMax · Tekst

Hermes Agent x MiniMax

MiniMax M-serie tekstmodellen zijn sparse MoE LLMs met 200K-1M context en leveren frontier codingscores voor een fractie van de kosten van dense modellen. Via RunAPI delen ze een enkele API-sleutel met pay-as-you-go tokenfacturatie en zijn ze aanroepbaar via OpenAI Chat Completions, OpenAI Responses en Anthropic Messages. Dit zijn MiniMax' tekstmodellen, los van MiniMax Hailuo videogeneratie.

7 variants vanaf $0.18 / 1M tokens Commercieel toegestaan

Prerequisite: npx runapi mcp install

Prompt

Promptmodellen

Gebruik MiniMax-M2 wanneer het bij de taak past: 230B / 10B actief, 200K context, baseline M-serie codingmodel.

You have access to RunAPI chat models for MiniMax.

Available MiniMax models:
- MiniMax-M2: 230B / 10B actief, 200K context, baseline M-serie codingmodel
  chat endpoints: /v1/chat/completions
- MiniMax-M2.1: 200K context, polyglot programmeren, 74% SWE-bench Verified
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5: 200K context, sterker agentisch tool calling en search
  chat endpoints: /v1/chat/completions
- MiniMax-M2.5-highspeed: M2.5 op ongeveer 100 tokens/sec, dezelfde gewichten en hogere throughput
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7: 200K context, 56,2% SWE-bench Pro, zelfevoluerende training
  chat endpoints: /v1/chat/completions
- MiniMax-M2.7-highspeed: M2.7 op ongeveer 100 tokens/sec, dezelfde gewichten en hogere throughput
  chat endpoints: /v1/chat/completions
- MiniMax-M3: 1M context, 80,5% SWE-bench Verified, frontier open-weight coding en lange context
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen.
Verify the active model with: hermes model;hermes doctor

Openbare versies en endpoints

Model-ID Endpoints Vanafprijs Catalogus
MiniMax-M2
/v1/chat/completions
$0.19 / 1M tokens Modeldetails
MiniMax-M2.1
/v1/chat/completions
$0.19 / 1M tokens Modeldetails
MiniMax-M2.5
/v1/chat/completions
$0.19 / 1M tokens Modeldetails
MiniMax-M2.5-highspeed
/v1/chat/completions
$0.37 / 1M tokens Modeldetails
MiniMax-M2.7
/v1/chat/completions
$0.19 / 1M tokens Modeldetails
MiniMax-M2.7-highspeed
/v1/chat/completions
$0.37 / 1M tokens Modeldetails
MiniMax-M3
/v1/chat/completions
$0.18 / 1M tokens Modeldetails

Verifiëren

Poll totdat de Task een eindstatus bereikt

Selecteer <model-id> om verificatieopdrachten te genereren.

Configuratie

Handleiding-endpoint: <endpoint>

Selecteer <model-id> om een aanvraag te genereren met het openbare invoercontract van het endpoint.
Zo werkt het

Start in 3 stappen

  1. Kies een model-ID

    Selecteer een openbare model-ID uit de catalogus en bekijk het endpoint en de actuele vanafprijs.

  2. Configureer RunAPI

    Voeg de providerconfiguratie voor deze agent toe.

  3. Verifieer het resultaat

    Voer de onderstaande status- en modelselectieopdrachten uit.

Wat je kunt bouwen met Hermes Agent + MiniMax

  • Programmeren en redeneren met agents

    Laat je agent code plannen, schrijven en reviewen of meerstapsproblemen oplossen met het redeneervermogen van het model.

  • Analyse en extractie van lange documenten

    Vat rapporten, contracten of codebases samen en haal gestructureerde velden uit lange documenten.

  • Workflows met toolaanroepen

    Koppel het model aan functies en API's zodat je agent tussen antwoorden door gegevens kan opzoeken en acties kan uitvoeren.

Waarom MiniMax gebruiken via RunAPI + Hermes Agent

  • 7 varianten, één API-sleutel

    Gebruik één RunAPI-verbinding om beschikbare modelvarianten te kiezen zonder je integratie aan te passen.

  • Duidelijke gebruiksprijzen

    Bekijk de actuele catalogusprijzen voordat je een aanvraag verstuurt, zonder abonnement of minimale besteding.

  • Directe antwoorden

    Synchrone aanroepen geven het resultaat in hetzelfde antwoord terug, zodat je agent het direct kan gebruiken zonder de taakstatus op te vragen.

Vragen over Hermes Agent + MiniMax

Zijn dit dezelfde modellen als MiniMax Hailuo videomodellen?

Nee. Dit zijn MiniMax' teksttaalmodellen voor coding en chat; Hailuo is MiniMax' aparte lijn voor videogeneratie.

Welk MiniMax tekstmodel moet ik kiezen?

MiniMax-M3 is het sterkst, met 1M context, 80,5% SWE-bench Verified en als eerste open-weight model de combinatie van frontier coding met miljoen-token context. M2.7 is de beste optie met 200K context. Highspeed-varianten (M2.5 en M2.7) draaien dezelfde gewichten op ongeveer 100 tokens/sec voor lagere latency tegen hogere tokenkosten.

Welke SDKs kunnen MiniMax text via RunAPI aanroepen?

Gebruik de OpenAI SDK, Chat Completions of Responses, of de Anthropic Messages SDK tegen RunAPI met de MiniMax model id. De proxy past het protocol aan.

Hoe wordt MiniMax text gefactureerd?

Per token tegen RunAPI's gepubliceerde input- en outputtarieven voor elk model, pay-as-you-go. Highspeed-varianten worden gefactureerd tegen hun eigen gepubliceerde tarieven, met dezelfde outputkwaliteit en hogere throughput.

Welke model-ID moet ik gebruiken?

Kies een openbare model-ID uit de versietabel. Elke ID biedt de endpoints die in de betreffende rij staan.

Configureert deze handleiding een chatmodel?

Ja. Deze modellijn ondersteunt een clientgericht LLM-protocol.

Aan de slag met MiniMax en Hermes Agent

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op