Text · MiniMax

MiniMax API

MiniMax text API-toegang via RunAPI, sparse MoE-modellen van 200K tot 1M context en tot 80,5% SWE-bench Verified.

Operationeel · 7 variants · vanaf $0.0002
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "MiniMax-M3",
  "messages": [
    {
      "role": "user",
      "content": "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="MiniMax-M3",
    messages=[{"role": "user", "content": "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "MiniMax-M3",
  messages: [{ role: "user", content: "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

MiniMax' M-serie bestaat uit sparse Mixture-of-Experts tekstmodellen gebouwd voor kostenefficient coderen. M2 tot en met M2.7 (230B totaal / ongeveer 10B actief, 256 experts) bieden 200K context met steeds sterkere agentische mogelijkheden, en M2.7 haalt 56,2% op SWE-bench Pro. MiniMax-M3 gebruikt een grotere, andere architectuur om 1M context te herstellen met een nieuw Sparse Attention-ontwerp, scoort 80,5% op SWE-bench Verified en 59,0% op SWE-bench Pro. Highspeed-varianten draaien dezelfde gewichten op ongeveer 100 tokens/sec voor latencygevoelig werk. Alles is beschikbaar via RunAPI met een enkele sleutel en tokenfacturatie.

  • Meerdere varianten voor verschillende snelheid-/kwaliteitsniveaus
  • Modelskill bevat docs, schema's en setupnotities
  • Werkt met appgerichte codeerworkflows
  • Mislukte generaties worden niet in rekening gebracht
VARIANTS

Vergelijk alle API-varianten

Variant Billing Pricing
MiniMax-M2 1K tokens Input $0.19 / 1M tokens | Output $0.73 / 1M tokens Bekijken →
MiniMax-M2.1 1K tokens Input $0.19 / 1M tokens | Output $0.73 / 1M tokens Bekijken →
MiniMax-M2.5 1K tokens Input $0.19 / 1M tokens | Output $0.73 / 1M tokens Bekijken →
MiniMax-M2.5-highspeed 1K tokens Input $0.37 / 1M tokens | Output $1.46 / 1M tokens Bekijken →
MiniMax-M2.7 1K tokens Input $0.19 / 1M tokens | Output $0.73 / 1M tokens Bekijken →
MiniMax-M2.7-highspeed 1K tokens Input $0.37 / 1M tokens | Output $1.46 / 1M tokens Bekijken →
MiniMax-M3 1K tokens Input $0.18-$0.36 / 1M tokens | Output $0.72-$1.44 / 1M tokens Bekijken →
API

MiniMax API-endpoints

Gebruik de OpenAI- of Anthropic-SDK met je RunAPI-sleutel. Geen extra SDK nodig.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
HOE HET WERKT

Van modelskill naar eerste resultaat in vier stappen

01

Kies het model

Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.

02

Configureren

Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.

03

Bouwen

Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.

04

Ontvangen

Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.

CONTEXT

Wat is de MiniMax API?

MiniMax M-serie tekstmodellen zijn sparse MoE LLMs met 200K-1M context en leveren frontier codingscores voor een fractie van de kosten van dense modellen. Via RunAPI delen ze een enkele API-sleutel met pay-as-you-go tokenfacturatie en zijn ze aanroepbaar via OpenAI Chat Completions, OpenAI Responses en Anthropic Messages. Dit zijn MiniMax' tekstmodellen, los van MiniMax Hailuo videogeneratie.

Provider
MiniMax
Modality
Text
WAAROM RUNAPI

Waarom de MiniMax API via RunAPI gebruiken

Eén auth, elke provider

Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.

Uniforme prijzen & billing

Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.

Skill met schema's

Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.

FAQ

Veelgestelde vragen

Zijn dit dezelfde modellen als MiniMax Hailuo videomodellen?

Nee. Dit zijn MiniMax' teksttaalmodellen voor coding en chat; Hailuo is MiniMax' aparte lijn voor videogeneratie.

Welk MiniMax tekstmodel moet ik kiezen?

MiniMax-M3 is het sterkst, met 1M context, 80,5% SWE-bench Verified en als eerste open-weight model de combinatie van frontier coding met miljoen-token context. M2.7 is de beste optie met 200K context. Highspeed-varianten (M2.5 en M2.7) draaien dezelfde gewichten op ongeveer 100 tokens/sec voor lagere latency tegen hogere tokenkosten.

Welke SDKs kunnen MiniMax text via RunAPI aanroepen?

Gebruik de OpenAI SDK, Chat Completions of Responses, of de Anthropic Messages SDK tegen RunAPI met de MiniMax model id. De proxy past het protocol aan.

Hoe wordt MiniMax text gefactureerd?

Per token tegen RunAPI's gepubliceerde input- en outputtarieven voor elk model, pay-as-you-go. Highspeed-varianten kosten ongeveer 2 keer standaard voor dezelfde outputkwaliteit met hogere throughput.

Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

Is er een gratis tier?

Nieuwe accounts krijgen de eerste calls gratis op elk model. Daarna betaal je per call.

Streamen jullie resultaten?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Hoe worden mislukkingen gefactureerd?

Mislukte generations worden niet in rekening gebracht.

Worden outputs gecachet?

Gegenereerde outputs worden opgeslagen en zijn op te vragen via task-ID. Inputs worden niet gecachet.

Mag ik het commercieel gebruiken?

Ja — commercieel gebruik is inbegrepen voor elke variant, tenzij een modellicentie het expliciet beperkt. Dat staat aangegeven op de variantpagina.

Hoe zit het met rate limits?

Rate limits per key schalen mee met je usage tier. Zie de prijzenpagina voor de actuele limieten.

Waar kan ik problemen melden?

Open een issue in de publieke GitHub-repo of mail support.

VERGELIJKBARE MODELLEN

Als je de MiniMax API goed vindt, probeer deze dan eens

NU BEGINNEN

Begin met bouwen met de MiniMax API.