Eén auth, elke provider
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Gebruik de MiniMax API via RunAPI met een modelskill, uniforme auth en pay-as-you-go prijzen.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "Genereer op basis van deze API-specificatie een getypeerde client, schrijf integratietests tegen een mockserver en itereer tot ze slagen." }]
});
MiniMax' M-serie bestaat uit sparse Mixture-of-Experts tekstmodellen gebouwd voor kostenefficient coderen. M2 tot en met M2.7 (230B totaal / ongeveer 10B actief, 256 experts) bieden 200K context met steeds sterkere agentische mogelijkheden, en M2.7 haalt 56,2% op SWE-bench Pro. MiniMax-M3 gebruikt een grotere, andere architectuur om 1M context te herstellen met een nieuw Sparse Attention-ontwerp, scoort 80,5% op SWE-bench Verified en 59,0% op SWE-bench Pro. Highspeed-varianten draaien dezelfde gewichten op ongeveer 100 tokens/sec voor latencygevoelig werk. Alles is beschikbaar via RunAPI met een enkele sleutel en tokenfacturatie.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variant | Facturering | Prijzen | |
|---|---|---|---|
| MiniMax-M2 | 1K tokens | Invoer $0.19 / 1M tokens | Uitvoer $0.73 / 1M tokens | Bekijken → |
| MiniMax-M2.1 | 1K tokens | Invoer $0.19 / 1M tokens | Uitvoer $0.73 / 1M tokens | Bekijken → |
| MiniMax-M2.5 | 1K tokens | Invoer $0.19 / 1M tokens | Uitvoer $0.73 / 1M tokens | Bekijken → |
| MiniMax-M2.5-highspeed | 1K tokens | Invoer $0.37 / 1M tokens | Uitvoer $1.46 / 1M tokens | Bekijken → |
| MiniMax-M2.7 | 1K tokens | Invoer $0.19 / 1M tokens | Uitvoer $0.73 / 1M tokens | Bekijken → |
| MiniMax-M2.7-highspeed | 1K tokens | Invoer $0.37 / 1M tokens | Uitvoer $1.46 / 1M tokens | Bekijken → |
| MiniMax-M3 | 1K tokens | Invoer $0.18-$0.36 / 1M tokens | Uitvoer $0.72-$1.44 / 1M tokens | Bekijken → |
| Endpoint | Resolutie | Duur | Prijs | |
|---|---|---|---|---|
| chat_completion | — | — | Invoer $0.19 / 1M tokens | Uitvoer $0.73 / 1M tokens |
Prijzen getoond voor MiniMax-M2. Andere varianten behouden hun eigen endpoint-prijzen.
Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.
Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.
Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.
Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.
MiniMax M-serie tekstmodellen zijn sparse MoE LLMs met 200K-1M context en leveren frontier codingscores voor een fractie van de kosten van dense modellen. Via RunAPI delen ze een enkele API-sleutel met pay-as-you-go tokenfacturatie en zijn ze aanroepbaar via OpenAI Chat Completions, OpenAI Responses en Anthropic Messages. Dit zijn MiniMax' tekstmodellen, los van MiniMax Hailuo videogeneratie.
Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.
Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.
Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.
Nee. Dit zijn MiniMax' teksttaalmodellen voor coding en chat; Hailuo is MiniMax' aparte lijn voor videogeneratie.
MiniMax-M3 is het sterkst, met 1M context, 80,5% SWE-bench Verified en als eerste open-weight model de combinatie van frontier coding met miljoen-token context. M2.7 is de beste optie met 200K context. Highspeed-varianten (M2.5 en M2.7) draaien dezelfde gewichten op ongeveer 100 tokens/sec voor lagere latency tegen hogere tokenkosten.
Gebruik de OpenAI SDK, Chat Completions of Responses, of de Anthropic Messages SDK tegen RunAPI met de MiniMax model id. De proxy past het protocol aan.
Per token tegen RunAPI's gepubliceerde input- en outputtarieven voor elk model, pay-as-you-go. Highspeed-varianten worden gefactureerd tegen hun eigen gepubliceerde tarieven, met dezelfde outputkwaliteit en hogere throughput.
Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.
Een account en API-sleutel aanmaken is gratis. API-aanroepen worden naar gebruik van je vooraf betaalde saldo afgeschreven; voeg saldo toe voordat je verzoeken verstuurt.