Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
It looks like you may prefer a different language. Switch anytime.
Utilisez l'API MiniMax via RunAPI avec une compétence de modèle, une authentification unifiée et une tarification à l'usage.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "À partir de cette spécification API, générez un client typé, écrivez des tests d'intégration contre un serveur mock et itérez jusqu'à ce qu'ils passent."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "À partir de cette spécification API, générez un client typé, écrivez des tests d'intégration contre un serveur mock et itérez jusqu'à ce qu'ils passent."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "À partir de cette spécification API, générez un client typé, écrivez des tests d'intégration contre un serveur mock et itérez jusqu'à ce qu'ils passent." }]
});
La série M de MiniMax regroupe des modèles texte sparse Mixture-of-Experts conçus pour du code économique. M2 à M2.7 (230B total / ~10B actifs, 256 experts) offrent un contexte 200K avec des capacités agentiques progressivement renforcées — M2.7 atteint 56,2 % sur SWE-bench Pro. MiniMax-M3 utilise une architecture plus grande et différente pour rétablir le contexte 1M avec un nouveau design Sparse Attention, obtenant 80,5 % sur SWE-bench Verified et 59,0 % sur SWE-bench Pro. Les variantes Highspeed exécutent les mêmes poids à ~100 tokens/sec pour les tâches sensibles à la latence. Tous sont disponibles via RunAPI avec une seule clé et une facturation au token.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Facturation | Tarifs | |
|---|---|---|---|
| MiniMax-M2 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Voir → |
| MiniMax-M2.1 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Voir → |
| MiniMax-M2.5 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Voir → |
| MiniMax-M2.5-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Voir → |
| MiniMax-M2.7 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Voir → |
| MiniMax-M2.7-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Voir → |
| MiniMax-M3 | 1K tokens | Input $0.18-$0.36 / 1M tokens | Output $0.72-$1.44 / 1M tokens | Voir → |
| Endpoint | Résolution | Durée | Prix | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens |
Prix affichés pour MiniMax-M2. Les autres variantes conservent leurs propres tarifs par endpoint.
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Interrogez par task ID ou traitez le callback quand la génération se termine.
Les modèles texte MiniMax série M sont des LLM MoE sparse avec contexte 200K–1M, livrant des scores de code frontier pour une fraction du coût des modèles denses. Via RunAPI, ils partagent une seule clé API avec facturation au token à l'usage, et sont appelables depuis OpenAI Chat Completions, OpenAI Responses et Anthropic Messages. Ce sont les modèles texte de MiniMax, distincts de la génération vidéo MiniMax Hailuo.
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Les tarifs à l'usage sont visibles avant l'appel.
Non. Ce sont les modèles de langage texte de MiniMax pour le code et le chat ; Hailuo est la ligne séparée de génération vidéo de MiniMax.
MiniMax-M3 est le plus fort — contexte 1M, 80,5 % SWE-bench Verified, et le premier modèle open-weight combinant code frontier et contexte million-token. M2.7 est la meilleure option à contexte 200K. Les variantes Highspeed (M2.5 et M2.7) exécutent les mêmes poids à ~100 tokens/sec pour une latence réduite à un coût token plus élevé.
Utilisez le SDK OpenAI (Chat Completions ou Responses) ou le SDK Anthropic Messages avec RunAPI et l'identifiant de modèle MiniMax ; le proxy adapte le protocole.
Au token selon les tarifs d'entrée et de sortie publiés par RunAPI pour chaque modèle, à l'usage. Les variantes Highspeed coûtent environ 2× le standard pour la même qualité de sortie avec un débit plus élevé.
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.
Les générations échouées ne sont pas facturées