Un’unica autenticazione, tutti i provider
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
It looks like you may prefer a different language. Switch anytime.
Usa l'API MiniMax tramite RunAPI con model skill, autenticazione unificata e prezzi pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "Dato questo spec API, genera un client tipizzato, scrivi test di integrazione contro un mock server e itera finché non passano."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "Dato questo spec API, genera un client tipizzato, scrivi test di integrazione contro un mock server e itera finché non passano."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "Dato questo spec API, genera un client tipizzato, scrivi test di integrazione contro un mock server e itera finché non passano." }]
});
La serie M di MiniMax comprende modelli testuali sparsi Mixture-of-Experts pensati per coding efficiente nei costi. Da M2 a M2.7 (230B totali / circa 10B attivi e 256 esperti) offrono 200K di contesto con capacità agentiche progressivamente più forti, e M2.7 raggiunge il 56,2% su SWE-bench Pro. MiniMax-M3 utilizza un'architettura più ampia e diversa per ripristinare 1M di contesto con un nuovo design Sparse Attention, ottenendo l'80,5% su SWE-bench Verified e il 59,0% su SWE-bench Pro. Le varianti Highspeed eseguono gli stessi pesi a circa 100 tokens/sec per lavori sensibili alla latenza. Tutti sono disponibili tramite RunAPI con una sola chiave e fatturazione per token.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Fatturazione | Prezzo | |
|---|---|---|---|
| MiniMax-M2 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Visualizza → |
| MiniMax-M2.1 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Visualizza → |
| MiniMax-M2.5 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Visualizza → |
| MiniMax-M2.5-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Visualizza → |
| MiniMax-M2.7 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Visualizza → |
| MiniMax-M2.7-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Visualizza → |
| MiniMax-M3 | 1K tokens | Input $0.18-$0.36 / 1M tokens | Output $0.72-$1.44 / 1M tokens | Visualizza → |
| Endpoint | Risoluzione | Durata | Prezzo | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens |
Prezzi mostrati per MiniMax-M2. Le altre varianti mantengono i propri prezzi per endpoint.
Seleziona modello e variante adatti al tipo di output, al livello qualità e alla latenza target.
Imposta la tua chiave RunAPI e installa il model skill nel workspace di codice.
Usa le istruzioni dello skill per aggiungere la feature modello dentro la tua applicazione.
Interroga per task ID, usa streaming dove supportato o gestisci il callback webhook.
I modelli testuali MiniMax serie M sono LLM MoE sparsi con contesto da 200K a 1M, capaci di punteggi di coding frontier a una frazione del costo dei modelli densi. Tramite RunAPI condividono una singola chiave API con fatturazione token pay-as-you-go e sono chiamabili dalle superfici OpenAI Chat Completions, OpenAI Responses e Anthropic Messages. Questi sono i modelli testuali MiniMax, distinti dalla generazione video MiniMax Hailuo.
Una sola chiave RunAPI sblocca l’intero catalogo. Niente account separati, niente rotazione delle chiavi per integrazione.
Prezzi per chiamata in USD, fatturati mensilmente. Le generazioni fallite non vengono addebitate.
Schema tipizzati e note di setup sono inclusi nel model skill, così l'implementazione parte dal contratto corretto.
No. Questi sono i modelli linguistici testuali MiniMax per coding e chat; Hailuo è la linea separata di generazione video di MiniMax.
MiniMax-M3 è il più forte, con 1M di contesto, 80,5% su SWE-bench Verified e il primo modello open-weight a combinare coding frontier con contesto da un milione di token. M2.7 è la migliore opzione da 200K di contesto. Le varianti Highspeed (M2.5 e M2.7) eseguono gli stessi pesi a circa 100 tokens/sec per latenza inferiore a un costo token più alto.
Usa l'SDK OpenAI, Chat Completions o Responses, oppure l'SDK Anthropic Messages contro RunAPI con il model id MiniMax. Il proxy adatta il protocollo.
Per token alle tariffe di input e output pubblicate da RunAPI per ciascun modello, pay-as-you-go. Le varianti Highspeed costano circa 2 volte lo standard per la stessa qualità di output con throughput più alto.
Scegli la variante più economica che soddisfa il tuo livello di qualità. La maggior parte dei team inizia con la variante veloce e passa alla pro per la produzione.
Creare un account e una chiave API è gratuito. Le chiamate API sono addebitate a consumo sul saldo prepagato; aggiungi fondi prima di inviare richieste.