Jedno uwierzytelnienie, wszyscy providerzy
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
It looks like you may prefer a different language. Switch anytime.
Korzystaj z API MiniMax przez RunAPI z model skillem, wspólnym uwierzytelnianiem i cennikiem pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "Na podstawie tej specyfikacji API wygeneruj typowanego klienta, napisz testy integracyjne z mock serverem i iteruj, aż przejdą."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "Na podstawie tej specyfikacji API wygeneruj typowanego klienta, napisz testy integracyjne z mock serverem i iteruj, aż przejdą."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "Na podstawie tej specyfikacji API wygeneruj typowanego klienta, napisz testy integracyjne z mock serverem i iteruj, aż przejdą." }]
});
Seria M od MiniMax to rzadkie tekstowe modele Mixture-of-Experts zbudowane pod ekonomiczne kodowanie. M2 do M2.7 (230B łącznie / około 10B aktywnych, 256 ekspertów) oferują kontekst 200K z coraz silniejszymi możliwościami agentowymi, a M2.7 osiąga 56.2% w SWE-bench Pro. MiniMax-M3 wykorzystuje większą, inną architekturę, przywracając kontekst 1M z nowym projektem Sparse Attention, osiągając 80.5% w SWE-bench Verified i 59.0% w SWE-bench Pro. Warianty Highspeed używają tych samych wag przy około 100 tokens/sec dla zadań wrażliwych na opóźnienie. Wszystkie są dostępne przez RunAPI z jednym kluczem i rozliczeniem za token.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Wariant | Rozliczenia | Cennik | |
|---|---|---|---|
| MiniMax-M2 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Zobacz → |
| MiniMax-M2.1 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Zobacz → |
| MiniMax-M2.5 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Zobacz → |
| MiniMax-M2.5-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Zobacz → |
| MiniMax-M2.7 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | Zobacz → |
| MiniMax-M2.7-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | Zobacz → |
| MiniMax-M3 | 1K tokens | Input $0.18-$0.36 / 1M tokens | Output $0.72-$1.44 / 1M tokens | Zobacz → |
| Endpoint | Rozdzielczość | Czas trwania | Cena | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens |
Ceny podane dla MiniMax-M2. Pozostałe warianty mają własne cenniki endpointów.
Wybierz model i wariant pasujące do typu wyjścia, progu jakości i celu opóźnienia.
Ustaw klucz RunAPI i zainstaluj model skill w workspace kodu.
Użyj instrukcji skilla, aby dodać funkcję modelu w swojej aplikacji.
Odpytuj po task ID, streamuj gdy wspierane albo obsłuż callback webhook.
Tekstowe modele MiniMax M-series to rzadkie LLM-y MoE z kontekstem 200K-1M, dostarczające frontierowe wyniki kodowania za ułamek kosztu modeli gęstych. Przez RunAPI korzystają z jednego klucza API, rozliczenia tokenowego pay-as-you-go i można je wywoływać z OpenAI Chat Completions, OpenAI Responses oraz Anthropic Messages. To tekstowe modele MiniMax, odrębne od generowania wideo MiniMax Hailuo.
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
Rozliczanie za wywołanie w USD, fakturowane co miesiąc. Nieudane generacje nie są naliczane.
Typowane schematy i notatki setupu są spakowane w model skill, więc implementacja startuje od właściwego kontraktu.
Nie. To tekstowe modele językowe MiniMax do kodowania i czatu; Hailuo to osobna linia MiniMax do generowania wideo.
MiniMax-M3 jest najmocniejszy — kontekst 1M, 80.5% SWE-bench Verified i pierwszy model o otwartych wagach łączący frontierowe kodowanie z milionowym kontekstem. M2.7 to najlepsza opcja z kontekstem 200K. Warianty Highspeed (M2.5 i M2.7) używają tych samych wag przy około 100 tokens/sec dla niższych opóźnień i wyższego kosztu tokenów.
Użyj OpenAI SDK (Chat Completions lub Responses) albo Anthropic Messages SDK z RunAPI i model id MiniMax; proxy dopasuje protokół.
Za token według opublikowanych przez RunAPI stawek wejścia i wyjścia dla każdego modelu, pay-as-you-go. Warianty Highspeed kosztują około 2× więcej niż standardowe przy tej samej jakości wyjścia i większej przepustowości.
Wybierz najtańszy wariant, który spełnia Twoje wymagania jakościowe. Większość zespołów zaczyna od szybkiego wariantu, a do produkcji przechodzi na pro.
Utworzenie konta i klucza API jest bezpłatne. Wywołania API są rozliczane według zużycia z przedpłaconego salda; doładuj je przed wysłaniem żądań.