1つの API key
モデルやプロバイダーをまたいで同じ認証情報を使えます。
RunAPIのモデルスキル、統合認証、従量課金制の料金でMiniMax APIを利用できます。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "このAPI仕様に基づいて型付きクライアントを生成し、モックサーバーに対する統合テストを書き、パスするまで反復してください。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "このAPI仕様に基づいて型付きクライアントを生成し、モックサーバーに対する統合テストを書き、パスするまで反復してください。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "このAPI仕様に基づいて型付きクライアントを生成し、モックサーバーに対する統合テストを書き、パスするまで反復してください。" }]
});
MiniMaxのMシリーズは、コスト効率の高いコーディング向けに構築されたスパースMixture-of-Expertsテキストモデルです。M2からM2.7(総230B / アクティブ約10B、256エキスパート)は200Kコンテキストを提供し、段階的に強化されたエージェント機能を備えます — M2.7はSWE-bench Proで56.2%に到達します。MiniMax-M3はより大規模で異なるアーキテクチャを採用し、新しいSparse Attention設計で1Mコンテキストを復活させ、SWE-bench Verifiedで80.5%、SWE-bench Proで59.0%を記録します。Highspeedバリアントは同じ重みを約100 tokens/secで実行し、レイテンシ重視の作業に適しています。すべて1つのキーとトークン単位の課金でRunAPI経由で利用できます。
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| バリアント | 請求 | 料金 | |
|---|---|---|---|
| MiniMax-M2 | 1,000 トークン | 入力 $0.19 / 100万トークン | 出力 $0.73 / 100万トークン | 見る → |
| MiniMax-M2.1 | 1,000 トークン | 入力 $0.19 / 100万トークン | 出力 $0.73 / 100万トークン | 見る → |
| MiniMax-M2.5 | 1,000 トークン | 入力 $0.19 / 100万トークン | 出力 $0.73 / 100万トークン | 見る → |
| MiniMax-M2.5-highspeed | 1,000 トークン | 入力 $0.37 / 100万トークン | 出力 $1.46 / 100万トークン | 見る → |
| MiniMax-M2.7 | 1,000 トークン | 入力 $0.19 / 100万トークン | 出力 $0.73 / 100万トークン | 見る → |
| MiniMax-M2.7-highspeed | 1,000 トークン | 入力 $0.37 / 100万トークン | 出力 $1.46 / 100万トークン | 見る → |
| MiniMax-M3 | 1,000 トークン | 入力 $0.18-$0.36 / 100万トークン | 出力 $0.72-$1.44 / 100万トークン | 見る → |
| Endpoint | 解像度 | 尺 | 価格 | |
|---|---|---|---|---|
| chat_completion | — | — | 入力 $0.19 / 100万トークン | 出力 $0.73 / 100万トークン |
MiniMax-M2 の料金を表示しています。他のバリアントはそれぞれの endpoint 料金が適用されます。
出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。
対応するすべてのモデルに RunAPI key を使います。
機能実装の前に model skill をコード作業環境へ追加します。
task ID でポーリングするか、生成完了時の callback を処理します。
モデルやプロバイダーをまたいで同じ認証情報を使えます。
model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。
呼び出し前に従量料金を確認できます。
いいえ。これらはコーディングとチャット向けのMiniMaxテキスト言語モデルです。HailuoはMiniMaxの別の動画生成ラインです。
MiniMax-M3が最も強力です — 1Mコンテキスト、80.5% SWE-bench Verifiedを備え、フロンティア級コーディングと100万トークンコンテキストを組み合わせた初のオープンウェイトモデルです。M2.7は200Kコンテキストで最良の選択肢です。Highspeedバリアント(M2.5とM2.7)は同じ重みを約100 tokens/secで実行し、より高いトークン単価で低レイテンシを実現します。
OpenAI SDK(Chat CompletionsまたはResponses)またはAnthropic Messages SDKをRunAPIに向け、MiniMaxモデルIDを渡してください。プロキシがプロトコルを適応します。
各モデルについてRunAPIが公開している入力・出力レートに基づくトークン単位の従量課金です。Highspeedバリアントは、同じ出力品質をより高いスループットで提供し、個別に公開されたレートで課金されます。
model skill をインストールし、RunAPI key とセットアップメモに従ってください。
失敗した生成は課金されません