MiniMax API
وصول إلى MiniMax text API عبر RunAPI — نماذج sparse MoE من سياق 200K إلى 1M، وحتى 80.5% في SWE-bench Verified.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"messages": [
{
"role": "user",
"content": "بناءً على مواصفة API هذه، أنشئ عميلاً typed، واكتب اختبارات تكامل مقابل mock server، وكرر حتى تنجح."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="MiniMax-M3",
messages=[{"role": "user", "content": "بناءً على مواصفة API هذه، أنشئ عميلاً typed، واكتب اختبارات تكامل مقابل mock server، وكرر حتى تنجح."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "MiniMax-M3",
messages: [{ role: "user", content: "بناءً على مواصفة API هذه، أنشئ عميلاً typed، واكتب اختبارات تكامل مقابل mock server، وكرر حتى تنجح." }]
});
سلسلة M من MiniMax هي نماذج نصية sparse Mixture-of-Experts مبنية للبرمجة بتكلفة فعالة. تقدم M2 حتى M2.7 (230B إجمالاً / نحو 10B نشطة، 256 خبيراً) سياق 200K مع قدرات وكلاء أقوى تدريجياً، ويصل M2.7 إلى 56.2% في SWE-bench Pro. يستخدم MiniMax-M3 معمارية أكبر ومختلفة لاستعادة سياق 1M بتصميم Sparse Attention جديد، مسجلاً 80.5% في SWE-bench Verified و59.0% في SWE-bench Pro. تعمل متغيرات Highspeed بالأوزان نفسها عند نحو 100 tokens/sec للأعمال الحساسة للزمن. كلها متاحة عبر RunAPI بمفتاح واحد وفوترة حسب التوكن.
- عدة إصدارات لمستويات مختلفة من السرعة / الجودة
- يتضمن model skill التوثيق والـschemas وملاحظات الإعداد
- يعمل مع workflows موجهة لتطوير التطبيقات
- لا يتم احتساب رسوم على عمليات التوليد الفاشلة
قارن جميع إصدارات API
| Variant | Billing | Pricing | |
|---|---|---|---|
| MiniMax-M2 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | عرض → |
| MiniMax-M2.1 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | عرض → |
| MiniMax-M2.5 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | عرض → |
| MiniMax-M2.5-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | عرض → |
| MiniMax-M2.7 | 1K tokens | Input $0.19 / 1M tokens | Output $0.73 / 1M tokens | عرض → |
| MiniMax-M2.7-highspeed | 1K tokens | Input $0.37 / 1M tokens | Output $1.46 / 1M tokens | عرض → |
| MiniMax-M3 | 1K tokens | Input $0.18-$0.36 / 1M tokens | Output $0.72-$1.44 / 1M tokens | عرض → |
نقاط نهاية API لـ MiniMax
استخدم SDK OpenAI أو Anthropic مع مفتاح RunAPI. لا حاجة لـ SDK إضافي.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
من model skill إلى أول نتيجة في أربع خطوات
اختر النموذج
اختر النموذج والإصدار المناسبين لنوع المخرجات ومستوى الجودة وزمن الاستجابة المستهدف.
الإعداد
اضبط مفتاح RunAPI وثبّت model skill في مساحة عمل الكود.
التنفيذ
استخدم تعليمات المهارة لإضافة ميزة النموذج داخل تطبيقك.
الاستلام
استعلم عبر task ID أو استخدم البث عند دعمه أو عالج webhook callback.
ما هي MiniMax API؟
نماذج MiniMax M-series النصية هي LLMs بنمط sparse MoE وسياق 200K-1M، وتقدم نتائج برمجة متقدمة بجزء من تكلفة النماذج dense. عبر RunAPI تشترك هذه النماذج في مفتاح API واحد مع فوترة توكنات بنظام الدفع حسب الاستخدام، ويمكن استدعاؤها من واجهات OpenAI Chat Completions وOpenAI Responses وAnthropic Messages. هذه نماذج MiniMax النصية، وهي منفصلة عن توليد الفيديو MiniMax Hailuo.
لماذا تستخدم MiniMax API عبر RunAPI
مصادقة واحدة لكل مزود
مفتاح RunAPI واحد يفتح الوصول إلى الكتالوج بالكامل. لا حسابات منفصلة، ولا تدوير مفاتيح لكل تكامل.
تسعير وفوترة موحّدان
تسعير لكل استدعاء بالدولار الأمريكي، ويُفوتر شهريًا. لا تُحتسب التوليدات الفاشلة.
Skill مع schemas
تأتي الـschemas المعرّفة وملاحظات الإعداد داخل model skill حتى يبدأ التنفيذ من العقد الصحيح.
أسئلة شائعة
هل هذه هي نماذج MiniMax Hailuo للفيديو نفسها؟
لا. هذه نماذج لغة نصية من MiniMax للبرمجة والدردشة؛ Hailuo هو خط منفصل من MiniMax لتوليد الفيديو.
أي نموذج MiniMax نصي أختار؟
MiniMax-M3 هو الأقوى — سياق 1M، و80.5% في SWE-bench Verified، وأول نموذج مفتوح الأوزان يجمع بين برمجة frontier وسياق مليون توكن. M2.7 هو أفضل خيار بسياق 200K. تعمل متغيرات Highspeed (M2.5 وM2.7) بالأوزان نفسها عند نحو 100 tokens/sec لتقليل زمن الاستجابة مقابل تكلفة توكن أعلى.
ما حزم SDK التي يمكنها استدعاء MiniMax text عبر RunAPI؟
استخدم OpenAI SDK (Chat Completions أو Responses) أو Anthropic Messages SDK مع RunAPI وmodel id الخاص بـ MiniMax؛ وسيتولى proxy تكييف البروتوكول.
كيف تتم فوترة MiniMax text؟
حسب التوكن وفق أسعار الإدخال والإخراج المنشورة في RunAPI لكل نموذج، بنظام الدفع حسب الاستخدام. تكلف متغيرات Highspeed نحو 2× القياسية للجودة نفسها مع إنتاجية أعلى.
أي نسخة ينبغي أن أبدأ بها؟
اختر أرخص نسخة تفي بمعيار الجودة لديك. يبدأ معظم الفرق بالنسخة السريعة ثم ينتقلون إلى pro للإنتاج.
هل توجد خطة مجانية؟
تحصل الحسابات الجديدة على أول طلبات مجانية على كل نموذج. بعد ذلك، الدفع حسب كل طلب.
هل تدعمون البث المباشر للنتائج؟
حيث يتوفر البث المباشر، يوفّر RunAPI البث من البداية إلى النهاية.
كيف يتم احتساب الرسوم عند الفشل؟
لا يتم تحصيل رسوم على عمليات التوليد الفاشلة.
هل يتم تخزين المخرجات مؤقتًا؟
يتم حفظ المخرجات المولدة ويمكن استرجاعها بواسطة task ID. لا يتم تخزين المدخلات مؤقتًا.
هل يمكنني الاستخدام تجاريًا؟
نعم — يشمل كل إصدار الاستخدام التجاري ما لم يقيّده ترخيص النموذج صراحةً، ويُشار إلى ذلك في صفحة الإصدار.
ماذا عن حدود المعدل؟
تتدرج حدود المعدل لكل مفتاح وفق فئة الاستخدام. راجع صفحة الأسعار للاطلاع على الحدود الحالية.
أين يمكنني الإبلاغ عن المشاكل؟
افتح issue في مستودع GitHub العام أو راسل الدعم عبر البريد الإلكتروني.