Kimi API
وصول إلى Moonshot AI Kimi API عبر RunAPI، مع kimi-k3 كنموذج رائد حالي يمتلك استدلالاً مفعلاً دائماً.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "خطط ونفّذ أداة CLI صغيرة، أنشئ هيكل المشروع، واكتب الأوامر، وأضف الاختبارات، وشغّلها حتى تنجح."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "خطط ونفّذ أداة CLI صغيرة، أنشئ هيكل المشروع، واكتب الأوامر، وأضف الاختبارات، وشغّلها حتى تنجح."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "خطط ونفّذ أداة CLI صغيرة، أنشئ هيكل المشروع، واكتب الأوامر، وأضف الاختبارات، وشغّلها حتى تنجح." }]
});
Kimi هي عائلة نماذج لغة من Moonshot AI. يعد kimi-k3 النموذج الرائد الحالي ويستخدم الاستدلال دائماً. تدعم النسخة الأولى في RunAPI طلبات النص البسيطة فقط، بشكل متزامن أو عبر SSE. يبقى kimi-k2.5 وkimi-k2.6 متاحين؛ وتنتمي معمارية 1T MoE والنتائج المعيارية المرتبطة بها تحديداً إلى نماذج K2 الأقدم.
- عدة إصدارات لمستويات مختلفة من السرعة / الجودة
- يتضمن model skill التوثيق والـschemas وملاحظات الإعداد
- يعمل مع workflows موجهة لتطوير التطبيقات
- لا يتم احتساب رسوم على عمليات التوليد الفاشلة
قارن جميع إصدارات API
| Variant | Billing | Pricing | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | عرض → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | عرض → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | عرض → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | عرض → |
نقاط نهاية API لـ Kimi
استخدم SDK OpenAI أو Anthropic مع مفتاح RunAPI. لا حاجة لـ SDK إضافي.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
من model skill إلى أول نتيجة في أربع خطوات
اختر النموذج
اختر النموذج والإصدار المناسبين لنوع المخرجات ومستوى الجودة وزمن الاستجابة المستهدف.
الإعداد
اضبط مفتاح RunAPI وثبّت model skill في مساحة عمل الكود.
التنفيذ
استخدم تعليمات المهارة لإضافة ميزة النموذج داخل تطبيقك.
الاستلام
استعلم عبر task ID أو استخدم البث عند دعمه أو عالج webhook callback.
ما هي Kimi API؟
kimi-k3 هو نموذج Kimi الرائد الحالي مع استدلال مفعّل دائماً. في النسخة الأولى من RunAPI يتوفر لطلبات نصية بسيطة، بشكل متزامن أو عبر SSE. استخدم OpenAI Chat Completions أو OpenAI Responses أو Anthropic Messages أو Gemini native بالمفتاح نفسه؛ ويبقى kimi-k2.5 وkimi-k2.6 متاحين أيضاً.
لماذا تستخدم Kimi API عبر RunAPI
مصادقة واحدة لكل مزود
مفتاح RunAPI واحد يفتح الوصول إلى الكتالوج بالكامل. لا حسابات منفصلة، ولا تدوير مفاتيح لكل تكامل.
تسعير وفوترة موحّدان
تسعير لكل استدعاء بالدولار الأمريكي، ويُفوتر شهريًا. لا تُحتسب التوليدات الفاشلة.
Skill مع schemas
تأتي الـschemas المعرّفة وملاحظات الإعداد داخل model skill حتى يبدأ التنفيذ من العقد الصحيح.
أسئلة شائعة
ما الذي تم تحسين Kimi من أجله؟
kimi-k3 هو النموذج الرائد الحالي ويستخدم الاستدلال دائماً. تركز النسخة الأولى من RunAPI على مهام النص البسيطة، بشكل متزامن أو عبر SSE؛ ويبقى kimi-k2.5 وkimi-k2.6 متاحين.
ما الفرق بين kimi-k2.5 وkimi-k2.6؟
المعمارية نفسها 1T MoE. أضاف kimi-k2.5 إدخالاً متعدد الوسائط أصلياً (vision + text). أما kimi-k2.6 فهو تحسين post-training لاستقرار أقوى في المهام طويلة الأفق؛ ترتفع SWE-bench Pro من 50.7% إلى 58.6%، ويتوسع Agent Swarm من 100 إلى 300 sub-agents.
ما حزم SDK التي يمكنها استدعاء Kimi عبر RunAPI؟
استخدم OpenAI Chat Completions أو OpenAI Responses أو Anthropic Messages أو Gemini native مع مفتاح RunAPI ومعرّف نموذج Kimi، بما فيه kimi-k3.
كيف تتم فوترة Kimi؟
راجع صفحة كتالوج RunAPI الخاصة بكل نموذج Kimi، بما في ذلك kimi-k3، للحصول على معلومات الفوترة الحالية.
أي نسخة ينبغي أن أبدأ بها؟
اختر أرخص نسخة تفي بمعيار الجودة لديك. يبدأ معظم الفرق بالنسخة السريعة ثم ينتقلون إلى pro للإنتاج.
هل توجد خطة مجانية؟
تحصل الحسابات الجديدة على أول طلبات مجانية على كل نموذج. بعد ذلك، الدفع حسب كل طلب.
هل تدعمون البث المباشر للنتائج؟
حيث يتوفر البث المباشر، يوفّر RunAPI البث من البداية إلى النهاية.
كيف يتم احتساب الرسوم عند الفشل؟
لا يتم تحصيل رسوم على عمليات التوليد الفاشلة.
هل يتم تخزين المخرجات مؤقتًا؟
يتم حفظ المخرجات المولدة ويمكن استرجاعها بواسطة task ID. لا يتم تخزين المدخلات مؤقتًا.
هل يمكنني الاستخدام تجاريًا؟
نعم — يشمل كل إصدار الاستخدام التجاري ما لم يقيّده ترخيص النموذج صراحةً، ويُشار إلى ذلك في صفحة الإصدار.
ماذا عن حدود المعدل؟
تتدرج حدود المعدل لكل مفتاح وفق فئة الاستخدام. راجع صفحة الأسعار للاطلاع على الحدود الحالية.
أين يمكنني الإبلاغ عن المشاكل؟
افتح issue في مستودع GitHub العام أو راسل الدعم عبر البريد الإلكتروني.