Z.ai نماذج الذكاء الاصطناعي
Z.ai GLM، نماذج MoE LLM بترخيص MIT من سياق 128K إلى 200K، مع أعلى نتائج SWE-bench للنماذج مفتوحة الأوزان، عبر مفتاح RunAPI واحد.
تطور Z.ai عائلة GLM من نماذج اللغة Mixture-of-Experts بترخيص MIT للبرمجة وسير عمل الوكلاء. يمتد الخط من GLM-4.5 (355B / 32B نشطة، سياق 128K) إلى GLM-5.1 (754B / 40B نشطة، سياق 200K)، والذي يحمل أعلى نتيجة مفتوحة الأوزان في SWE-bench Pro عند 58.4%. كلها متاحة عبر RunAPI من OpenAI وAnthropic SDKs مع فوترة حسب التوكن.
- مفتاح API واحد مشترك بين جميع المزودين
- تنقل model skills التوثيق والـschemas إلى مساحة عملك
- فوترة حسب كل طلب، بلا التزام
- لا تُفرض رسوم على عمليات التوليد الفاشلة
ما يميزها
جميع نماذج Z.ai
ثبّت model skill من Z.ai.
اختر نموذجًا وأضف مهارته حتى تحصل أداة البرمجة على التوثيق والـschemas وملاحظات الأسعار وخطوات الإعداد.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "اقرأ هذا المستودع متعدد الملفات، واعثر على اختبار التكامل الفاشل، واقترح patch مع شرح السبب الجذري."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "اقرأ هذا المستودع متعدد الملفات، واعثر على اختبار التكامل الفاشل، واقترح patch مع شرح السبب الجذري."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "اقرأ هذا المستودع متعدد الملفات، واعثر على اختبار التكامل الفاشل، واقترح patch مع شرح السبب الجذري." }]
});
كل إصدار من Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | عرض → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | عرض → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | عرض → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | عرض → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | عرض → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | عرض → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | عرض → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | عرض → |
الأسئلة الشائعة حول Z.ai
هل هذا تكامل رسمي مع Z.ai؟
يوفّر RunAPI واجهة API مُدارة مع تسعير وقدرات وسلوك أخطاء واضح وشفاف.
هل أحتاج إلى حساب Z.ai؟
لا — يكفي مفتاح RunAPI الخاص بك للوصول المُدار.
ما مقدار زمن الاستجابة الإضافي بسبب العبور عبر البروكسي؟
عادةً أقل من 20 مللي ثانية. يحتفظ RunAPI بطبقة البروكسي قريبة من مناطق تنفيذ النماذج.
هل يتم تخزين الصور / الفيديوهات مؤقتًا؟
تُخزَّن المخرجات المُولَّدة ويمكن استرجاعها عبر معرّف المهمة. لا يتم تخزين المدخلات مؤقتًا.
هل يمكنني استخدام مفتاحي الخاص؟
ليس حاليًا — تستند الطلبات إلى وصول مُدار بواسطة RunAPI.