Z.ai Modèles IA
GLM de Z.ai — LLM MoE sous licence MIT de 128K à 200K de contexte, meilleurs scores SWE-bench open-weight, via une seule clé RunAPI.
Z.ai construit la famille GLM de modèles de langage Mixture-of-Experts sous licence MIT pour le code et les workflows agentiques. La ligne couvre GLM-4.5 (355B / 32B actifs, contexte 128K) jusqu'à GLM-5.1 (754B / 40B actifs, contexte 200K), qui détient le meilleur score open-weight sur SWE-bench Pro à 58,4 %. Tous sont disponibles via RunAPI depuis les SDKs OpenAI et Anthropic avec facturation au token.
- Une API key partagée entre fournisseurs
- Les model skills apportent docs et schémas dans votre workspace
- Facturation par appel, sans engagement
- Les générations échouées ne sont pas facturées
Points forts
Tous les modèles de Z.ai
Installez un model skill Z.ai.
Choisissez un modèle et ajoutez son skill pour que votre outil de code dispose des docs, schémas, notes de tarifs et étapes de setup.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine." }]
});
Toutes les variantes de Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Voir → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Voir → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Voir → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Voir → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Voir → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Voir → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Voir → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Voir → |
Questions fréquentes sur Z.ai
Est-ce une intégration officielle Z.ai ?
RunAPI expose une surface API gérée avec tarifs, capacités et comportement d'erreur transparents.
Ai-je besoin d'un compte Z.ai ?
Non. Votre clé RunAPI suffit pour l'accès géré.
Comment les tarifs sont-ils facturés ?
Par appel ou par unité mesurée, sans facturation des générations échouées.