FOURNISSEUR

Z.ai Modèles IA

GLM de Z.ai — LLM MoE sous licence MIT de 128K à 200K de contexte, meilleurs scores SWE-bench open-weight, via une seule clé RunAPI.

1 models · 8 variants · à partir de $0.0001
APERÇU

Z.ai construit la famille GLM de modèles de langage Mixture-of-Experts sous licence MIT pour le code et les workflows agentiques. La ligne couvre GLM-4.5 (355B / 32B actifs, contexte 128K) jusqu'à GLM-5.1 (754B / 40B actifs, contexte 200K), qui détient le meilleur score open-weight sur SWE-bench Pro à 58,4 %. Tous sont disponibles via RunAPI depuis les SDKs OpenAI et Anthropic avec facturation au token.

  • Une API key partagée entre fournisseurs
  • Les model skills apportent docs et schémas dans votre workspace
  • Facturation par appel, sans engagement
  • Les générations échouées ne sont pas facturées
FONCTIONNALITÉS

Points forts

MODÈLES

Tous les modèles de Z.ai

DÉMARRAGE RAPIDE

Installez un model skill Z.ai.

Choisissez un modèle et ajoutez son skill pour que votre outil de code dispose des docs, schémas, notes de tarifs et étapes de setup.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5.2",
  "messages": [
    {
      "role": "user",
      "content": "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "glm-5.2",
  messages: [{ role: "user", content: "Lisez ce dépôt multi-fichiers, trouvez le test d'intégration en échec et proposez un patch avec une explication de la cause racine." }]
});
https://runapi.ai 5 endpoints
RÉFÉRENCE

Toutes les variantes de Z.ai

Table complète des tarifs →
Model Variant Billing Pricing
GLM
glm-4.5 1K tokens Input $0.41 / 1M tokens | Output $1.61 / 1M tokens Voir →
glm-4.5-air 1K tokens Input $0.10 / 1M tokens | Output $0.55 / 1M tokens Voir →
glm-4.6 1K tokens Input $0.60 / 1M tokens | Output $1.22 / 1M tokens Voir →
glm-4.7 1K tokens Input $0.60 / 1M tokens | Output $1.19 / 1M tokens Voir →
glm-5 1K tokens Input $1.00 / 1M tokens | Output $1.60 / 1M tokens Voir →
glm-5-turbo 1K tokens Input $1.20 / 1M tokens | Output $2.00 / 1M tokens Voir →
glm-5.1 1K tokens Input $1.40 / 1M tokens | Output $2.20 / 1M tokens Voir →
glm-5.2 1K tokens Input $0.70 / 1M tokens | Output $2.20 / 1M tokens Voir →
FAQ

Questions fréquentes sur Z.ai

Est-ce une intégration officielle Z.ai ?

RunAPI expose une surface API gérée avec tarifs, capacités et comportement d'erreur transparents.

Ai-je besoin d'un compte Z.ai ?

Non. Votre clé RunAPI suffit pour l'accès géré.

Comment les tarifs sont-ils facturés ?

Par appel ou par unité mesurée, sans facturation des générations échouées.

COMMENCER

Commencez à appeler les modèles Z.ai depuis une seule API.