Z.ai AI-modellen
Z.ai's GLM, MIT-gelicentieerde MoE LLMs van 128K tot 200K context en top open-weight SWE-bench scores, via een enkele RunAPI-sleutel.
Z.ai bouwt de GLM-familie van MIT-gelicentieerde Mixture-of-Experts taalmodellen voor coding en agentische workflows. De lijn loopt van GLM-4.5, 355B / 32B actief en 128K context, tot GLM-5.1, 754B / 40B actief en 200K context, dat met 58,4% de hoogste open-weight SWE-bench Pro-score heeft. Alles is beschikbaar via RunAPI vanuit de OpenAI en Anthropic SDKs met tokenfacturatie.
- Eén API-key gedeeld tussen providers
- Modelskills brengen docs en schema's naar je workspace
- Betalen per call, zonder verplichting
- Mislukte generaties worden niet in rekening gebracht
Wat opvalt
Alle modellen van Z.ai
Installeer een Z.ai modelskill.
Kies een model en voeg de skill toe zodat je codeertool docs, schema's, prijsnotities en setupstappen heeft.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak." }]
});
Alle varianten van Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Bekijken → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Bekijken → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Bekijken → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Bekijken → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Bekijken → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Bekijken → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Bekijken → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Bekijken → |
Veelgestelde vragen over Z.ai
Is dit een officiële Z.ai-integratie?
RunAPI biedt een beheerde API-laag met transparante prijzen, mogelijkheden en foutgedrag.
Heb ik een Z.ai-account nodig?
Nee — je RunAPI-sleutel is genoeg voor beheerde toegang.
Wat is de extra latency door proxying?
Meestal onder de 20 ms. RunAPI houdt de proxylaag dicht bij de regio’s waar het model draait.
Worden afbeeldingen / video’s gecached?
Genereerde output wordt opgeslagen en is op te halen via task ID. Invoer wordt niet gecached.
Kan ik mijn eigen key gebruiken?
Nog niet — calls gebruiken RunAPI-beheerde toegang.