PROVIDER

Z.ai AI-modellen

Z.ai's GLM, MIT-gelicentieerde MoE LLMs van 128K tot 200K context en top open-weight SWE-bench scores, via een enkele RunAPI-sleutel.

1 models · 8 variants · vanaf $0.0001
OVERVIEW

Z.ai bouwt de GLM-familie van MIT-gelicentieerde Mixture-of-Experts taalmodellen voor coding en agentische workflows. De lijn loopt van GLM-4.5, 355B / 32B actief en 128K context, tot GLM-5.1, 754B / 40B actief en 200K context, dat met 58,4% de hoogste open-weight SWE-bench Pro-score heeft. Alles is beschikbaar via RunAPI vanuit de OpenAI en Anthropic SDKs met tokenfacturatie.

  • Eén API-key gedeeld tussen providers
  • Modelskills brengen docs en schema's naar je workspace
  • Betalen per call, zonder verplichting
  • Mislukte generaties worden niet in rekening gebracht
FEATURES

Wat opvalt

MODELS

Alle modellen van Z.ai

QUICKSTART

Installeer een Z.ai modelskill.

Kies een model en voeg de skill toe zodat je codeertool docs, schema's, prijsnotities en setupstappen heeft.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5.2",
  "messages": [
    {
      "role": "user",
      "content": "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "glm-5.2",
  messages: [{ role: "user", content: "Lees deze repository met meerdere bestanden, vind de falende integratietest en stel een patch voor met uitleg van de hoofdoorzaak." }]
});
https://runapi.ai 5 endpoints
REFERENCE

Alle varianten van Z.ai

Volledige prijstabel →
Model Variant Billing Pricing
GLM
glm-4.5 1K tokens Input $0.41 / 1M tokens | Output $1.61 / 1M tokens Bekijken →
glm-4.5-air 1K tokens Input $0.10 / 1M tokens | Output $0.55 / 1M tokens Bekijken →
glm-4.6 1K tokens Input $0.60 / 1M tokens | Output $1.22 / 1M tokens Bekijken →
glm-4.7 1K tokens Input $0.60 / 1M tokens | Output $1.19 / 1M tokens Bekijken →
glm-5 1K tokens Input $1.00 / 1M tokens | Output $1.60 / 1M tokens Bekijken →
glm-5-turbo 1K tokens Input $1.20 / 1M tokens | Output $2.00 / 1M tokens Bekijken →
glm-5.1 1K tokens Input $1.40 / 1M tokens | Output $2.20 / 1M tokens Bekijken →
glm-5.2 1K tokens Input $0.70 / 1M tokens | Output $2.20 / 1M tokens Bekijken →
FAQ

Veelgestelde vragen over Z.ai

Is dit een officiële Z.ai-integratie?

RunAPI biedt een beheerde API-laag met transparante prijzen, mogelijkheden en foutgedrag.

Heb ik een Z.ai-account nodig?

Nee — je RunAPI-sleutel is genoeg voor beheerde toegang.

Wat is de extra latency door proxying?

Meestal onder de 20 ms. RunAPI houdt de proxylaag dicht bij de regio’s waar het model draait.

Worden afbeeldingen / video’s gecached?

Genereerde output wordt opgeslagen en is op te halen via task ID. Invoer wordt niet gecached.

Kan ik mijn eigen key gebruiken?

Nog niet — calls gebruiken RunAPI-beheerde toegang.

NU BEGINNEN

Begin met bouwen met Z.ai-modellen.