ANBIETER

Z.ai KI-Modelle

Z.ai GLM — MIT-lizenzierte MoE-LLMs von 128K bis 200K Kontext, Top-Open-Weight-SWE-bench-Scores, über einen RunAPI-Key.

1 models · 8 variants · ab $0.0001
ÜBERBLICK

Z.ai entwickelt die GLM-Familie MIT-lizenzierter Mixture-of-Experts-Sprachmodelle für Coding und agentische Workflows. Die Linie reicht von GLM-4.5 (355B / 32B aktiv, 128K Kontext) bis GLM-5.1 (754B / 40B aktiv, 200K Kontext), das mit 58,4 % den höchsten Open-Weight-SWE-bench-Pro-Score hält. Alle sind über RunAPI aus den OpenAI- und Anthropic-SDKs mit tokenbasierter Abrechnung verfügbar.

  • Ein API Key für mehrere Anbieter
  • Model Skills bringen Docs und Schemas in deinen Workspace
  • Abrechnung pro Aufruf, ohne Verpflichtung
  • Fehlgeschlagene Generierungen werden nicht berechnet
FUNKTIONEN

Was heraussticht

MODELLE

Alle Modelle von Z.ai

QUICKSTART

Installiere einen Z.ai Model Skill.

Wähle ein Modell und füge seinen Skill hinzu, damit dein Coding-Tool Docs, Schemas, Preishinweise und Setup-Schritte kennt.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5.2",
  "messages": [
    {
      "role": "user",
      "content": "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "glm-5.2",
  messages: [{ role: "user", content: "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor." }]
});
https://runapi.ai 5 endpoints
REFERENZ

Jede Variante von Z.ai

Vollständige Preistabelle →
Model Variant Billing Pricing
GLM
glm-4.5 1K tokens Input $0.41 / 1M tokens | Output $1.61 / 1M tokens Ansehen →
glm-4.5-air 1K tokens Input $0.10 / 1M tokens | Output $0.55 / 1M tokens Ansehen →
glm-4.6 1K tokens Input $0.60 / 1M tokens | Output $1.22 / 1M tokens Ansehen →
glm-4.7 1K tokens Input $0.60 / 1M tokens | Output $1.19 / 1M tokens Ansehen →
glm-5 1K tokens Input $1.00 / 1M tokens | Output $1.60 / 1M tokens Ansehen →
glm-5-turbo 1K tokens Input $1.20 / 1M tokens | Output $2.00 / 1M tokens Ansehen →
glm-5.1 1K tokens Input $1.40 / 1M tokens | Output $2.20 / 1M tokens Ansehen →
glm-5.2 1K tokens Input $0.70 / 1M tokens | Output $2.20 / 1M tokens Ansehen →
FAQ

Häufige Fragen zu Z.ai

Ist das eine offizielle Z.ai-Integration?

RunAPI stellt eine verwaltete API-Oberfläche mit transparenten Preisen, Funktionen und Fehlerverhalten bereit.

Brauche ich ein Z.ai-Konto?

Nein. Dein RunAPI Key reicht für den verwalteten Zugriff.

Wie wird abgerechnet?

Pro Aufruf oder Einheit; fehlgeschlagene Generierungen werden nicht berechnet.

JETZT STARTEN

Rufe Z.ai-Modelle über eine API auf.