Z.ai KI-Modelle
Z.ai GLM — MIT-lizenzierte MoE-LLMs von 128K bis 200K Kontext, Top-Open-Weight-SWE-bench-Scores, über einen RunAPI-Key.
Z.ai entwickelt die GLM-Familie MIT-lizenzierter Mixture-of-Experts-Sprachmodelle für Coding und agentische Workflows. Die Linie reicht von GLM-4.5 (355B / 32B aktiv, 128K Kontext) bis GLM-5.1 (754B / 40B aktiv, 200K Kontext), das mit 58,4 % den höchsten Open-Weight-SWE-bench-Pro-Score hält. Alle sind über RunAPI aus den OpenAI- und Anthropic-SDKs mit tokenbasierter Abrechnung verfügbar.
- Ein API Key für mehrere Anbieter
- Model Skills bringen Docs und Schemas in deinen Workspace
- Abrechnung pro Aufruf, ohne Verpflichtung
- Fehlgeschlagene Generierungen werden nicht berechnet
Was heraussticht
Alle Modelle von Z.ai
Installiere einen Z.ai Model Skill.
Wähle ein Modell und füge seinen Skill hinzu, damit dein Coding-Tool Docs, Schemas, Preishinweise und Setup-Schritte kennt.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor." }]
});
Jede Variante von Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Ansehen → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Ansehen → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Ansehen → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Ansehen → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Ansehen → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Ansehen → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Ansehen → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Ansehen → |
Häufige Fragen zu Z.ai
Ist das eine offizielle Z.ai-Integration?
RunAPI stellt eine verwaltete API-Oberfläche mit transparenten Preisen, Funktionen und Fehlerverhalten bereit.
Brauche ich ein Z.ai-Konto?
Nein. Dein RunAPI Key reicht für den verwalteten Zugriff.
Wie wird abgerechnet?
Pro Aufruf oder Einheit; fehlgeschlagene Generierungen werden nicht berechnet.