Z.ai Modelos de IA
GLM da Z.ai — LLMs MoE licenciados MIT de 128K a 200K de contexto, scores SWE-bench open-weight de ponta, via uma única key RunAPI.
A Z.ai cria a família GLM de modelos de linguagem Mixture-of-Experts licenciados MIT para coding e workflows agênticos. A linha vai de GLM-4.5 (355B / 32B ativos, contexto 128K) a GLM-5.1 (754B / 40B ativos, contexto 200K), que mantém o maior score open-weight no SWE-bench Pro com 58,4%. Todos estão disponíveis pelo RunAPI a partir dos SDKs da OpenAI e Anthropic com cobrança por token.
- Uma API key compartilhada entre provedores
- Model skills levam documentação e schemas ao seu workspace
- Cobrança por chamada, sem compromisso
- Gerações com falha não são cobradas
Destaques
Todos os modelos de Z.ai
Instale um model skill de Z.ai.
Escolha um modelo e adicione seu skill para que sua ferramenta de código tenha documentação, schemas, notas de preço e etapas de setup.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Leia este repositório multi-arquivo, encontre o teste de integração que falha e proponha um patch com explicação da causa raiz."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Leia este repositório multi-arquivo, encontre o teste de integração que falha e proponha um patch com explicação da causa raiz."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Leia este repositório multi-arquivo, encontre o teste de integração que falha e proponha um patch com explicação da causa raiz." }]
});
Todas as variantes de Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Ver → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Ver → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Ver → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Ver → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Ver → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Ver → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Ver → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Ver → |
Perguntas frequentes sobre Z.ai
Esta é uma integração oficial de Z.ai?
RunAPI expõe uma superfície API gerenciada com preços, capacidades e comportamento de erros transparentes.
Preciso de uma conta Z.ai?
Não. Sua chave RunAPI é suficiente para o acesso gerenciado.
Como os preços são cobrados?
Por chamada ou por unidade medida, sem cobrança por gerações com falha.