Z.ai Modelos de IA
GLM de Z.ai — LLMs MoE con licencia MIT, contexto de 128K a 200K y puntuaciones SWE-bench open-weight líderes, mediante una sola key de RunAPI.
Z.ai crea la familia GLM de modelos de lenguaje Mixture-of-Experts con licencia MIT para programación y flujos de trabajo agénticos. La línea abarca desde GLM-4.5 (355B / 32B activos, contexto 128K) hasta GLM-5.1 (754B / 40B activos, contexto 200K), que mantiene la puntuación open-weight más alta en SWE-bench Pro con 58,4%. Todos están disponibles a través de RunAPI desde los SDKs de OpenAI y Anthropic con facturación por token.
- Una API key compartida entre proveedores
- Los model skills llevan documentación y schemas a tu workspace
- Facturación por llamada, sin compromiso
- Las generaciones fallidas no se cobran
Lo más destacado
Todos los modelos de Z.ai
Instala un model skill de Z.ai.
Elige un modelo y añade su skill para que tu herramienta de código tenga documentación, schemas, notas de precios y pasos de setup.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Lee este repositorio de varios archivos, encuentra la prueba de integración que falla y propone un parche con una explicación de la causa raíz."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Lee este repositorio de varios archivos, encuentra la prueba de integración que falla y propone un parche con una explicación de la causa raíz."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Lee este repositorio de varios archivos, encuentra la prueba de integración que falla y propone un parche con una explicación de la causa raíz." }]
});
Todas las variantes de Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Ver → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Ver → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Ver → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Ver → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Ver → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Ver → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Ver → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Ver → |
Preguntas frecuentes sobre Z.ai
¿Es una integración oficial de Z.ai?
RunAPI ofrece una superficie API gestionada con precios, capacidades y comportamiento de errores transparentes.
¿Necesito una cuenta de Z.ai?
No. Tu clave RunAPI basta para el acceso gestionado.
¿Cómo se factura el precio?
Por llamada o por unidad medida; las generaciones fallidas no se cobran.