Z.ai Modele AI
GLM od Z.ai, LLM-y MoE na licencji MIT od kontekstu 128K do 200K, z czołowymi wynikami SWE-bench dla modeli o otwartych wagach, przez jeden klucz RunAPI.
Z.ai tworzy rodzinę GLM, modele językowe Mixture-of-Experts na licencji MIT do kodowania i workflow agentowych. Linia obejmuje GLM-4.5 (355B / 32B aktywnych, kontekst 128K) do GLM-5.1 (754B / 40B aktywnych, kontekst 200K), który ma najwyższy wynik open-weight w SWE-bench Pro: 58.4%. Wszystkie są dostępne przez RunAPI z OpenAI i Anthropic SDK z rozliczeniem za token.
- Jeden klucz API współdzielony między providerami
- Model skille przenoszą dokumentację i schematy do Twojego workspace
- Rozliczenie za wywołanie, bez zobowiązań
- Nieudane generacje nie są naliczane
Co wyróżnia
Wszystkie modele od Z.ai
Zainstaluj model skill Z.ai.
Wybierz model i dodaj jego skill, aby narzędzie do kodowania miało dokumentację, schematy, notatki cenowe i kroki setupu.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [
{
"role": "user",
"content": "Przeczytaj to repozytorium z wielu plików, znajdź padający test integracyjny i zaproponuj poprawkę wraz z wyjaśnieniem przyczyny."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5.2",
messages=[{"role": "user", "content": "Przeczytaj to repozytorium z wielu plików, znajdź padający test integracyjny i zaproponuj poprawkę wraz z wyjaśnieniem przyczyny."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5.2",
messages: [{ role: "user", content: "Przeczytaj to repozytorium z wielu plików, znajdź padający test integracyjny i zaproponuj poprawkę wraz z wyjaśnieniem przyczyny." }]
});
Każda wariacja od Z.ai
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
GLM
|
glm-4.5 | 1K tokens | Input $0.41 / 1M tokens | Output $1.61 / 1M tokens | Zobacz → |
| glm-4.5-air | 1K tokens | Input $0.10 / 1M tokens | Output $0.55 / 1M tokens | Zobacz → | |
| glm-4.6 | 1K tokens | Input $0.60 / 1M tokens | Output $1.22 / 1M tokens | Zobacz → | |
| glm-4.7 | 1K tokens | Input $0.60 / 1M tokens | Output $1.19 / 1M tokens | Zobacz → | |
| glm-5 | 1K tokens | Input $1.00 / 1M tokens | Output $1.60 / 1M tokens | Zobacz → | |
| glm-5-turbo | 1K tokens | Input $1.20 / 1M tokens | Output $2.00 / 1M tokens | Zobacz → | |
| glm-5.1 | 1K tokens | Input $1.40 / 1M tokens | Output $2.20 / 1M tokens | Zobacz → | |
| glm-5.2 | 1K tokens | Input $0.70 / 1M tokens | Output $2.20 / 1M tokens | Zobacz → |
Najczęściej zadawane pytania o Z.ai
Czy to oficjalna integracja Z.ai?
RunAPI udostępnia zarządzany interfejs API z przejrzystym cennikiem, możliwościami i zachowaniem błędów.
Czy potrzebuję konta Z.ai?
Nie — wystarczy Twój klucz RunAPI, aby korzystać z zarządzanego dostępu.
Jaki jest narzut opóźnienia związany z proxy?
Zazwyczaj poniżej 20 ms. RunAPI utrzymuje warstwę proxy blisko regionów wykonywania modeli.
Czy obrazy / filmy są buforowane?
Wygenerowane wyniki są zapisywane i dostępne do pobrania po ID zadania. Dane wejściowe nie są buforowane.
Czy mogę użyć własnego klucza?
Na ten moment nie — wywołania korzystają z dostępu zarządzanego przez RunAPI.