---
title: "GLM API — 變體、價格與 model skill | RunAPI"
url: "https://runapi.ai/zh-HK/models/glm.md"
canonical: "https://runapi.ai/zh-HK/models/glm.md"
locale: "zh-HK"
model: "GLM"
provider: "Z.ai"
modality: "text"
variant_count: 7
price_from_cents: 1
---

# GLM API

Z.ai GLM API access via RunAPI — MIT-licensed MoE models with up to 200K context, leading open-weight coding benchmarks.

**Provider:** Z.ai
**Modality:** Text
**Catalog:** 7 variants

GLM is Z.ai&#39;s family of MIT-licensed Mixture-of-Experts language models. GLM-4.5 (355B total / 32B active, 128K context) introduced the open-weight MoE line with a flagship and a lighter Air tier. GLM-4.6 and 4.7 extend to 200K context with stronger code generation — 4.7 reaches 73.8% on SWE-bench. The GLM-5 series (744B / 40B active, 200K context) pushes further to 77.8% SWE-bench Verified, and GLM-5.1 holds the top open-weight score on SWE-bench Pro at 58.4%. All are available through RunAPI with one key and per-token billing.

## Variants

| Version | Variant | Pricing | Billing | URL |
|---|---|---|---|---|
| glm-4.5 | `4.5` | $0.020 | 1K tokens | https://runapi.ai/zh-HK/models/glm/4.5.md |
| glm-4.5-air | `4.5-air` | $0.010 | 1K tokens | https://runapi.ai/zh-HK/models/glm/4.5-air.md |
| glm-4.6 | `4.6` | $0.020 | 1K tokens | https://runapi.ai/zh-HK/models/glm/4.6.md |
| glm-4.7 | `4.7` | $0.020 | 1K tokens | https://runapi.ai/zh-HK/models/glm/4.7.md |
| glm-5 | `5` | $0.020 | 1K tokens | https://runapi.ai/zh-HK/models/glm/5.md |
| glm-5-turbo | `5-turbo` | $0.020 | 1K tokens | https://runapi.ai/zh-HK/models/glm/5-turbo.md |
| glm-5.1 | `5.1` | $0.030 | 1K tokens | https://runapi.ai/zh-HK/models/glm/5.1.md |


## API endpoints

Base URL: `https://runapi.ai`

- `POST /v1/chat/completions`

Use the OpenAI or Anthropic SDK with your RunAPI API key. No extra SDK required.

## Context

GLM models from Z.ai are MIT-licensed MoE LLMs spanning 128K–200K context. GLM-5.1 leads open-weight models on SWE-bench Pro. Through RunAPI they share a single API key with pay-as-you-go token billing, callable from the OpenAI Chat Completions, OpenAI Responses, and Anthropic Messages surfaces.

## FAQ

### 我應該先用邊個版本？

先選最平而且符合你質素要求的版本。大多數團隊會先用快速版本，之後再升級到 pro 用於正式生產。

### 有免費方案嗎？

新帳戶可獲得每個模型的首次呼叫免費。之後按次收費。

### 你哋支援串流結果嗎？

如有提供串流，RunAPI 會端到端串流。

### 失敗會點樣收費？

生成失敗不會收費。

### 輸出有快取嗎？

已生成輸出會儲存，並可按任務 ID 取回。輸入內容不會快取。

### 可以商業使用嗎？

可以——除非模型授權明確限制，否則每個版本都包括商業使用。相關限制會在版本頁面列明。

### 限流點樣計？

每個密鑰的限流會跟使用等級而提升。最新限制請參考定價頁。

### 可以在邊度報告問題？

可以在公開 GitHub repo 開 issue，或者電郵支援。

