glm-5-turbo API
Z.ai / GLM
透過 RunAPI 使用 GLM 系列的 glm-5-turbo。按次收費,無需訂閱,失敗的生成不扣費。
可正常運作
·
text
·
可商用
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/glm-5-turbo:generateContent
POST /v1beta/models/glm-5-turbo:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-turbo",
"messages": [
{
"role": "user",
"content": "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5-turbo",
messages=[{"role": "user", "content": "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5-turbo",
messages: [{ role: "user", content: "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。" }]
});
切換 variant
OVERVIEW
glm-5-turbo 針對 GLM 系列中品質與成本的最佳平衡點。
- 按次收費,美元計價
- 生成失敗不收費
- 如模型支援,提供串流輸出
- Model skill setup
PRICING
收費
失敗的生成不會收費
Chat completion
Input
$1.20
/ 1M tokens
Output
$2.00
/ 1M tokens
Cache read
$0.24
Cache write 5m
Free
Cache write 1h
Free
規格說明
技術詳情
| 模型 ID | glm-5-turbo |
| 供應商 | Z.ai |
| 模式 | text |
| 任務類型 | synchronous |
| 計費單位 | 1K tokens |
| API endpoint | /v1/chat/completions |
| /v1/responses | |
| /v1/messages | |
| /v1beta/models/glm-5-turbo:generateContent | |
| /v1beta/models/glm-5-turbo:streamGenerateContent | |
| 商業授權 | 是 — 已透過 API 包含 |
| 目錄狀態 | 可正常運作 |
SKILLS
快速開始 — glm-5-turbo
結構一致 · variant 已固定於 model 中
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/glm-5-turbo:generateContent | Gemini generateContent |
| /v1beta/models/glm-5-turbo:streamGenerateContent | Gemini streamGenerateContent |
運作方式
四步使用 glm-5-turbo
01
安裝
為此模型系列安裝 model skill。
02
設定
將 model 欄位設為本頁顯示的完整 model ID。
03
呼叫
連同 prompt、inputs 及 callback 設定,送出一個 typed request。
04
接收
從 RunAPI 讀取 task response、webhook callback 或 cached output URL。
DIFFERENCES
glm-5-turbo 有咩不同
VS GLM-4.5
為速度最佳化嘅 GLM-5 層級,降低延遲
355B / 啟用 32B;128K 上下文;旗艦開放權重 MoE baseline
VS GLM-4.5-AIR
為速度最佳化嘅 GLM-5 層級,降低延遲
較輕量嘅 GLM-4.5 層級,適合快速、低成本日常工作
VS GLM-4.6
為速度最佳化嘅 GLM-5 層級,降低延遲
200K 上下文;首個運行於 Cambricon 晶片嘅 GLM;更精準程式碼生成
使用場景
最適合
客戶支援
從私有知識庫回答客戶問題,減少工單數量。
文件分析
草擬合約摘要,並標示重點條款供律師審閱。
程式碼生成
在 CI 自動生成單元測試、程式碼審查同重構建議。
FAQ
關於 glm-5-turbo 的常見問題
模型 ID 會否在不同版本之間保持穩定?
RunAPI 會保持 model ID 穩定,並處理相容的版本更新,而不需要改動你的 request 格式。
這個 variant 的 rate limit 係多少?
每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。
之後可以切換 variant 嗎?
可以——variant 只係一個旗標。只要更改 model 參數就可以切換。
支援 streaming 嗎?
在可用 streaming 的情況下,RunAPI 會端到端串流。
我應該在邊度回報品質問題?
可以在公開 GitHub repo 開 issue,或者電郵支援團隊。
GLM 的其他 variant
glm-4.5-air
最平
4.5-air
Input $0.10 / 1M tokens | Output $0.55 / 1M tokens
glm-4.5
4.5
Input $0.41 / 1M tokens | Output $1.61 / 1M tokens
glm-4.6
4.6
Input $0.60 / 1M tokens | Output $1.22 / 1M tokens
glm-4.7
4.7
Input $0.60 / 1M tokens | Output $1.19 / 1M tokens
glm-5.2
5.2
Input $0.70 / 1M tokens | Output $2.20 / 1M tokens
glm-5
5
Input $1.00 / 1M tokens | Output $1.60 / 1M tokens
glm-5.1
5.1
Input $1.40 / 1M tokens | Output $2.20 / 1M tokens
其他模型的替代方案
立即開始