VARIANT · Z.ai / GLM

glm-5.2 API

Z.ai / GLM

透過 RunAPI 使用 GLM 系列的 glm-5.2。按次收費,無需訂閱,失敗的生成不扣費。

可正常運作 · text · 可商用
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/glm-5.2:generateContent
POST /v1beta/models/glm-5.2:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5.2",
  "messages": [
    {
      "role": "user",
      "content": "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "glm-5.2",
  messages: [{ role: "user", content: "閱讀呢個多檔案 repository,搵出失敗嘅整合測試,並提出 patch,同時解釋根本原因。" }]
});
https://runapi.ai 5 endpoints
切換 variant
OVERVIEW

glm-5.2 針對 GLM 系列中品質與成本的最佳平衡點。

  • 按次收費,美元計價
  • 生成失敗不收費
  • 如模型支援,提供串流輸出
  • Model skill setup
PRICING

收費

失敗的生成不會收費
Chat completion
Input $0.70 / 1M tokens
Output $2.20 / 1M tokens
Cache read $0.13
Cache write 5m Free
規格說明

技術詳情

模型 ID glm-5.2
供應商 Z.ai
模式 text
任務類型 synchronous
計費單位 1K tokens
API endpoint /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/glm-5.2:generateContent
/v1beta/models/glm-5.2:streamGenerateContent
商業授權 是 — 已透過 API 包含
目錄狀態 可正常運作
SKILLS

快速開始 — glm-5.2

結構一致 · variant 已固定於 model 中

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/glm-5.2:generateContent Gemini generateContent
/v1beta/models/glm-5.2:streamGenerateContent Gemini streamGenerateContent
運作方式

四步使用 glm-5.2

01

安裝

為此模型系列安裝 model skill。

02

設定

將 model 欄位設為本頁顯示的完整 model ID。

03

呼叫

連同 prompt、inputs 及 callback 設定,送出一個 typed request。

04

接收

從 RunAPI 讀取 task response、webhook callback 或 cached output URL。

DIFFERENCES

glm-5.2 有咩不同

VS GLM-4.5

當前旗艦基礎模型,專為文字生成而設

355B / 啟用 32B;128K 上下文;旗艦開放權重 MoE baseline

VS GLM-4.5-AIR

當前旗艦基礎模型,專為文字生成而設

較輕量嘅 GLM-4.5 層級,適合快速、低成本日常工作

VS GLM-4.6

當前旗艦基礎模型,專為文字生成而設

200K 上下文;首個運行於 Cambricon 晶片嘅 GLM;更精準程式碼生成

使用場景

最適合

客戶支援

從私有知識庫回答客戶問題,減少工單數量。

文件分析

草擬合約摘要,並標示重點條款供律師審閱。

程式碼生成

在 CI 自動生成單元測試、程式碼審查同重構建議。

FAQ

關於 glm-5.2 的常見問題

模型 ID 會否在不同版本之間保持穩定?

RunAPI 會保持 model ID 穩定,並處理相容的版本更新,而不需要改動你的 request 格式。

這個 variant 的 rate limit 係多少?

每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。

之後可以切換 variant 嗎?

可以——variant 只係一個旗標。只要更改 model 參數就可以切換。

支援 streaming 嗎?

在可用 streaming 的情況下,RunAPI 會端到端串流。

我應該在邊度回報品質問題?

可以在公開 GitHub repo 開 issue,或者電郵支援團隊。

立即開始

開始用 GLM 建立產品。