Z.ai · Text
Hermes Agent x GLM
Z.ai 的 GLM 模型是 MIT 授權的 MoE LLM,涵蓋 128K-200K 上下文。GLM-5.1 在 SWE-bench Pro 中領先開放權重模型。透過 RunAPI,這些模型共用單一 API 金鑰、按用量 token 計費,並可從 OpenAI Chat Completions、OpenAI Responses 與 Anthropic Messages 介面呼叫。
公開版本與端點
| 模型 ID | 版本 | 端點 | 起始價格 | 模型目錄 |
|---|---|---|---|---|
glm-4.5 | 355B / 啟用 32B;128K 上下文;旗艦開放權重 MoE baseline | /v1/chat/completions | $0.0004 | 模型詳情 |
glm-4.5-air | 較輕量的 GLM-4.5 層級,適合快速、低成本日常工作 | /v1/chat/completions | $0.0001 | 模型詳情 |
glm-4.6 | 200K 上下文;首個運行於 Cambricon 晶片的 GLM;更銳利的程式碼生成 | /v1/chat/completions | $0.0006 | 模型詳情 |
glm-4.7 | 200K 上下文;73.8% SWE-bench;跨輪次持續 thinking | /v1/chat/completions | $0.0006 | 模型詳情 |
glm-5 | 744B / 啟用 40B;200K 上下文;77.8% SWE-bench Verified | /v1/chat/completions | $0.0010 | 模型詳情 |
glm-5-turbo | 為速度最佳化的 GLM-5 層級,降低延遲 | /v1/chat/completions | $0.0012 | 模型詳情 |
glm-5.1 | 754B / 啟用 40B;58.4% SWE-bench Pro;開放權重最高分 | /v1/chat/completions | $0.0014 | 模型詳情 |
glm-5.2 | 當前旗艦基礎模型,專為文字生成打造 | /v1/chat/completions | $0.0007 | 模型詳情 |
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。驗證
選擇 <model-id> 後產生驗證命令。使用流程
- 1. 選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
- 2. 設定 RunAPI
為此 Agent 新增 Provider 設定。
- 3. 驗證結果
執行下方 Agent 狀態與模型選擇命令。
常見問題
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。
本指南會設定聊天模型嗎?
會。此 Model Line 支援面向用戶端的 LLM 協定。