Z.ai · Text
Hermes Agent x GLM
Z.ai 的 GLM 模型是 MIT 开源的 MoE 大语言模型,上下文 128K–200K。GLM-5.1 在 SWE-bench Pro 上领跑开放权重。通过 RunAPI 共用一个 API key、按量计费,可用 OpenAI Chat Completions、OpenAI Responses 与 Anthropic Messages 接口调用。
公开版本与端点
| 模型 ID | 版本 | 端点 | 起步价格 | 模型目录 |
|---|---|---|---|---|
glm-4.5 | 355B / 32B 激活;128K 上下文;开放权重 MoE 旗舰基线 | /v1/chat/completions | $0.0004 | 模型详情 |
glm-4.5-air | 更轻量的 GLM-4.5,低成本日常任务首选 | /v1/chat/completions | $0.0001 | 模型详情 |
glm-4.6 | 200K 上下文;首款昇腾芯片 GLM;代码生成增强 | /v1/chat/completions | $0.0006 | 模型详情 |
glm-4.7 | 200K 上下文;SWE-bench 73.8%;跨轮次持续思考 | /v1/chat/completions | $0.0006 | 模型详情 |
glm-5 | 744B / 40B 激活;200K 上下文;SWE-bench Verified 77.8% | /v1/chat/completions | $0.0010 | 模型详情 |
glm-5-turbo | GLM-5 速度优化档位,更低延迟 | /v1/chat/completions | $0.0012 | 模型详情 |
glm-5.1 | 754B / 40B 激活;SWE-bench Pro 58.4% — 开放权重最高分 | /v1/chat/completions | $0.0014 | 模型详情 |
glm-5.2 | 当前旗舰基础模型,面向文本生成 | /v1/chat/completions | $0.0007 | 模型详情 |
配置
指南端点: <endpoint>
选择 <model-id> 后,按端点的公开输入契约生成请求。验证
选择 <model-id> 后生成验证命令。使用流程
- 1. 选择模型 ID
选择公开模型 ID,并查看其端点与当前起步价格。
- 2. 配置 RunAPI
为该 Agent 添加 Provider 配置。
- 3. 验证结果
运行下方 Agent 状态与模型选择命令。
常见问题
应该使用哪个模型 ID?
从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。
本指南会配置聊天模型吗?
会。该 Model Line 支持面向客户端的 LLM 协议。