It looks like you may prefer a different language. Switch anytime.

Z.ai · Text

Hermes Agent x GLM

Z.ai 的 GLM 模型是 MIT 开源的 MoE 大语言模型,上下文 128K–200K。GLM-5.1 在 SWE-bench Pro 上领跑开放权重。通过 RunAPI 共用一个 API key、按量计费,可用 OpenAI Chat Completions、OpenAI Responses 与 Anthropic Messages 接口调用。

9 variants 起价 $0.0001 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任务匹配时使用 glm-4.5:355B / 32B 激活;128K 上下文;开放权重 MoE 旗舰基线。

You have access to RunAPI chat models for GLM.

Available GLM models:
- glm-4.5: 355B / 32B 激活;128K 上下文;开放权重 MoE 旗舰基线
  chat endpoints: /v1/chat/completions
- glm-4.5-air: 更轻量的 GLM-4.5,低成本日常任务首选
  chat endpoints: /v1/chat/completions
- glm-4.6: 200K 上下文;首款昇腾芯片 GLM;代码生成增强
  chat endpoints: /v1/chat/completions
- glm-4.7: 200K 上下文;SWE-bench 73.8%;跨轮次持续思考
  chat endpoints: /v1/chat/completions
- glm-5: 744B / 40B 激活;200K 上下文;SWE-bench Verified 77.8%
  chat endpoints: /v1/chat/completions
- glm-5-turbo: GLM-5 速度优化档位,更低延迟
  chat endpoints: /v1/chat/completions
- glm-5.1: 754B / 40B 激活;SWE-bench Pro 58.4% — 开放权重最高分
  chat endpoints: /v1/chat/completions
- glm-5.2: 当前旗舰基础模型,面向文本生成
  chat endpoints: /v1/chat/completions
- glm-5.3: 最新 GLM 文本模型,支持 OpenAI 兼容 Chat Completions
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 阅读这个多文件仓库,找出失败的集成测试,并给出补丁及根因说明。
Verify the active model with: hermes model;hermes doctor

公开版本与端点

模型 ID 端点 起步价格 模型目录
glm-4.5
/v1/chat/completions
$0.0004 模型详情
glm-4.5-air
/v1/chat/completions
$0.0001 模型详情
glm-4.6
/v1/chat/completions
$0.0006 模型详情
glm-4.7
/v1/chat/completions
$0.0006 模型详情
glm-5
/v1/chat/completions
$0.0010 模型详情
glm-5-turbo
/v1/chat/completions
$0.0012 模型详情
glm-5.1
/v1/chat/completions
$0.0014 模型详情
glm-5.2
/v1/chat/completions
$0.0007 模型详情
glm-5.3
/v1/chat/completions
$0.0014 模型详情

验证

轮询,直到 Task 进入终态

选择 <model-id> 后生成验证命令。

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。
使用流程

三步开始使用

  1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 配置 RunAPI

    为该 Agent 添加 Provider 配置。

  3. 验证结果

    运行下方 Agent 状态与模型选择命令。

使用 Hermes Agent + GLM 可以构建什么

  • 产品演示视频

    根据文字描述生成 5 至 10 秒的产品动画,适合电商展示和社交广告。

  • AI 数字人内容

    创建带口型同步的数字人视频,用于培训材料、客户支持和营销内容。

  • 批量视频制作

    排队生成数百个视频,并通过 webhook 接收结果。

为什么通过 RunAPI + Hermes Agent 使用 GLM

  • 9 个变体,一个 API 密钥

    通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。

  • 清晰的用量价格

    发送请求前查看目录中的当前价格,无需订阅或最低消费。

  • 自动化任务流程

    通过一致的任务流程提交任务、查询状态并收集异步结果,无需编写手动轮询代码。

Hermes Agent + GLM 常见问题

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

会。该 Model Line 支持面向客户端的 LLM 协议。

开始在 Hermes Agent 中使用 GLM

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们