Google · 文本

Hermes Agent x Gemini

Gemini 是 Google 的旗舰多模态 LLM,提供 Flash(快速)和 Pro(旗舰推理)变体。通过 RunAPI,所有 Gemini 模型共享相同的 API 接口和计费。

11 variants 起价 $0.10 / 百万 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任务匹配时使用 gemini-2.5-flash:速度/成本优化;100 万上下文;稳定基线。

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: 速度/成本优化;100 万上下文;稳定基线
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite;100 万上下文,默认关闭思考;OpenAI 兼容 Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: 2.5 代最强推理;100 万上下文
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite;100 万上下文,可调思考;通过 OpenAI 兼容 Chat Completions 发送文本请求
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: 面向高并发生产场景的快速多模态流式输出
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: 轻量级 Gemini,支持 Chat Completions 与原生内容流式文本生成
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: 面向生产工作流的快速多模态对话、工具调用与流式输出
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: 支持用量回传的快速流式对话与原生内容输出
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: 支持函数调用与原生内容流式输出的文本对话,适合 Agent 工作负载
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: 分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。
Verify the active model with: hermes model;hermes doctor

公开版本与端点

模型 ID 端点 起步价格 模型目录
gemini-2.5-flash
/v1/chat/completions
$0.30 / 百万 tokens 模型详情
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 百万 tokens 模型详情
gemini-2.5-pro
/v1/chat/completions
$1.25 / 百万 tokens 模型详情
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 百万 tokens 模型详情
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 百万 tokens 模型详情
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 百万 tokens 模型详情
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 百万 tokens 模型详情
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 百万 tokens 模型详情
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 百万 tokens 模型详情
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 百万 tokens 模型详情
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 百万 tokens 模型详情

验证

轮询,直到 Task 进入终态

选择 <model-id> 后生成验证命令。

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。
使用流程

三步开始使用

  1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 配置 RunAPI

    为该 Agent 添加 Provider 配置。

  3. 验证结果

    运行下方 Agent 状态与模型选择命令。

使用 Hermes Agent + Gemini 可以构建什么

  • 多模态 Agent

    利用 Gemini 的多模态输入,构建能同时基于文字、图片、音频和视频进行推理的 Hermes Agent 工作流。

  • 长文档分析

    在一次请求中把大型代码库、合同或研究资料交给 Gemini,再让 Hermes Agent 针对同一材料继续追问。

  • 低成本的工具调用链

    在需要连续多次调用的工具循环中使用 Gemini 的 Flash 版本,速度快、成本低。

为什么通过 RunAPI + Hermes Agent 使用 Gemini

  • 11 个变体,一个 API 密钥

    通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。

  • 清晰的用量价格

    发送请求前查看目录中的当前价格,无需订阅或最低消费。

  • 直接返回结果

    同步调用在同一个响应中返回结果,Agent 无需轮询任务即可直接使用。

Hermes Agent + Gemini 常见问题

在 Hermes Agent 中使用 Gemini 需要 Google Cloud 凭据吗?

不需要。RunAPI 通过兼容 OpenAI 的端点提供 Gemini。用你的 RunAPI API 密钥在 Hermes Agent 中把 RunAPI 配置为提供方即可,无需 Google Cloud 项目或 Vertex AI 配置。

上下文缓存对长文档有什么帮助?

当同一段大上下文在多个请求中重复发送时,缓存可以降低后续调用的输入成本,适合指令和参考资料反复出现的 Agent 循环。

Hermes Agent 能在会话中途在 Gemini 和其他模型之间切换吗?

可以。RunAPI 的所有语言模型共用同一个提供方和 API 密钥,会话中切换模型无需修改提供方配置。

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

会。该 Model Line 支持面向客户端的 LLM 协议。

开始在 Hermes Agent 中使用 Gemini

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们