公开版本与端点
| 模型 ID | 端点 | 起步价格 | 模型目录 |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 百万 tokens | 模型详情 |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 百万 tokens | 模型详情 |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 百万 tokens | 模型详情 |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 百万 tokens | 模型详情 |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 百万 tokens | 模型详情 |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 百万 tokens | 模型详情 |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 百万 tokens | 模型详情 |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 百万 tokens | 模型详情 |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 百万 tokens | 模型详情 |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 百万 tokens | 模型详情 |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 百万 tokens | 模型详情 |
验证
轮询,直到 Task 进入终态
选择 <model-id> 后生成验证命令。
配置
指南端点: <endpoint>
选择 <model-id> 后,按端点的公开输入契约生成请求。
三步开始使用
-
选择模型 ID
选择公开模型 ID,并查看其端点与当前起步价格。
-
配置 RunAPI
为该 Agent 添加 Provider 配置。
-
验证结果
运行下方 Agent 状态与模型选择命令。
使用 Hermes Agent + Gemini 可以构建什么
-
多模态 Agent
利用 Gemini 的多模态输入,构建能同时基于文字、图片、音频和视频进行推理的 Hermes Agent 工作流。
-
长文档分析
在一次请求中把大型代码库、合同或研究资料交给 Gemini,再让 Hermes Agent 针对同一材料继续追问。
-
低成本的工具调用链
在需要连续多次调用的工具循环中使用 Gemini 的 Flash 版本,速度快、成本低。
为什么通过 RunAPI + Hermes Agent 使用 Gemini
-
11 个变体,一个 API 密钥
通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。
-
清晰的用量价格
发送请求前查看目录中的当前价格,无需订阅或最低消费。
-
直接返回结果
同步调用在同一个响应中返回结果,Agent 无需轮询任务即可直接使用。
Hermes Agent + Gemini 常见问题
在 Hermes Agent 中使用 Gemini 需要 Google Cloud 凭据吗?
不需要。RunAPI 通过兼容 OpenAI 的端点提供 Gemini。用你的 RunAPI API 密钥在 Hermes Agent 中把 RunAPI 配置为提供方即可,无需 Google Cloud 项目或 Vertex AI 配置。
上下文缓存对长文档有什么帮助?
当同一段大上下文在多个请求中重复发送时,缓存可以降低后续调用的输入成本,适合指令和参考资料反复出现的 Agent 循环。
Hermes Agent 能在会话中途在 Gemini 和其他模型之间切换吗?
可以。RunAPI 的所有语言模型共用同一个提供方和 API 密钥,会话中切换模型无需修改提供方配置。
应该使用哪个模型 ID?
从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。
本指南会配置聊天模型吗?
会。该 Model Line 支持面向客户端的 LLM 协议。