Google · 文字

Hermes Agent x Gemini

Gemini 是 Google 的旗艦多模態 LLM,提供 Flash(快速)及 Pro(前沿推理)變體。透過 RunAPI,所有 Gemini 模型共用相同的 API 結構及計費方式。

11 variants 由 $0.10 / 百萬 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 gemini-2.5-flash:針對速度/成本優化;1M 上下文;舊世代基準。

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: 針對速度/成本優化;1M 上下文;舊世代基準
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite;100 萬上下文,預設關閉思考;OpenAI 相容 Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: 2.5 世代中推理能力最強;1M 上下文
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite;100 萬上下文,可調思考;透過 OpenAI 相容 Chat Completions 傳送文字請求
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: 快速多模態串流,適用於大量正式環境工作負載
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: 輕量級 Gemini,支援 Chat Completions 與原生內容串流文字生成
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: 面向正式環境工作流程的快速多模態對話、工具調用與串流輸出
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: 支援用量回報的快速串流對話與原生內容輸出
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: 支援函數呼叫與原生內容串流輸出的文字對話,適合 Agent 工作負載
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: 分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。
Verify the active model with: hermes model;hermes doctor

公開版本與端點

模型 ID 端點 起始價格 模型目錄
gemini-2.5-flash
/v1/chat/completions
$0.30 / 百萬 tokens 模型詳情
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 百萬 tokens 模型詳情
gemini-2.5-pro
/v1/chat/completions
$1.25 / 百萬 tokens 模型詳情
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 百萬 tokens 模型詳情
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 百萬 tokens 模型詳情
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 百萬 tokens 模型詳情
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 百萬 tokens 模型詳情
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 百萬 tokens 模型詳情
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 百萬 tokens 模型詳情
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 百萬 tokens 模型詳情
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 百萬 tokens 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    為此 Agent 新增 Provider 設定。

  3. 驗證結果

    執行下方 Agent 狀態與模型選擇命令。

使用 Hermes Agent + Gemini 可以建立甚麼

  • 多模態 Agent

    利用 Gemini 的多模態輸入,建立能同時根據文字、圖片、音訊和影片進行推理的 Hermes Agent 工作流程。

  • 長文件分析

    在一次請求中把大型代碼庫、合約或研究數據交給 Gemini,再讓 Hermes Agent 針對同一份數據繼續追問。

  • 低成本的工具調用鏈

    在需要連續多次調用的工具循環中使用 Gemini 的 Flash 版本,速度快、成本低。

為甚麼透過 RunAPI + Hermes Agent 使用 Gemini

  • 11 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 直接返回結果

    同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。

Hermes Agent + Gemini 常見問題

在 Hermes Agent 中使用 Gemini 需要 Google Cloud 憑證嗎?

不需要。RunAPI 透過相容 OpenAI 的端點提供 Gemini。用你的 RunAPI API 金鑰在 Hermes Agent 中將 RunAPI 設定為供應商即可,不需要 Google Cloud 項目或 Vertex AI 設定。

上下文緩存對長文件有什麼幫助?

當同一段大型上下文在多個請求中重複傳送時,緩存可以降低後續調用的輸入成本,適合指令和參考數據反覆出現的 Agent 循環。

Hermes Agent 能在會話中途於 Gemini 和其他模型之間切換嗎?

可以。RunAPI 的所有語言模型共用同一個供應商和 API 金鑰,在會話中切換模型不必修改供應商設定。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

會。此 Model Line 支援面向用戶端的 LLM 協定。

透過 Hermes Agent 開始使用 Gemini

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們