公開版本與端點
| 模型 ID | 端點 | 起始價格 | 模型目錄 |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 百萬 tokens | 模型詳情 |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 百萬 tokens | 模型詳情 |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 百萬 tokens | 模型詳情 |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 百萬 tokens | 模型詳情 |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 百萬 tokens | 模型詳情 |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 百萬 tokens | 模型詳情 |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 百萬 tokens | 模型詳情 |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 百萬 tokens | 模型詳情 |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 百萬 tokens | 模型詳情 |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 百萬 tokens | 模型詳情 |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 百萬 tokens | 模型詳情 |
驗證
輪詢,直到 Task 進入終態
選擇 <model-id> 後產生驗證命令。
設定
指南端點: <endpoint>
選擇 <model-id> 後,依端點的公開輸入契約產生請求。
三步開始使用
-
選擇模型 ID
選擇公開模型 ID,並查看其端點與目前起始價格。
-
設定 RunAPI
為此 Agent 新增 Provider 設定。
-
驗證結果
執行下方 Agent 狀態與模型選擇命令。
使用 Hermes Agent + Gemini 可以打造什麼
-
多模態 Agent
利用 Gemini 的多模態輸入,建立能同時根據文字、圖片、音訊和影片進行推理的 Hermes Agent 工作流程。
-
長文件分析
在一次請求中把大型程式碼庫、合約或研究資料交給 Gemini,再讓 Hermes Agent 針對同一份資料繼續追問。
-
低成本的工具呼叫鏈
在需要連續多次呼叫的工具迴圈中使用 Gemini 的 Flash 版本,速度快、成本低。
為什麼透過 RunAPI + Hermes Agent 使用 Gemini
-
11 個變體,一個 API 金鑰
透過一個 RunAPI 連線選擇可用的模型變體,無需變更現有整合。
-
清楚的用量價格
送出請求前查看目錄中的目前價格,無需訂閱或最低消費。
-
直接回傳結果
同步呼叫會在同一個回應中回傳結果,Agent 不需輪詢工作即可直接使用。
Hermes Agent + Gemini 常見問題
在 Hermes Agent 中使用 Gemini 需要 Google Cloud 憑證嗎?
不需要。RunAPI 透過相容 OpenAI 的端點提供 Gemini。用你的 RunAPI API 金鑰在 Hermes Agent 中將 RunAPI 設定為提供者即可,不需要 Google Cloud 專案或 Vertex AI 設定。
脈絡快取對長文件有什麼幫助?
當同一段大型脈絡在多個請求中重複傳送時,快取可以降低後續呼叫的輸入成本,適合指令和參考資料反覆出現的 Agent 迴圈。
Hermes Agent 能在工作階段中途於 Gemini 和其他模型之間切換嗎?
可以。RunAPI 的所有語言模型共用同一個提供者和 API 金鑰,在工作階段中切換模型不必修改提供者設定。
應該使用哪個模型 ID?
從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。
本指南會設定聊天模型嗎?
會。此 Model Line 支援面向用戶端的 LLM 協定。