公開バージョンとエンドポイント
| モデル ID | エンドポイント | 開始価格 | モデルカタログ |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 100万トークン | モデル詳細 |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 100万トークン | モデル詳細 |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 100万トークン | モデル詳細 |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 100万トークン | モデル詳細 |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 100万トークン | モデル詳細 |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 100万トークン | モデル詳細 |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 100万トークン | モデル詳細 |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 100万トークン | モデル詳細 |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 100万トークン | モデル詳細 |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 100万トークン | モデル詳細 |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 100万トークン | モデル詳細 |
検証
Task が終端状態になるまでポーリングします
<model-id> を選択すると検証コマンドが生成されます。
設定
ガイドエンドポイント: <endpoint>
<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
3ステップで始める
-
モデル ID を選択
公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。
-
RunAPI を設定
この Agent の Provider 設定を追加します。
-
結果を検証
以下の Agent ステータスおよびモデル選択コマンドを実行します。
Hermes Agent + Gemini で作れるもの
-
マルチモーダルエージェント
Gemini のマルチモーダル入力を生かし、テキスト、画像、音声、動画をまとめて推論する Hermes Agent のワークフローを構築します。
-
長い文書の分析
大規模なコードベース、契約書、研究資料を 1 回のリクエストで Gemini に渡し、同じ資料について Hermes Agent に追加の質問をさせます。
-
コスト効率の良いツール呼び出しチェーン
エージェントが何度も連続して呼び出すツールループで、高速かつ低コストな Gemini の Flash バージョンを使います。
Gemini を RunAPI + Hermes Agent で使う理由
-
11 個のバリアントを 1 つの API キーで
RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。
-
わかりやすい利用料金
リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。
-
直接のレスポンス
同期呼び出しは同じレスポンスで結果を返すため、エージェントはタスクをポーリングせずにすぐ結果を使えます。
Hermes Agent + Gemini に関するよくある質問
Google Cloud の認証情報なしで Hermes Agent から Gemini を使えますか?
はい。RunAPI は OpenAI 互換のエンドポイントで Gemini を提供しています。RunAPI API キーで RunAPI を Hermes Agent のプロバイダーとして設定するだけで、Google Cloud のプロジェクトや Vertex AI の設定は不要です。
コンテキストキャッシュは長い文書でどう役立ちますか?
同じ大きなコンテキストを多くのリクエストで送る場合、キャッシュによって後続の呼び出しの入力コストが下がります。指示や参照資料が繰り返されるエージェントループで効果があります。
Hermes Agent はセッションの途中で Gemini とほかのモデルを切り替えられますか?
はい。RunAPI の言語モデルはすべて同じプロバイダーと API キーを共有しているため、プロバイダーの設定を変えずにセッション中にモデルを切り替えられます。
どのモデル ID を使うべきですか?
バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。
このガイドはチャットモデルを設定しますか?
はい。この Model Line はクライアント向け LLM プロトコルをサポートします。