Google · テキスト

Hermes Agent x Gemini

GeminiはGoogleのフラッグシップマルチモーダルLLMで、Flash(高速)とPro(最上位推論)バリアントがあります。RunAPI経由では、すべてのGeminiモデルが同じAPIの形式と課金を共有します。

11 variants から $0.10 / 100万トークン 商用利用対応

Prerequisite: npx runapi mcp install

Prompt

プロンプトモデル

タスクに合う場合は gemini-2.5-flash を使用してください: 速度/コスト最適化、1Mコンテキスト、以前世代のベースライン。

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: 速度/コスト最適化、1Mコンテキスト、以前世代のベースライン
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite;1Mコンテキスト、思考は既定でオフ;OpenAI互換Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: 2.5世代最高の推論、1Mコンテキスト
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite;1Mコンテキスト、調整可能な思考;OpenAI互換Chat Completionsでテキストを送信
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: 大量制作ワークロード向け高速マルチモーダルストリーミング
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Chat Completions またはネイティブコンテンツストリーミングでテキストを生成する軽量 Gemini
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: 本番ワークロード向けの高速マルチモーダルチャット、ツール、ストリーミング
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: 使用量レポート対応の高速ストリーミングチャットとネイティブコンテンツ出力
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: 関数呼び出しとネイティブコンテンツストリーミングに対応したエージェント向けテキストチャット
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: このコードベースを分析し、Before/Afterの例を示しながら3つのパフォーマンス改善案を提案してください。
Verify the active model with: hermes model;hermes doctor

公開バージョンとエンドポイント

モデル ID エンドポイント 開始価格 モデルカタログ
gemini-2.5-flash
/v1/chat/completions
$0.30 / 100万トークン モデル詳細
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 100万トークン モデル詳細
gemini-2.5-pro
/v1/chat/completions
$1.25 / 100万トークン モデル詳細
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 100万トークン モデル詳細
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 100万トークン モデル詳細
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 100万トークン モデル詳細
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 100万トークン モデル詳細
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 100万トークン モデル詳細
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 100万トークン モデル詳細
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 100万トークン モデル詳細
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 100万トークン モデル詳細

検証

Task が終端状態になるまでポーリングします

<model-id> を選択すると検証コマンドが生成されます。

設定

ガイドエンドポイント: <endpoint>

<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
利用手順

3ステップで始める

  1. モデル ID を選択

    公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。

  2. RunAPI を設定

    この Agent の Provider 設定を追加します。

  3. 結果を検証

    以下の Agent ステータスおよびモデル選択コマンドを実行します。

Hermes Agent + Gemini で作れるもの

  • マルチモーダルエージェント

    Gemini のマルチモーダル入力を生かし、テキスト、画像、音声、動画をまとめて推論する Hermes Agent のワークフローを構築します。

  • 長い文書の分析

    大規模なコードベース、契約書、研究資料を 1 回のリクエストで Gemini に渡し、同じ資料について Hermes Agent に追加の質問をさせます。

  • コスト効率の良いツール呼び出しチェーン

    エージェントが何度も連続して呼び出すツールループで、高速かつ低コストな Gemini の Flash バージョンを使います。

Gemini を RunAPI + Hermes Agent で使う理由

  • 11 個のバリアントを 1 つの API キーで

    RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。

  • わかりやすい利用料金

    リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。

  • 直接のレスポンス

    同期呼び出しは同じレスポンスで結果を返すため、エージェントはタスクをポーリングせずにすぐ結果を使えます。

Hermes Agent + Gemini に関するよくある質問

Google Cloud の認証情報なしで Hermes Agent から Gemini を使えますか?

はい。RunAPI は OpenAI 互換のエンドポイントで Gemini を提供しています。RunAPI API キーで RunAPI を Hermes Agent のプロバイダーとして設定するだけで、Google Cloud のプロジェクトや Vertex AI の設定は不要です。

コンテキストキャッシュは長い文書でどう役立ちますか?

同じ大きなコンテキストを多くのリクエストで送る場合、キャッシュによって後続の呼び出しの入力コストが下がります。指示や参照資料が繰り返されるエージェントループで効果があります。

Hermes Agent はセッションの途中で Gemini とほかのモデルを切り替えられますか?

はい。RunAPI の言語モデルはすべて同じプロバイダーと API キーを共有しているため、プロバイダーの設定を変えずにセッション中にモデルを切り替えられます。

どのモデル ID を使うべきですか?

バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。

このガイドはチャットモデルを設定しますか?

はい。この Model Line はクライアント向け LLM プロトコルをサポートします。

Hermes AgentでGeminiを使い始める

チームで構築していますか?

エンタープライズ導入、連携、技術的なご相談をお手伝いします。

お問い合わせ