Google · Tekst

Hermes Agent x Gemini

Gemini is het multimodale vlaggenschip-LLM van Google, beschikbaar in Flash- (snel) en Pro-varianten (frontier-redeneren). Via RunAPI delen alle Gemini-modellen dezelfde API-structuur en facturering.

11 variants vanaf $0.10 / 1M tokens Commercieel toegestaan

Prerequisite: npx runapi mcp install

Prompt

Promptmodellen

Gebruik gemini-2.5-flash wanneer het bij de taak past: Geoptimaliseerd voor snelheid/kosten; 1M context; referentie uit de vorige generatie.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Geoptimaliseerd voor snelheid/kosten; 1M context; referentie uit de vorige generatie
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; 1M context, thinking standaard uit; OpenAI-compatibele Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Beste redeneervermogen in de 2.5-generatie; 1M context
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; 1M context, instelbare thinking; tekstrequests via OpenAI-compatibele Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Snelle multimodale streaming voor productieworkloads met hoge volumes
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Lichtgewicht Gemini voor tekstgeneratie via Chat Completions of native contentstreaming
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Snelle multimodale chat, tools en streaming voor productieworkloads
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Snelle streamingchat en native contentuitvoer met gebruiksrapportage
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Tekstchat met functieaanroepen en native contentstreaming voor agentworkloads
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analyseer deze codebase en stel drie prestatieverbeteringen voor met voor/na-voorbeelden.
Verify the active model with: hermes model;hermes doctor

Openbare versies en endpoints

Model-ID Endpoints Vanafprijs Catalogus
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1M tokens Modeldetails
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1M tokens Modeldetails
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1M tokens Modeldetails
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1M tokens Modeldetails
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1M tokens Modeldetails
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1M tokens Modeldetails
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1M tokens Modeldetails
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1M tokens Modeldetails
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1M tokens Modeldetails
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1M tokens Modeldetails
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1M tokens Modeldetails

Verifiëren

Poll totdat de Task een eindstatus bereikt

Selecteer <model-id> om verificatieopdrachten te genereren.

Configuratie

Handleiding-endpoint: <endpoint>

Selecteer <model-id> om een aanvraag te genereren met het openbare invoercontract van het endpoint.
Zo werkt het

Start in 3 stappen

  1. Kies een model-ID

    Selecteer een openbare model-ID uit de catalogus en bekijk het endpoint en de actuele vanafprijs.

  2. Configureer RunAPI

    Voeg de providerconfiguratie voor deze agent toe.

  3. Verifieer het resultaat

    Voer de onderstaande status- en modelselectieopdrachten uit.

Wat je kunt bouwen met Hermes Agent + Gemini

  • Multimodale agents

    Gebruik de multimodale invoer van Gemini om Hermes Agent-workflows te bouwen die tegelijk over tekst, afbeeldingen, audio en video redeneren.

  • Analyse van lange documenten

    Geef Gemini grote codebases, contracten of onderzoekscollecties in één verzoek en laat Hermes Agent vervolgvragen stellen over hetzelfde materiaal.

  • Kostenefficiënte ketens van toolaanroepen

    Gebruik een Flash-versie van Gemini voor snelle, goedkope toolloops waarin de agent veel aanroepen na elkaar doet.

Waarom Gemini gebruiken via RunAPI + Hermes Agent

  • 11 varianten, één API-sleutel

    Gebruik één RunAPI-verbinding om beschikbare modelvarianten te kiezen zonder je integratie aan te passen.

  • Duidelijke gebruiksprijzen

    Bekijk de actuele catalogusprijzen voordat je een aanvraag verstuurt, zonder abonnement of minimale besteding.

  • Directe antwoorden

    Synchrone aanroepen geven het resultaat in hetzelfde antwoord terug, zodat je agent het direct kan gebruiken zonder de taakstatus op te vragen.

Vragen over Hermes Agent + Gemini

Kan ik Gemini in Hermes Agent gebruiken zonder Google Cloud-inloggegevens?

Ja. RunAPI levert Gemini via zijn OpenAI-compatibele endpoint. Stel RunAPI in als provider in Hermes Agent met je RunAPI API-sleutel; een Google Cloud-project of Vertex AI-configuratie is niet nodig.

Hoe helpt contextcaching bij lange documenten?

Wanneer dezelfde grote context in veel verzoeken wordt meegestuurd, verlaagt caching de invoerkosten van latere aanroepen. Dat helpt bij agentloops waarin instructies en referentiemateriaal terugkomen.

Kan Hermes Agent tijdens een sessie wisselen tussen Gemini en andere modellen?

Ja. Alle taalmodellen van RunAPI delen dezelfde provider en API-sleutel, dus je kunt tijdens een sessie van model wisselen zonder de providerconfiguratie aan te passen.

Welke model-ID moet ik gebruiken?

Kies een openbare model-ID uit de versietabel. Elke ID biedt de endpoints die in de betreffende rij staan.

Configureert deze handleiding een chatmodel?

Ja. Deze modellijn ondersteunt een clientgericht LLM-protocol.

Aan de slag met Gemini en Hermes Agent

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op