Openbare versies en endpoints
| Model-ID | Endpoints | Vanafprijs | Catalogus |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1M tokens | Modeldetails |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1M tokens | Modeldetails |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1M tokens | Modeldetails |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1M tokens | Modeldetails |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1M tokens | Modeldetails |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1M tokens | Modeldetails |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1M tokens | Modeldetails |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1M tokens | Modeldetails |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1M tokens | Modeldetails |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1M tokens | Modeldetails |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1M tokens | Modeldetails |
Verifiëren
Poll totdat de Task een eindstatus bereikt
Selecteer <model-id> om verificatieopdrachten te genereren.
Configuratie
Handleiding-endpoint: <endpoint>
Selecteer <model-id> om een aanvraag te genereren met het openbare invoercontract van het endpoint.
Start in 3 stappen
-
Kies een model-ID
Selecteer een openbare model-ID uit de catalogus en bekijk het endpoint en de actuele vanafprijs.
-
Configureer RunAPI
Voeg de providerconfiguratie voor deze agent toe.
-
Verifieer het resultaat
Voer de onderstaande status- en modelselectieopdrachten uit.
Wat je kunt bouwen met Hermes Agent + Gemini
-
Multimodale agents
Gebruik de multimodale invoer van Gemini om Hermes Agent-workflows te bouwen die tegelijk over tekst, afbeeldingen, audio en video redeneren.
-
Analyse van lange documenten
Geef Gemini grote codebases, contracten of onderzoekscollecties in één verzoek en laat Hermes Agent vervolgvragen stellen over hetzelfde materiaal.
-
Kostenefficiënte ketens van toolaanroepen
Gebruik een Flash-versie van Gemini voor snelle, goedkope toolloops waarin de agent veel aanroepen na elkaar doet.
Waarom Gemini gebruiken via RunAPI + Hermes Agent
-
11 varianten, één API-sleutel
Gebruik één RunAPI-verbinding om beschikbare modelvarianten te kiezen zonder je integratie aan te passen.
-
Duidelijke gebruiksprijzen
Bekijk de actuele catalogusprijzen voordat je een aanvraag verstuurt, zonder abonnement of minimale besteding.
-
Directe antwoorden
Synchrone aanroepen geven het resultaat in hetzelfde antwoord terug, zodat je agent het direct kan gebruiken zonder de taakstatus op te vragen.
Vragen over Hermes Agent + Gemini
Kan ik Gemini in Hermes Agent gebruiken zonder Google Cloud-inloggegevens?
Ja. RunAPI levert Gemini via zijn OpenAI-compatibele endpoint. Stel RunAPI in als provider in Hermes Agent met je RunAPI API-sleutel; een Google Cloud-project of Vertex AI-configuratie is niet nodig.
Hoe helpt contextcaching bij lange documenten?
Wanneer dezelfde grote context in veel verzoeken wordt meegestuurd, verlaagt caching de invoerkosten van latere aanroepen. Dat helpt bij agentloops waarin instructies en referentiemateriaal terugkomen.
Kan Hermes Agent tijdens een sessie wisselen tussen Gemini en andere modellen?
Ja. Alle taalmodellen van RunAPI delen dezelfde provider en API-sleutel, dus je kunt tijdens een sessie van model wisselen zonder de providerconfiguratie aan te passen.
Welke model-ID moet ik gebruiken?
Kies een openbare model-ID uit de versietabel. Elke ID biedt de endpoints die in de betreffende rij staan.
Configureert deze handleiding een chatmodel?
Ja. Deze modellijn ondersteunt een clientgericht LLM-protocol.