Google · Text

Hermes Agent x Gemini

Gemini ist Googles multimodales Flagship-LLM, verfügbar in Flash (schnell) und Pro (Frontier-Reasoning). Über RunAPI teilen alle Gemini-Modelle dieselbe API-Form und Abrechnung.

11 variants ab $0.10 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende gemini-2.5-flash, wenn es zur Aufgabe passt: Geschwindigkeit/Kosten optimiert; 1M Kontext; ältere Generation als Baseline.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Geschwindigkeit/Kosten optimiert; 1M Kontext; ältere Generation als Baseline
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Bestes Reasoning der 2.5-Generation; 1M Kontext
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Schnelles multimodales Streaming für Hochvolumen-Produktionsworkloads
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Leichtgewichtiges Gemini zur Textgenerierung über Chat Completions oder natives Content-Streaming
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Schneller multimodaler Chat, Tools und Streaming für Produktionsworkloads
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Schneller Streaming-Chat und native Inhaltsausgabe mit Nutzungsberichten
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Textchat mit Funktionsaufrufen und nativem Content-Streaming für Agenten-Workloads
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1 Mio. Tokens Modelldetails
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1 Mio. Tokens Modelldetails
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1 Mio. Tokens Modelldetails
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1 Mio. Tokens Modelldetails
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1 Mio. Tokens Modelldetails
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1 Mio. Tokens Modelldetails
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1 Mio. Tokens Modelldetails
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1 Mio. Tokens Modelldetails
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1 Mio. Tokens Modelldetails
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1 Mio. Tokens Modelldetails
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + Gemini bauen kannst

  • Multimodale Agenten

    Nutze Geminis multimodale Eingaben, um Hermes-Agent-Workflows zu bauen, die Text, Bilder, Audio und Video gemeinsam auswerten.

  • Analyse langer Dokumente

    Gib Gemini große Codebasen, Verträge oder Forschungssammlungen in einer Anfrage und lass Hermes Agent Folgefragen zum selben Material stellen.

  • Kosteneffiziente Tool-Aufrufketten

    Setze eine Flash-Version von Gemini für schnelle, günstige Tool-Schleifen ein, in denen der Agent viele Aufrufe nacheinander ausführt.

Warum Gemini über RunAPI + Hermes Agent nutzen

  • 11 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Direkte Antworten

    Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.

Fragen zu Hermes Agent + Gemini

Kann ich Gemini in Hermes Agent ohne Google-Cloud-Zugangsdaten nutzen?

Ja. RunAPI stellt Gemini über seinen OpenAI-kompatiblen Endpunkt bereit. Richte RunAPI mit deinem RunAPI-API-Schlüssel als Provider in Hermes Agent ein; ein Google-Cloud-Projekt oder Vertex-AI-Setup ist nicht nötig.

Wie hilft Context Caching bei langen Dokumenten?

Wenn derselbe große Kontext in vielen Anfragen gesendet wird, senkt Caching die Eingabekosten späterer Aufrufe. Das hilft bei Agent-Schleifen, in denen sich Anweisungen und Referenzmaterial wiederholen.

Kann Hermes Agent während einer Sitzung zwischen Gemini und anderen Modellen wechseln?

Ja. Alle Sprachmodelle von RunAPI nutzen denselben Provider und API-Schlüssel, daher kannst du das Modell während einer Sitzung wechseln, ohne die Provider-Konfiguration zu ändern.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

Gemini mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen