Öffentliche Versionen und Endpunkte
| Modell-ID | Endpunkte | Startpreis | Katalog |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1 Mio. Tokens | Modelldetails |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1 Mio. Tokens | Modelldetails |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1 Mio. Tokens | Modelldetails |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1 Mio. Tokens | Modelldetails |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1 Mio. Tokens | Modelldetails |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1 Mio. Tokens | Modelldetails |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1 Mio. Tokens | Modelldetails |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1 Mio. Tokens | Modelldetails |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1 Mio. Tokens | Modelldetails |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1 Mio. Tokens | Modelldetails |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1 Mio. Tokens | Modelldetails |
Überprüfen
Frage den Status ab, bis die Task einen Endstatus erreicht
Wähle <model-id>, um Prüfkommandos zu erzeugen.
Konfiguration
Guide-Endpunkt: <endpoint>
Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
In 3 Schritten loslegen
-
Modell-ID auswählen
Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.
-
RunAPI konfigurieren
Füge die Provider-Konfiguration für diesen Agenten hinzu.
-
Ergebnis überprüfen
Führe die unten gezeigten Status- und Modellauswahlbefehle aus.
Was du mit Hermes Agent + Gemini bauen kannst
-
Multimodale Agenten
Nutze Geminis multimodale Eingaben, um Hermes-Agent-Workflows zu bauen, die Text, Bilder, Audio und Video gemeinsam auswerten.
-
Analyse langer Dokumente
Gib Gemini große Codebasen, Verträge oder Forschungssammlungen in einer Anfrage und lass Hermes Agent Folgefragen zum selben Material stellen.
-
Kosteneffiziente Tool-Aufrufketten
Setze eine Flash-Version von Gemini für schnelle, günstige Tool-Schleifen ein, in denen der Agent viele Aufrufe nacheinander ausführt.
Warum Gemini über RunAPI + Hermes Agent nutzen
-
11 Varianten, ein API-Schlüssel
Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.
-
Klare Nutzungspreise
Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.
-
Direkte Antworten
Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.
Fragen zu Hermes Agent + Gemini
Kann ich Gemini in Hermes Agent ohne Google-Cloud-Zugangsdaten nutzen?
Ja. RunAPI stellt Gemini über seinen OpenAI-kompatiblen Endpunkt bereit. Richte RunAPI mit deinem RunAPI-API-Schlüssel als Provider in Hermes Agent ein; ein Google-Cloud-Projekt oder Vertex-AI-Setup ist nicht nötig.
Wie hilft Context Caching bei langen Dokumenten?
Wenn derselbe große Kontext in vielen Anfragen gesendet wird, senkt Caching die Eingabekosten späterer Aufrufe. Das hilft bei Agent-Schleifen, in denen sich Anweisungen und Referenzmaterial wiederholen.
Kann Hermes Agent während einer Sitzung zwischen Gemini und anderen Modellen wechseln?
Ja. Alle Sprachmodelle von RunAPI nutzen denselben Provider und API-Schlüssel, daher kannst du das Modell während einer Sitzung wechseln, ohne die Provider-Konfiguration zu ändern.
Welche Modell-ID soll ich verwenden?
Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.
Konfiguriert diese Anleitung ein Chatmodell?
Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.