OpenAI · Text

Hermes Agent x GPT

GPT ist OpenAIs Frontier-LLM-Familie mit Standard- und Mini-Varianten für unterschiedliche Kosten-Performance-Abwägungen. Über RunAPI teilen alle GPT-Modelle dieselbe API-Form und Abrechnung.

15 variants ab $0.06 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende codex-auto-review, wenn es zur Aufgabe passt: codex-auto-review.

You have access to RunAPI chat models for GPT.

Available GPT models:
- codex-auto-review: codex-auto-review
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-4o-mini: Schnelles, kostengünstiges GPT-4o-Modell für alltägliche Textaufgaben
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5-pro: GPT-5 Pro für Analyse und Programmierung über die Responses API
  chat endpoints: /v1/responses
- gpt-5.2: Professionelle Wissensarbeit; Thinking-Modus für anspruchsvolle Aufgaben
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4: Bestes Coding + Agenten-Workflows; branchenführender Code-Benchmark
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4-mini: Kostengünstiger Ersatz für gpt-5.4; für Free-Tier verfügbar
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.4-nano: gpt-5.4-nano
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.5: Speziell für langfristige Agenten-Aufgaben; beste Fehlerkorrektur
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-luna: Schnellste, leichteste GPT-5.6-Stufe für Zusammenfassungen, Entwürfe und tägliche Automatisierung
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.6-sol: Flaggschiff für die schwierigsten Aufgaben: komplexes Coding, Tiefenrecherche, langfristige Agenten
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-terra: Ausgewogener Allrounder für hohes Volumen; nahezu Flaggschiff-Qualität, kosteneffizient
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-6-astra: Leistungsstärkstes Modell: Frontier-Reasoning, 1M Kontext, Code-Generierung und agentische Aufgaben
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-luna: Schnellstes, leichtestes GPT-6-Modell: 1M Kontext für Zusammenfassungen, Entwürfe und Alltagsautomatisierung
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-sol: Kosteneffizientes GPT-6-Modell: starkes Reasoning, 1M Kontext, Coding und agentische Aufgaben
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6.1-sol: Kosteneffizientes GPT-6-Modell: starkes Reasoning, 1M Kontext, Coding und agentische Aufgaben
  chat endpoints: /v1/chat/completions, /v1/responses

Use the model ID and chat endpoint that match the user's request.
Example request: Analysiere diese Quartalsumsatzdaten und erstelle eine Zusammenfassung mit Schlüsseltrends, Anomalien und drei Empfehlungen.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
codex-auto-review
/v1/chat/completions /v1/responses
$0.20 / 1 Mio. Tokens Modelldetails
gpt-4o-mini
/v1/chat/completions /v1/responses
$0.15 / 1 Mio. Tokens Modelldetails
gpt-5-pro
/v1/responses
$7.50 / 1 Mio. Tokens Modelldetails
gpt-5.2
/v1/responses /v1/chat/completions
$1.75 / 1 Mio. Tokens Modelldetails
gpt-5.4
/v1/responses /v1/chat/completions
$2.50 / 1 Mio. Tokens Modelldetails
gpt-5.4-mini
/v1/chat/completions /v1/responses
$0.75 / 1 Mio. Tokens Modelldetails
gpt-5.4-nano
/v1/responses /v1/chat/completions
$0.20 / 1 Mio. Tokens Modelldetails
gpt-5.5
/v1/chat/completions /v1/responses
$5.00 / 1 Mio. Tokens Modelldetails
gpt-5.6-luna
/v1/responses /v1/chat/completions
$0.20 / 1 Mio. Tokens Modelldetails
gpt-5.6-sol
/v1/chat/completions /v1/responses
$5.00 / 1 Mio. Tokens Modelldetails
gpt-5.6-terra
/v1/responses /v1/chat/completions
$2.00 / 1 Mio. Tokens Modelldetails
gpt-6-astra
/v1/chat/completions /v1/responses
$5.00 / 1 Mio. Tokens Modelldetails
gpt-6-luna
/v1/chat/completions /v1/responses
$0.06 / 1 Mio. Tokens Modelldetails
gpt-6-sol
/v1/chat/completions /v1/responses
$1.20 / 1 Mio. Tokens Modelldetails
gpt-6.1-sol
/v1/chat/completions /v1/responses
$1.00 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + GPT bauen kannst

  • Komplexes Reasoning und mehrstufige Aufgaben

    Nutze GPT über Hermes Agent für komplexes Reasoning, Refactoring und mehrstufige automatisierte Workflows.

  • Batch-Verarbeitung mit strukturierten Ausgaben

    Verarbeite große Dokumentbestände mit schemagebundenem JSON für RAG-Pipelines, Rechnungsauslese oder Inhaltsklassifizierung.

  • Modell-Routing nach Aufgabenkomplexität

    Schicke einfache Anfragen an eine kleinere GPT-Version und schwierigeres Reasoning an eine größere, alles über denselben RunAPI-Provider und Schlüssel.

Warum GPT über RunAPI + Hermes Agent nutzen

  • 15 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Direkte Antworten

    Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.

Fragen zu Hermes Agent + GPT

Kann ich GPT in Hermes Agent über RunAPI verwenden?

Ja. Hermes Agent unterstützt eigene OpenAI-kompatible Provider. Füge RunAPI mit der auf dieser Seite gezeigten Konfiguration hinzu und setze eine GPT-Version aus der Versionsliste als Modell.

Funktioniert die Responses API über RunAPI in Hermes Agent?

RunAPI unterstützt für GPT sowohl die Chat Completions API als auch die Responses API. Hermes Agent kann beide mit demselben API-Schlüssel nutzen.

Kann Hermes Agent pro Anfrage zwischen GPT-Versionen wechseln?

Ja. Ändere nur das Modellfeld. Provider, Base-URL und API-Schlüssel bleiben gleich.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

GPT mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen