OpenAI · Bild

Hermes Agent x GPT Image

GPT Image ist OpenAIs Bildgenerierungsmodell, das Text-zu-Bild und Bildbearbeitung unterstützt. Über RunAPI teilen alle GPT Image-Endpunkte einen gemeinsamen Key und Abrechnung pro Aufruf.

1 variants ab $0.12 / Aufruf Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende gpt-image-1.5, wenn es zur Aufgabe passt: Bildgenerierung und -bearbeitung mit starker kompositorischer Kontrolle.

You have access to RunAPI task tools for GPT Image.

Available GPT Image models:
- gpt-image-1.5: Bildgenerierung und -bearbeitung mit starker kompositorischer Kontrolle
  endpoints: /api/v1/gpt_image/edit_image, /api/v1/gpt_image/text_to_image
  request fields: model, prompt, aspect_ratio, quality

Use the model ID and endpoint that match the user's request.
Example prompt: Generiere eine Flat-Design-Illustration eines Teams, das gemeinsam an einem Whiteboard arbeitet, lebendige Farben, klare Linien.
/api/v1/gpt_image/edit_image: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/gpt_image/edit_image und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/gpt_image/edit_image/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/gpt_image/text_to_image: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/gpt_image/text_to_image und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/gpt_image/text_to_image/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
gpt-image-1.5
/api/v1/gpt_image/edit_image /api/v1/gpt_image/text_to_image
$0.12 / Aufruf Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Sende POST an /api/v1/gpt_image/text_to_image und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/gpt_image/text_to_image/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.

Konfiguration

Guide-Endpunkt: /api/v1/gpt_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-image-1.5",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1",
  "quality": "high"
}'
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Setze RUNAPI_API_KEY, bevor du die Endpunktanfrage sendest.

  3. Ergebnis überprüfen

    Frage bei asynchronen Endpunkten denselben Endpunkt ab, bis die Task einen Endstatus erreicht.

Was du mit Hermes Agent + GPT Image bauen kannst

  • Marketing- und Produktbilder

    Erzeuge Kampagnenbilder, Produktaufnahmen und Social-Creatives aus einem schriftlichen Briefing.

  • Kreative Varianten in Serie

    Erzeuge in einem Durchlauf viele Versionen eines Konzepts, um Stile, Layouts und Formate zu vergleichen.

  • Bearbeitung und Inpainting

    Überarbeite ein vorhandenes Bild, indem du Änderungen an Hintergrund, Objekten oder Details beschreibst, sofern das Modell Bearbeitungs-Endpunkte anbietet.

Warum GPT Image über RunAPI + Hermes Agent nutzen

  • 1 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Automatische Task-Workflows

    Sende Tasks, frage ihren Status ab und sammle asynchrone Ergebnisse in einem einheitlichen Ablauf ohne eigenen Polling-Code.

Fragen zu Hermes Agent + GPT Image

Welche Endpunkte unterstützt GPT Image?

Text-zu-Bild und Bildbearbeitung. Beide akzeptieren detaillierte Text-Prompts mit kompositionellen Anweisungen.

Wie funktioniert die kompositionelle Steuerung?

GPT Image folgt räumlichen Layout-Anweisungen in deinem Prompt — du kannst angeben, wo Objekte erscheinen, relative Größen und Anordnungen im Bildrahmen.

Welche Ausgabegrößen sind verfügbar?

3 feste Größen bis zu 1536 Pixel.

Wie unterscheidet sich GPT Image von GPT Image 2?

GPT Image 2 ist das neuere Modell mit nahezu perfektem mehrsprachigem Text-Rendering und bis zu 4K-Ausgabe. GPT Image ist die ältere Generation mit starker kompositioneller Steuerung.

Kann ich GPT Image zur Bildbearbeitung verwenden?

Ja — der Bildbearbeitungs-Endpunkt akzeptiert ein Quellbild und modifiziert es basierend auf deinem Text-Prompt als Bildbearbeitungstool.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Nein. Diese Modelllinie verwendet den hier gezeigten Endpunktablauf und wird nicht als Agent-Chatmodell dargestellt.

GPT Image mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen