---
title: &quot;OpenClaw Bildgenerierung — Flux, Imagen 4, GPT Image und Midjourney per API&quot;
description: &quot;KI-Bildgenerierung in OpenClaw-Agent-Workflows mit Flux Kontext, Imagen 4, Seedream, GPT Image 2 und Midjourney. Ein RunAPI Key, keine zusätzlichen Skills nötig.&quot;
url: &quot;https://runapi.ai/de/openclaw-image-generation.md&quot;
canonical: &quot;https://runapi.ai/de/openclaw-image-generation&quot;
locale: &quot;de&quot;
---

# Flux, Imagen 4, GPT Image und Midjourney in OpenClaw — ohne zusätzliche Skills

Derselbe API Key, den dein OpenClaw-Agent für Chat nutzt, ruft auch Flux Kontext, Imagen 4, Seedream, GPT Image 2 und Midjourney auf — über 10 Bildmodelle, kein zusätzlicher Skill nötig. Nutze Text-zu-Bild, Bildbearbeitung, Bild-zu-Video und Prompt-Erkennung in einem RunAPI-Task-Flow.

Jedes Modell deckt einen anderen Produktionsbedarf ab. Flux Kontext übernimmt markengerechte Bearbeitungen und Textdarstellung. Imagen 4 liefert fotorealistische Ausgaben mit starker Prompt-Treue. Seedream 5 Lite ist schnell und günstig für Hochvolumen-Workflows. GPT Image 2 glänzt bei instruktionsgesteuerten Bearbeitungen und Compositing. Midjourney eignet sich für hochwertige KI-Bildgenerierung, kreative Bildbearbeitung, Bild-zu-Video, Prompt-Erkennung und Seed-Abfragen. Alle fünf nutzen denselben RunAPI-Task-Lifecycle, den dein OpenClaw-Agent bereits verwendet.

## Bilder in OpenClaw über RunAPI generieren

1. **RunAPI in OpenClaw konfigurieren** — Falls du RunAPI noch nicht in OpenClaw eingerichtet hast, folge der OpenClaw-Setup-Anleitung. Füge den RunAPI-Provider mit der baseUrl https://runapi.ai/v1 und deiner RUNAPI_API_KEY-Umgebungsvariablen hinzu.
2. **Bildgenerierungsanfrage senden** — Nutze den RunAPI-Task-Endpoint aus deinem Agent-Code oder einem direkten HTTP-Aufruf. Setze das Feld model auf den Slug des Bildmodells, z. B. flux-kontext-pro, imagen-4 oder gpt-image-2. Der Request-Body folgt demselben JSON-Muster wie LLM-Aufrufe.
3. **Ergebnis abfragen und abrufen** — Bildtasks liefern eine Task-ID zurück. Frage den Task-Status-Endpoint ab oder nutze einen Webhook-Callback. Wenn der Task abgeschlossen ist, enthält die Antwort die URL des generierten Bildes. RunAPI SDKs und das CLI übernehmen das Polling automatisch.

## Flux Kontext vs. Imagen 4 vs. Seedream vs. GPT Image 2 vs Midjourney

| Vergleichspunkt | Flux Kontext | Imagen 4 | Seedream | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| Beste Standardnutzung | Markengerechte Bearbeitungen, Text-Overlays, Logo-Platzierung und kontextbezogene Bildbearbeitung mit Stilreferenzen. | Fotorealistische Generierung aus detaillierten Prompts, Produktfotografie und hochwertige Einzelbildausgabe. | Schnelle Massengenerierung und Prototyping, bei denen Geschwindigkeit und Kosten wichtiger sind als maximales Detail. | Instruktionsgesteuertes Compositing, Hintergrundänderungen, Stilübertragungen und mehrstufige Bildbearbeitung. | Kreative Art Direction, hochwertige KI-Kunst, cineastische Kompositionen und Text-zu-Bild, wenn der visuelle Stil wichtiger ist als präzise Bearbeitung. |
| Eingabetypen | Text-Prompt, Referenzbild für kontextbezogene Bearbeitung, Stilreferenzen. | Text-Prompt. Fast-, Standard- und Ultra-Qualitätsstufen. | Text-Prompt, Bild-zu-Bild mit einer Quellbild-URL. | Text-Prompt für Generierung, Text plus Bild-URL für Bearbeitung und Compositing. | Text-Prompt für die Generierung; Quellbild-URL für Bearbeitung, Bild-zu-Video, Prompt-Erkennung und Seed-Abfragen. |
| Ausgabequalität | Hohe Detailgenauigkeit mit präziser Textdarstellung. Stark darin, Markenelemente über Bearbeitungen hinweg zu erhalten. | Fotorealistisch mit starker Prompt-Treue. Ultra-Tier für maximales Detail. | Gute Qualität bei hoher Geschwindigkeit. Geeignet für Entwürfe, Thumbnails und Iterationsschleifen. | Hohe Qualität mit starker Befolgung von Instruktionen. Ideal für Bearbeitungen, die räumliche Beziehungen verstehen müssen. | Stark stilisierte und hochwertige visuelle Ausgabe. Gut für cineastische Concept Art, Kampagnenmotive und Moodboards. |
| Geschwindigkeit | Standardmäßige Generierungsgeschwindigkeit. Geeignet für interaktive und Batch-Workflows. | Fast-Tier für nahezu sofortige Ausgabe verfügbar. Standard- und Ultra-Tier tauschen Geschwindigkeit gegen Qualität. | Besonders schnell für Hochvolumen-Entwürfe und Prototyping-Pipelines. | Standardgeschwindigkeit. Etwas langsamer bei komplexen mehrstufigen Bearbeitungen. | Asynchroner Task-Workflow. Geeignet für Agent-Pipelines, die während der Mediengenerierung pollen oder Callbacks nutzen können. |
| Kosten pro Bild | Ab 2,5 Cent (Pro). Max-Tier bei 5 Cent für höhere Wiedergabetreue. | Von 2 Cent (Fast) bis 6 Cent (Ultra). Standard bei 4 Cent. | 2,75 Cent pro Bild für Text-zu-Bild und Bild-zu-Bild. | Ab 3 Cent. Auflösungsbasierte Preisgestaltung. | Prüfe vor dem Produktionseinsatz die Live-Midjourney-Modellseite für aktuelle Task-Preise je Endpoint. |
| Beste Nutzung für OpenClaw-Agents | Wenn der Agent-Workflow Marken-Assets, Marketing-Bilder oder textlastige Grafiken beinhaltet. | Wenn der Agent fotorealistische Ausgabe aus einer Beschreibung in natürlicher Sprache benötigt. | Wenn der Agent viele Bilder pro Session generiert und Kosten oder Geschwindigkeit Priorität haben. | Wenn der Agent bestehende Bilder basierend auf Nutzerinstruktionen bearbeitet. | Wenn der Agent hochwertige kreative Richtung, Bildvariationen oder Bild-zu-Video aus einem ausgewählten Frame benötigt. |

## USE CASES

- **Marketing-Asset-Generierung** — OpenClaw-Agents können Produktbilder, Social-Media-Grafiken und Werbemittel generieren, indem sie Flux Kontext oder Imagen 4 aufrufen. Der Agent erstellt den Prompt aus dem Gesprächskontext und ruft das fertige Bild in derselben Session ab.
- **Automatisierte Bildbearbeitung** — Übergib eine vorhandene Bild-URL an GPT Image 2 oder Seedream mit einer Bearbeitungsanweisung. Der Agent kann Hintergründe entfernen, Stile wechseln oder Elemente zusammensetzen — ohne manuelle Design-Tools.
- **Hochvolumen-Bilditeration** — OpenClaw-Agents, die UI-Komponenten, Social Ads oder Produktvariationen prototypisieren, profitieren von Seedream 5 Lites Geschwindigkeit und niedrigen Kosten pro Bild. Generiere 20 Entwürfe pro Session und leite den ausgewählten Prompt für die finale Ausgabe an Flux Kontext Pro weiter.
- **Kreative Richtung mit Midjourney** — Nutze Midjourney, wenn der Agent hochwertige KI-Kunst, cineastische Konzeptvisuals, Bildvariationen, Prompt-Erkennung oder Bild-zu-Video-Bewegungstests aus einem ausgewählten Frame benötigt.

## Bilder über den RunAPI-Task-Endpoint generieren

Nutze denselben RunAPI Key und denselben Task-Lifecycle für jedes Bildmodell. Ändere den Modell-Slug und den Endpoint, um zwischen Flux, Imagen, Seedream, GPT Image und Midjourney zu wechseln. Die Antwort liefert eine Task-ID für das Polling, damit dein Agent einen Workflow für Entwürfe, Bearbeitungen, Variationen und Bild-zu-Video-Tasks behalten kann.

### Flux Kontext

POST /api/v1/task/text_to_image

```json
{
  &quot;model&quot;: &quot;flux-kontext-pro&quot;,
  &quot;prompt&quot;: &quot;A futuristic city skyline at sunset, photorealistic, 8K detail&quot;
}
```
### Imagen 4

POST /api/v1/task/text_to_image

```json
{
  &quot;model&quot;: &quot;imagen-4&quot;,
  &quot;prompt&quot;: &quot;A golden retriever wearing astronaut suit, studio lighting&quot;
}
```
### GPT Image 2

POST /api/v1/task/edit_image

```json
{
  &quot;model&quot;: &quot;gpt-image-2&quot;,
  &quot;prompt&quot;: &quot;Remove the background and add a tropical beach&quot;,
  &quot;image_url&quot;: &quot;https://example.com/photo.jpg&quot;
}
```
### Midjourney

POST /api/v1/midjourney/text_to_image

```json
{
  &quot;model&quot;: &quot;midjourney-v8.1&quot;,
  &quot;prompt&quot;: &quot;A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting&quot;,
  &quot;aspect_ratio&quot;: &quot;16:9&quot;
}
```

## Derselbe API Key generiert Video und Musik

- **Videogenerierung** — Generiere Videoclips mit Kling 3.0, Veo 3 und Seedance 2.0. Text-zu-Video- und Bild-zu-Video-Endpoints folgen demselben asynchronen Task-Lifecycle wie die Bildgenerierung.
- **Musikerstellung** — Erstelle Musiktracks mit Suno v4, v4.5 und v5. Beschreibe Genre, Stimmung und Texte im Prompt. Der Agent erhält Audio-URLs, wenn der Task abgeschlossen ist.

## KI-Bildgenerierung ab 2 Cent pro Bild

RunAPI nutzt nutzungsbasierte Abrechnung (Pay-as-you-go) ohne monatliches Abonnement. Jedes Bildmodell hat einen Task-Preis abhängig von Modell-Tier, Endpoint und Ausgabeoptionen. Prüfe die aktuellen Preise für Flux Kontext, Imagen 4, Seedream, GPT Image 2 und Midjourney auf der Live-Preisseite und den jeweiligen Modellseiten vor dem Produktionseinsatz.

Die Preise auf dieser Seite spiegeln die RunAPI-Pay-as-you-go-Tarife zum Zeitpunkt der Veröffentlichung wider. RunAPI legt Preise basierend auf Rechenkosten zuzüglich einer transparenten Marge fest. Die tatsächlichen Kosten pro Bild können je nach Auflösung, Qualitätsstufe oder modellspezifischen Optionen variieren. Aktuelle Preise vor dem Produktionseinsatz immer auf der Live-Preisseite bestätigen.

## FAQ zur OpenClaw-Bildgenerierung

### Wie wähle ich zwischen Flux Kontext und Imagen 4 für meinen OpenClaw-Workflow?

Nutze Flux Kontext Pro, wenn der Agent Marken-Assets, Marketing-Bilder oder Grafiken mit Text erstellt — er erhält Stile und rendert Text präzise. Nutze Imagen 4, wenn der Agent fotorealistische Ausgabe aus einer Beschreibung in natürlicher Sprache benötigt. Beide sind über denselben RunAPI-Endpoint verfügbar.
### Welche Bildmodelle funktionieren mit OpenClaw über RunAPI?

Flux Kontext Pro und Max, Imagen 4 in Fast-, Standard- und Ultra-Tier, Seedream 5 Lite, GPT Image 2, Midjourney, Nano Banana und weitere. Über 10 Bildmodelle sind über denselben API Key verfügbar. Die vollständige Liste ist auf der RunAPI-Preisseite einsehbar und wird automatisch aktualisiert, wenn neue Modelle hinzukommen.
### Wie viel kostet die Bildgenerierung über RunAPI?

Die Bildgenerierung wird nutzungsbasiert ohne monatliches Minimum abgerechnet. Die Preise variieren je nach Endpoint, Qualitätsstufe, Ausgabeauflösung und Task-Typ; prüfe die aktuellen Tarife für Flux, Imagen, Seedream, GPT Image und Midjourney auf der Live-Preisseite.
### Berechnet RunAPI Bildaufrufe und LLM-Aufrufe getrennt?

Nein. RunAPI nutzt ein einziges Credits-Guthaben für alle Modalitäten. Bild-, Video-, Musik- und LLM-Aufrufe ziehen alle vom selben Konto-Guthaben ab. Es gibt kein modalitätsspezifisches Abonnement oder eine Mindestausgabe. Den Verbrauch pro Modell kannst du im RunAPI-Dashboard einsehen.
### Wie wechsle ich zwischen Bildmodellen in meinem OpenClaw-Workflow?

Ändere das Feld model im Request-Body. Endpoint, API Key, Task-Lifecycle und Polling-Muster bleiben gleich. Dein Agent kann je nach Aufgabe zu verschiedenen Modellen routen, ohne den Integrationscode zu ändern. Zum Beispiel: Entwürfe an seedream-5-lite-text-to-image routen und finale Exporte an flux-kontext-pro.
### Ist RunAPI günstiger als fal.ai oder Replicate für die Bildgenerierung?

Die Bildgenerierung mit RunAPI beginnt bei 2 Cent pro Bild, verglichen mit fal.ai bei ca. 4 Cent und Replicate bei ca. 3,5 Cent pro Bild. Die Preise variieren je nach Modell und Auflösung. Aktuelle Preise pro Modell auf der RunAPI-Preisseite prüfen.

## Links

- [Flux Kontext](https://runapi.ai/de/models/flux-kontext)
- [Imagen 4](https://runapi.ai/de/models/imagen-4)
- [Seedream](https://runapi.ai/de/models/seedream)
- [GPT Image 2](https://runapi.ai/de/models/gpt-image-2)
- [Midjourney](https://runapi.ai/de/models/midjourney)
- [AI Video API Comparison](https://runapi.ai/de/ai-video-api-comparison)
- [Suno](https://runapi.ai/de/models/suno)
- [Models Hub](https://runapi.ai/de/models)
- [OpenClaw Setup](https://runapi.ai/de/openclaw)
- [Pricing](https://runapi.ai/de/pricing)
- [API docs](https://runapi.ai/de/docs)
