---
title: "Generazione immagini OpenClaw — Flux, Imagen 4, GPT Image e Midjourney via API"
description: "Genera immagini nei workflow dell'agente OpenClaw con Flux Kontext, Imagen 4, Seedream, GPT Image 2 e Midjourney. Una sola chiave RunAPI, nessuna skill aggiuntiva da installare."
url: "https://runapi.ai/it/openclaw-image-generation.md"
canonical: "https://runapi.ai/it/openclaw-image-generation"
locale: "it"
---

# Aggiungi Flux, Imagen 4, GPT Image e Midjourney a OpenClaw — senza skill aggiuntive

La stessa chiave API che il tuo agente OpenClaw usa per la chat chiama anche Flux Kontext, Imagen 4, Seedream, GPT Image 2 e Midjourney — oltre 10 modelli di immagini, nessuna skill aggiuntiva da installare. Usa text-to-image, modifica immagini, image-to-video e scoperta dei prompt in un unico flusso task RunAPI.

Ogni modello soddisfa un'esigenza produttiva diversa. Flux Kontext gestisce modifiche coerenti con il brand e il rendering del testo. Imagen 4 produce output fotorealistico con forte aderenza al prompt. Seedream 5 Lite è veloce e a basso costo per workflow ad alto volume. GPT Image 2 eccelle nelle modifiche guidate da istruzioni e nel compositing. Midjourney copre generazione di immagini AI rifinite, modifica creativa, image-to-video, scoperta dei prompt e seed lookup. Tutti e cinque usano lo stesso lifecycle di task RunAPI già adottato dal tuo agente OpenClaw.

## Genera immagini in OpenClaw tramite RunAPI

1. **Configura RunAPI in OpenClaw** — Se non hai ancora configurato RunAPI in OpenClaw, segui la guida di setup di OpenClaw. Aggiungi il provider RunAPI con baseUrl https://runapi.ai/v1 e la tua variabile d'ambiente RUNAPI_API_KEY.
2. **Invia una richiesta di generazione immagini** — Usa l'endpoint task di RunAPI dal codice del tuo agente o con una chiamata HTTP diretta. Imposta il campo model sullo slug del modello di immagini come flux-kontext-pro, imagen-4, o gpt-image-2. Il corpo della richiesta segue lo stesso schema JSON delle chiamate LLM.
3. **Effettua il polling e recupera il risultato** — I task di immagini restituiscono un task ID. Effettua il polling dell'endpoint di stato del task o usa un callback webhook. Quando il task viene completato, la risposta include l'URL dell'immagine generata. Gli SDK RunAPI e la CLI gestiscono automaticamente il polling.

## Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney

| Punto di confronto | Flux Kontext | Imagen 4 | Seedream | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| Utilizzo predefinito ottimale | Modifiche coerenti con il brand, sovrimpressioni di testo, posizionamento di loghi e modifiche in-context con riferimenti stilistici. | Generazione fotorealistica da prompt dettagliati, fotografia di prodotto e output di alta fedeltà per singola immagine. | Generazione in blocco veloce e prototipazione quando velocità e costo contano più del dettaglio massimo. | Compositing guidato da istruzioni, modifiche dello sfondo, trasferimenti di stile e modifica delle immagini in più passaggi. | Direzione artistica creativa, AI art rifinita, composizioni cinematografiche e text-to-image quando lo stile visivo conta più della precisione di editing. |
| Tipi di input | Prompt testuale, immagine di riferimento per modifiche in-context, riferimenti stilistici. | Prompt testuale. Livelli di qualità fast, standard e ultra. | Prompt testuale, image-to-image con URL immagine sorgente. | Prompt testuale per la generazione, testo più URL immagine per modifiche e compositing. | Prompt testuale per la generazione; URL dell'immagine sorgente per modifica, image-to-video, scoperta dei prompt e seed lookup. |
| Qualità dell'output | Alto dettaglio con rendering accurato del testo. Efficace nel preservare gli elementi del brand tra le modifiche. | Fotorealistico con forte aderenza al prompt. Livello ultra per il massimo dettaglio. | Buona qualità alla velocità. Adatto per bozze, miniature e cicli di iterazione. | Alta qualità con forte esecuzione delle istruzioni. Ideale per modifiche che richiedono comprensione delle relazioni spaziali. | Output visivo molto stilizzato e rifinito. Forte per concept art cinematografica, visual di campagna e moodboard. |
| Velocità | Velocità di generazione standard. Adatto per workflow interattivi e in batch. | Livello fast disponibile per output quasi istantaneo. I livelli standard e ultra scambiano velocità con qualità. | Molto rapido per pipeline di bozze e prototipi ad alto volume. | Velocità standard. Leggermente più lento per modifiche complesse in più passaggi. | Workflow task asincrono. Adatto a pipeline di agenti che possono fare polling o usare callback durante la generazione dei media. |
| Costo per immagine | Da 2,5 centesimi (Pro). Livello Max a 5 centesimi per maggiore fedeltà. | Da 2 centesimi (Fast) a 6 centesimi (Ultra). Standard a 4 centesimi. | 2,75 centesimi per immagine sia per text-to-image che image-to-image. | Da 3 centesimi. Prezzi basati sulla risoluzione. | Prima dell'uso in produzione, consulta la pagina modello Midjourney live per il prezzo task aggiornato per endpoint. |
| Ideale per gli agenti OpenClaw | Quando il workflow dell'agente coinvolge asset del brand, immagini di marketing o visual con molto testo. | Quando l'agente ha bisogno di output fotorealistico da una descrizione in linguaggio naturale. | Quando l'agente genera molte immagini per sessione e il costo o la velocità sono prioritari. | Quando l'agente modifica immagini esistenti in base alle istruzioni dell'utente. | Quando l'agente ha bisogno di direzione creativa rifinita, variazioni di immagine o image-to-video da un frame selezionato. |

## USE CASES

- **Generazione di asset di marketing** — Gli agenti OpenClaw possono generare immagini di prodotto, visual per i social media e creatività pubblicitarie chiamando Flux Kontext o Imagen 4. L'agente scrive il prompt in base al contesto della conversazione e recupera l'immagine finita nella stessa sessione.
- **Modifica automatica delle immagini** — Passa l'URL di un'immagine esistente a GPT Image 2 o Seedream con un'istruzione di modifica. L'agente può rimuovere sfondi, cambiare stili o comporre elementi senza strumenti di design manuali.
- **Iterazione di immagini ad alto volume** — Gli agenti OpenClaw che prototipano componenti UI, annunci social o varianti di prodotto traggono vantaggio dalla velocità e dal basso costo per immagine di Seedream 5 Lite. Genera 20 bozze per sessione, poi instrada il prompt selezionato a Flux Kontext Pro per l'output finale.
- **Direzione creativa con Midjourney** — Usa Midjourney quando l'agente ha bisogno di AI art rifinita, visual concept cinematografici, variazioni di immagine, scoperta dei prompt o test di movimento image-to-video da un frame selezionato.

## Genera immagini tramite l'endpoint task di RunAPI

Usa la stessa chiave RunAPI e lo stesso lifecycle del task per ogni modello di immagini. Cambia lo slug del modello e l'endpoint per passare tra Flux, Imagen, Seedream, GPT Image e Midjourney. La risposta restituisce un task ID per il polling, così il tuo agente può mantenere un solo workflow per bozze, modifiche, variazioni e task image-to-video.

### Flux Kontext

POST /api/v1/task/text_to_image

```json
{
  "model": "flux-kontext-pro",
  "prompt": "A futuristic city skyline at sunset, photorealistic, 8K detail"
}
```
### Imagen 4

POST /api/v1/task/text_to_image

```json
{
  "model": "imagen-4",
  "prompt": "A golden retriever wearing astronaut suit, studio lighting"
}
```
### GPT Image 2

POST /api/v1/task/edit_image

```json
{
  "model": "gpt-image-2",
  "prompt": "Remove the background and add a tropical beach",
  "image_url": "https://example.com/photo.jpg"
}
```
### Midjourney

POST /api/v1/midjourney/text_to_image

```json
{
  "model": "midjourney-v8.1",
  "prompt": "A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting",
  "aspect_ratio": "16:9"
}
```

## La stessa chiave API genera video e musica

- **Generazione video** — Genera clip video con Kling 3.0, Veo 3 e Seedance 2.0. Gli endpoint text-to-video e image-to-video seguono lo stesso lifecycle di task asincrono della generazione immagini.
- **Creazione musicale** — Crea tracce musicali con Suno v4, v4.5 e v5. Descrivi genere, mood e testi nel prompt. L'agente riceve gli URL audio quando il task viene completato.

## I costi di generazione immagini partono da 2 centesimi per immagine

RunAPI usa prezzi pay-as-you-go senza abbonamento mensile. Ogni modello di immagini ha un costo per task basato su livello del modello, endpoint e impostazioni di output. Consulta la pagina prezzi live e le pagine modello per le tariffe aggiornate di Flux Kontext, Imagen 4, Seedream, GPT Image 2 e Midjourney prima dell'uso in produzione.

I prezzi in questa pagina riflettono le tariffe pay-as-you-go di RunAPI al momento della pubblicazione. RunAPI imposta i prezzi in base al costo computazionale più un margine trasparente. Il costo effettivo per immagine può variare in base a risoluzione, livello di qualità o opzioni specifiche del modello. Verifica sempre i prezzi correnti sulla pagina prezzi aggiornata prima di effettuare il deployment in produzione.

## FAQ sulla generazione immagini con OpenClaw

### Come scelgo tra Flux Kontext e Imagen 4 per il mio workflow OpenClaw?

Usa Flux Kontext Pro quando l'agente produce asset del brand, immagini di marketing o visual che includono testo — preserva lo stile e renderizza il testo con precisione. Usa Imagen 4 quando l'agente ha bisogno di output fotorealistico da una descrizione in linguaggio naturale. Entrambi sono disponibili dallo stesso endpoint RunAPI.
### Quali modelli di immagini funzionano con OpenClaw tramite RunAPI?

Flux Kontext Pro e Max, Imagen 4 nei livelli fast, standard e ultra, Seedream 5 Lite, GPT Image 2, Midjourney, Nano Banana e molti altri. Oltre 10 modelli di immagini sono disponibili con la stessa chiave API. L'elenco completo è disponibile nella pagina prezzi di RunAPI e si aggiorna automaticamente all'aggiunta di nuovi modelli.
### Quanto costa la generazione immagini tramite RunAPI?

La generazione immagini RunAPI è pay-as-you-go senza minimo mensile. I prezzi variano per endpoint, livello qualità, risoluzione di output e tipo di task; consulta la pagina prezzi live per le tariffe aggiornate di Flux, Imagen, Seedream, GPT Image e Midjourney.
### RunAPI addebita separatamente le chiamate per immagini rispetto alle chiamate LLM?

No. RunAPI usa un saldo crediti unico per tutte le modalità. Le chiamate per immagini, video, musica e modello linguistico di grandi dimensioni attingono tutte dallo stesso saldo account. Non ci sono abbonamenti per singola modalità né spesa minima. Puoi monitorare la spesa per modello nel dashboard RunAPI.
### Come passo da un modello di immagini all'altro nel mio workflow OpenClaw?

Cambia il campo model nel corpo della richiesta. L'endpoint, la chiave API, il lifecycle del task e il pattern di polling rimangono invariati. Il tuo agente può instradare verso modelli diversi in base al task senza modificare il codice di integrazione. Ad esempio, instrada le bozze a seedream-5-lite-text-to-image e gli export finali a flux-kontext-pro.
### RunAPI è più economico di fal.ai o Replicate per la generazione immagini?

La generazione immagini di RunAPI parte da 2 centesimi per immagine rispetto a circa 4 centesimi di fal.ai e circa 3,5 centesimi di Replicate per immagine. I prezzi variano in base al modello e alla risoluzione. Consulta la pagina prezzi di RunAPI per le tariffe aggiornate per modello.

## Links

- [Flux Kontext](https://runapi.ai/it/models/flux-kontext)
- [Imagen 4](https://runapi.ai/it/models/imagen-4)
- [Seedream](https://runapi.ai/it/models/seedream)
- [GPT Image 2](https://runapi.ai/it/models/gpt-image-2)
- [Midjourney](https://runapi.ai/it/models/midjourney)
- [AI Video API Comparison](https://runapi.ai/it/ai-video-api-comparison)
- [Suno](https://runapi.ai/it/models/suno)
- [Models Hub](https://runapi.ai/it/models)
- [OpenClaw Setup](https://runapi.ai/it/openclaw)
- [Pricing](https://runapi.ai/it/pricing)
- [API docs](https://runapi.ai/it/docs/guides)
