Aggiungi Flux, Imagen 4, GPT Image e Midjourney a OpenClaw — senza skill aggiuntive
La stessa chiave API che il tuo agente OpenClaw usa per la chat chiama anche Flux Kontext, Imagen 4, Seedream, GPT Image 2 e Midjourney — oltre 10 modelli di immagini, nessuna skill aggiuntiva da installare. Usa text-to-image, modifica immagini, image-to-video e scoperta dei prompt in un unico flusso task RunAPI.
Install the RunAPI CLI and generate an image in this OpenClaw workspace.
- Run: npx runapi
- It will prompt you for an API key. Sign up at https://runapi.ai if you don't have one.
- Then run: npx runapi run text_to_image --model flux-kontext-pro --prompt "A red cube on a white table"
- Confirm the image URL appears in the output.
Available image models: flux-kontext-pro, imagen-4, seedream-5-lite-text-to-image, gpt-image-2-text-to-image, midjourney-v8.1.
Cinque famiglie di modelli immagine con Midjourney, una sola chiave API, zero skill aggiuntive
Ogni modello soddisfa un'esigenza produttiva diversa. Flux Kontext gestisce modifiche coerenti con il brand e il rendering del testo. Imagen 4 produce output fotorealistico con forte aderenza al prompt. Seedream 5 Lite è veloce e a basso costo per workflow ad alto volume. GPT Image 2 eccelle nelle modifiche guidate da istruzioni e nel compositing. Midjourney copre generazione di immagini AI rifinite, modifica creativa, image-to-video, scoperta dei prompt e seed lookup. Tutti e cinque usano lo stesso lifecycle di task RunAPI già adottato dal tuo agente OpenClaw.
Rendering del testo, coerenza del brand e modifiche in-context. Ideale per asset di marketing dove sovrimpressioni di testo e riferimenti stilistici sono fondamentali. Da 2,5 centesimi per immagine.
Generazione fotorealistica con alta fedeltà al prompt. I livelli standard, fast e ultra consentono di bilanciare velocità e dettaglio. Da 2 centesimi per immagine.
Generazione veloce e a basso costo per workflow in blocco. Gestisce text-to-image e image-to-image a 2,75 centesimi per chiamata, adatto per prototipazione e iterazione.
Modifiche e compositing guidati da istruzioni. Ideale per task in cui il prompt descrive una trasformazione — rimozione dello sfondo, trasferimento di stile, posizionamento di oggetti.
Generazione di immagini AI rifinite per concept di campagna, visual cinematografici, variazioni di immagine, test image-to-video, scoperta dei prompt e seed lookup tramite RunAPI.
Genera immagini in OpenClaw tramite RunAPI
Configura RunAPI in OpenClaw
Se non hai ancora configurato RunAPI in OpenClaw, segui la guida di setup di OpenClaw. Aggiungi il provider RunAPI con baseUrl https://runapi.ai/v1 e la tua variabile d'ambiente RUNAPI_API_KEY.
Invia una richiesta di generazione immagini
Usa l'endpoint task di RunAPI dal codice del tuo agente o con una chiamata HTTP diretta. Imposta il campo model sullo slug del modello di immagini come flux-kontext-pro, imagen-4, o gpt-image-2. Il corpo della richiesta segue lo stesso schema JSON delle chiamate LLM.
Effettua il polling e recupera il risultato
I task di immagini restituiscono un task ID. Effettua il polling dell'endpoint di stato del task o usa un callback webhook. Quando il task viene completato, la risposta include l'URL dell'immagine generata. Gli SDK RunAPI e la CLI gestiscono automaticamente il polling.
Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney
| Punto di confronto | Flux Kontext Pro | Imagen 4 | Seedream 5 Lite | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| Utilizzo predefinito ottimale | Modifiche coerenti con il brand, sovrimpressioni di testo, posizionamento di loghi e modifiche in-context con riferimenti stilistici. | Generazione fotorealistica da prompt dettagliati, fotografia di prodotto e output di alta fedeltà per singola immagine. | Generazione in blocco veloce e prototipazione quando velocità e costo contano più del dettaglio massimo. | Compositing guidato da istruzioni, modifiche dello sfondo, trasferimenti di stile e modifica delle immagini in più passaggi. | Direzione artistica creativa, AI art rifinita, composizioni cinematografiche e text-to-image quando lo stile visivo conta più della precisione di editing. |
| Tipi di input | Prompt testuale, immagine di riferimento per modifiche in-context, riferimenti stilistici. | Prompt testuale. Livelli di qualità fast, standard e ultra. | Prompt testuale, image-to-image con URL immagine sorgente. | Prompt testuale per la generazione, testo più URL immagine per modifiche e compositing. | Prompt testuale per la generazione; URL dell'immagine sorgente per modifica, image-to-video, scoperta dei prompt e seed lookup. |
| Qualità dell'output | Alto dettaglio con rendering accurato del testo. Efficace nel preservare gli elementi del brand tra le modifiche. | Fotorealistico con forte aderenza al prompt. Livello ultra per il massimo dettaglio. | Buona qualità alla velocità. Adatto per bozze, miniature e cicli di iterazione. | Alta qualità con forte esecuzione delle istruzioni. Ideale per modifiche che richiedono comprensione delle relazioni spaziali. | Output visivo molto stilizzato e rifinito. Forte per concept art cinematografica, visual di campagna e moodboard. |
| Velocità | Velocità di generazione standard. Adatto per workflow interattivi e in batch. | Livello fast disponibile per output quasi istantaneo. I livelli standard e ultra scambiano velocità con qualità. | Molto rapido per pipeline di bozze e prototipi ad alto volume. | Velocità standard. Leggermente più lento per modifiche complesse in più passaggi. | Workflow task asincrono. Adatto a pipeline di agenti che possono fare polling o usare callback durante la generazione dei media. |
| Costo per immagine | Da 2,5 centesimi (Pro). Livello Max a 5 centesimi per maggiore fedeltà. | Da 2 centesimi (Fast) a 6 centesimi (Ultra). Standard a 4 centesimi. | 2,75 centesimi per immagine sia per text-to-image che image-to-image. | Da 3 centesimi. Prezzi basati sulla risoluzione. | Prima dell'uso in produzione, consulta la pagina modello Midjourney live per il prezzo task aggiornato per endpoint. |
| Ideale per gli agenti OpenClaw | Quando il workflow dell'agente coinvolge asset del brand, immagini di marketing o visual con molto testo. | Quando l'agente ha bisogno di output fotorealistico da una descrizione in linguaggio naturale. | Quando l'agente genera molte immagini per sessione e il costo o la velocità sono prioritari. | Quando l'agente modifica immagini esistenti in base alle istruzioni dell'utente. | Quando l'agente ha bisogno di direzione creativa rifinita, variazioni di immagine o image-to-video da un frame selezionato. |
Generazione di asset di marketing
Gli agenti OpenClaw possono generare immagini di prodotto, visual per i social media e creatività pubblicitarie chiamando Flux Kontext o Imagen 4. L'agente scrive il prompt in base al contesto della conversazione e recupera l'immagine finita nella stessa sessione.
Esplora Flux KontextModifica automatica delle immagini
Passa l'URL di un'immagine esistente a GPT Image 2 o Seedream con un'istruzione di modifica. L'agente può rimuovere sfondi, cambiare stili o comporre elementi senza strumenti di design manuali.
Esplora GPT Image 2Iterazione di immagini ad alto volume
Gli agenti OpenClaw che prototipano componenti UI, annunci social o varianti di prodotto traggono vantaggio dalla velocità e dal basso costo per immagine di Seedream 5 Lite. Genera 20 bozze per sessione, poi instrada il prompt selezionato a Flux Kontext Pro per l'output finale.
Esplora SeedreamDirezione creativa con Midjourney
Usa Midjourney quando l'agente ha bisogno di AI art rifinita, visual concept cinematografici, variazioni di immagine, scoperta dei prompt o test di movimento image-to-video da un frame selezionato.
Esplora MidjourneyGenera immagini tramite l'endpoint task di RunAPI
Usa la stessa chiave RunAPI e lo stesso lifecycle del task per ogni modello di immagini. Cambia lo slug del modello e l'endpoint per passare tra Flux, Imagen, Seedream, GPT Image e Midjourney. La risposta restituisce un task ID per il polling, così il tuo agente può mantenere un solo workflow per bozze, modifiche, variazioni e task image-to-video.
{
"model": "flux-kontext-pro",
"prompt": "A futuristic city skyline at sunset, photorealistic, 8K detail"
}
{
"model": "imagen-4",
"prompt": "A golden retriever wearing astronaut suit, studio lighting"
}
{
"model": "gpt-image-2",
"prompt": "Remove the background and add a tropical beach",
"image_url": "https://example.com/photo.jpg"
}
{
"model": "midjourney-v8.1",
"prompt": "A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting",
"aspect_ratio": "16:9"
}
La stessa chiave API genera video e musica
Generazione video
Genera clip video con Kling 3.0, Veo 3 e Seedance 2.0. Gli endpoint text-to-video e image-to-video seguono lo stesso lifecycle di task asincrono della generazione immagini.
Confronta le API videoCreazione musicale
Crea tracce musicali con Suno v4, v4.5 e v5. Descrivi genere, mood e testi nel prompt. L'agente riceve gli URL audio quando il task viene completato.
Esplora i modelli SunoI costi di generazione immagini partono da 2 centesimi per immagine
RunAPI usa prezzi pay-as-you-go senza abbonamento mensile. Ogni modello di immagini ha un costo per task basato su livello del modello, endpoint e impostazioni di output. Consulta la pagina prezzi live e le pagine modello per le tariffe aggiornate di Flux Kontext, Imagen 4, Seedream, GPT Image 2 e Midjourney prima dell'uso in produzione.
Metodologia di pricing
I prezzi in questa pagina riflettono le tariffe pay-as-you-go di RunAPI al momento della pubblicazione. RunAPI imposta i prezzi in base al costo computazionale più un margine trasparente. Il costo effettivo per immagine può variare in base a risoluzione, livello di qualità o opzioni specifiche del modello. Verifica sempre i prezzi correnti sulla pagina prezzi aggiornata prima di effettuare il deployment in produzione.
FAQ sulla generazione immagini con OpenClaw
Come scelgo tra Flux Kontext e Imagen 4 per il mio workflow OpenClaw?
Usa Flux Kontext Pro quando l'agente produce asset del brand, immagini di marketing o visual che includono testo — preserva lo stile e renderizza il testo con precisione. Usa Imagen 4 quando l'agente ha bisogno di output fotorealistico da una descrizione in linguaggio naturale. Entrambi sono disponibili dallo stesso endpoint RunAPI.
Quali modelli di immagini funzionano con OpenClaw tramite RunAPI?
Flux Kontext Pro e Max, Imagen 4 nei livelli fast, standard e ultra, Seedream 5 Lite, GPT Image 2, Midjourney, Nano Banana e molti altri. Oltre 10 modelli di immagini sono disponibili con la stessa chiave API. L'elenco completo è disponibile nella pagina prezzi di RunAPI e si aggiorna automaticamente all'aggiunta di nuovi modelli.
Quanto costa la generazione immagini tramite RunAPI?
La generazione immagini RunAPI è pay-as-you-go senza minimo mensile. I prezzi variano per endpoint, livello qualità, risoluzione di output e tipo di task; consulta la pagina prezzi live per le tariffe aggiornate di Flux, Imagen, Seedream, GPT Image e Midjourney.
RunAPI addebita separatamente le chiamate per immagini rispetto alle chiamate LLM?
No. RunAPI usa un saldo crediti unico per tutte le modalità. Le chiamate per immagini, video, musica e modello linguistico di grandi dimensioni attingono tutte dallo stesso saldo account. Non ci sono abbonamenti per singola modalità né spesa minima. Puoi monitorare la spesa per modello nel dashboard RunAPI.
Come passo da un modello di immagini all'altro nel mio workflow OpenClaw?
Cambia il campo model nel corpo della richiesta. L'endpoint, la chiave API, il lifecycle del task e il pattern di polling rimangono invariati. Il tuo agente può instradare verso modelli diversi in base al task senza modificare il codice di integrazione. Ad esempio, instrada le bozze a seedream-5-lite-text-to-image e gli export finali a flux-kontext-pro.
RunAPI è più economico di fal.ai o Replicate per la generazione immagini?
La generazione immagini di RunAPI parte da 2 centesimi per immagine rispetto a circa 4 centesimi di fal.ai e circa 3,5 centesimi di Replicate per immagine. I prezzi variano in base al modello e alla risoluzione. Consulta la pagina prezzi di RunAPI per le tariffe aggiornate per modello.
Aggiungi la generazione immagini a OpenClaw in pochi minuti.
Una sola chiave RunAPI dà al tuo agente OpenClaw accesso a Flux Kontext, Imagen 4, Seedream, GPT Image 2, Midjourney e oltre 100 altri modelli tra immagini, video, musica e LLM. Nessuna skill aggiuntiva, nessun account di fatturazione separato.