OpenAI · Immagini

Hermes Agent x GPT Image

GPT Image è il modello di generazione di immagini di OpenAI, con supporto per text-to-image e modifica delle immagini. Tramite RunAPI tutti gli endpoint di GPT Image condividono una sola chiave e prezzi a chiamata.

1 variants da $0.12 / chiamata Uso commerciale consentito

Prerequisite: npx runapi mcp install

Prompt

Modelli del prompt

Usa gpt-image-1.5 quando è adatto all'attività: Generazione e modifica di immagini con un forte controllo compositivo.

You have access to RunAPI task tools for GPT Image.

Available GPT Image models:
- gpt-image-1.5: Generazione e modifica di immagini con un forte controllo compositivo
  endpoints: /api/v1/gpt_image/edit_image, /api/v1/gpt_image/text_to_image
  request fields: model, prompt, aspect_ratio, quality

Use the model ID and endpoint that match the user's request.
Example prompt: Genera un'illustrazione in flat design di un team che collabora attorno a una lavagna, con colori vivaci e linee pulite.
/api/v1/gpt_image/edit_image: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/gpt_image/edit_image e salva l’ID della Task restituita.
Invia GET a /api/v1/gpt_image/edit_image/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.
/api/v1/gpt_image/text_to_image: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/gpt_image/text_to_image e salva l’ID della Task restituita.
Invia GET a /api/v1/gpt_image/text_to_image/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.

Versioni ed endpoint pubblici

ID modello Endpoint Prezzo iniziale Catalogo
gpt-image-1.5
/api/v1/gpt_image/edit_image /api/v1/gpt_image/text_to_image
$0.12 / chiamata Dettagli modello

Verifica

Esegui il polling finché la Task non raggiunge uno stato terminale

Invia POST a /api/v1/gpt_image/text_to_image e salva l’ID della Task restituita.
Invia GET a /api/v1/gpt_image/text_to_image/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.

Configurazione

Endpoint della guida: /api/v1/gpt_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-image-1.5",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1",
  "quality": "high"
}'
Come funziona

Inizia in 3 passaggi

  1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Cosa puoi creare con Hermes Agent + GPT Image

  • Immagini di marketing e prodotto

    Genera immagini di campagna, foto di prodotto e contenuti social a partire da un brief scritto.

  • Varianti creative in batch

    Produci molte versioni di un concetto in un'unica esecuzione per confrontare stili, layout e formati.

  • Modifica e inpainting

    Perfeziona un'immagine esistente descrivendo modifiche a sfondo, oggetti o dettagli, quando il modello offre endpoint di modifica.

Perché usare GPT Image con RunAPI + Hermes Agent

  • 1 varianti, una chiave API

    Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.

  • Prezzi d'uso chiari

    Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.

  • Flussi di attività automatici

    Invia, controlla e raccogli risultati asincroni con un flusso di attività uniforme, senza scrivere codice di polling manuale.

Domande su Hermes Agent + GPT Image

Quali endpoint supporta GPT Image?

Text-to-image e image editing. Entrambi accettano prompt testuali dettagliati con istruzioni compositive.

Come funziona il controllo compositivo?

GPT Image segue le istruzioni di layout spaziale del prompt: puoi specificare dove compaiono gli oggetti, le dimensioni relative e la disposizione nell'inquadratura.

Quali dimensioni di output sono disponibili?

3 dimensioni fisse fino a 1536 pixel.

Come si confronta GPT Image con GPT Image 2?

GPT Image 2 è il modello più recente, con una resa del testo multilingue quasi perfetta e output fino a 4K. GPT Image è la generazione precedente, con un forte controllo compositivo.

Posso usare GPT Image per la modifica delle immagini?

Sì — l'endpoint di modifica delle immagini accetta un'immagine sorgente e la modifica in base al tuo prompt testuale, funzionando come uno strumento di editing.

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.

Inizia a usare GPT Image con Hermes Agent

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci