---
title: &quot;Usa Veo 3 in OpenClaw tramite RunAPI — Guida API Video&quot;
url: &quot;https://runapi.ai/it/openclaw-veo-3.md&quot;
canonical: &quot;https://runapi.ai/it/openclaw-veo-3&quot;
locale: &quot;it&quot;
model: &quot;veo-3&quot;
---

# Usa Veo 3 in OpenClaw.

Veo 3 è il modello di generazione video di Google DeepMind che produce clip 1080p fino a 8 secondi con audio nativo — dialoghi sincronizzati, suoni ambientali e musica generati insieme al video. Gli agenti OpenClaw lo chiamano tramite la stessa API key e lo stesso endpoint RunAPI usati per la chat, senza skill aggiuntivi da installare.

## API example

```bash
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;veo-3.1&quot;,
    &quot;prompt&quot;: &quot;A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns,\ light rain.&quot;,
    &quot;duration_seconds&quot;: 8,
    &quot;aspect_ratio&quot;: &quot;16:9&quot;
  }&#39;

```

### Response

```json
{
  &quot;task_id&quot;: &quot;tsk_abc123&quot;,
  &quot;status&quot;: &quot;pending&quot;,
  &quot;model&quot;: &quot;veo-3.1&quot;
}

```

## How it works

1. **Configura RunAPI** — Imposta la variabile d&#39;ambiente RUNAPI_API_KEY. Se hai già configurato RunAPI come provider OpenClaw per la chat, la stessa key funziona per la generazione video — nessuna configurazione o account provider aggiuntivo.
2. **Chiama Veo 3 text_to_video** — Invia una richiesta POST all&#39;endpoint text_to_video con model impostato su veo-3.1. Includi un prompt con descrizioni della scena e indicazioni audio (dialoghi, suoni ambientali). Imposta duration_seconds su 4, 6 o 8 e aspect_ratio su 16:9 o 9:16.
3. **Ottieni il risultato** — L&#39;endpoint restituisce subito un task_id. Esegui il polling dell&#39;endpoint di stato del task finché lo stato non cambia in completed, poi recupera l&#39;URL del video di output. Il video include l&#39;audio sincronizzato generato dal tuo prompt.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Obbligatorio. veo-3.1 (qualità standard) o veo-3.1-fast (costo inferiore, generazione più rapida). |
| `prompt` | `string` | Obbligatorio. Descrizione della scena con azione visiva, movimento della telecamera e indicazioni audio per dialoghi o suoni ambientali. |
| `duration_seconds` | `integer` | Facoltativo. Durata del video in secondi. Valori accettati: 4, 6, 8. Predefinito: 8. |
| `aspect_ratio` | `string` | Facoltativo. Rapporto d&#39;aspetto dell&#39;output. Valori accettati: 16:9, 9:16, auto. |
| `input_mode` | `string` | Facoltativo. Modalità di generazione. text (predefinito), first_and_last_frames (guidato da keyframe) o reference (riferimento di stile). |
| `first_frame_image_url` | `string` | Facoltativo. URL dell&#39;immagine del primo fotogramma. Usato quando input_mode è first_and_last_frames. |
| `last_frame_image_url` | `string` | Facoltativo. URL dell&#39;immagine dell&#39;ultimo fotogramma. Usato quando input_mode è first_and_last_frames. |
| `reference_image_urls` | `array` | Facoltativo. URL di immagini di riferimento per lo stile. Usato quando input_mode è reference. |
| `callback_url` | `string` | Facoltativo. URL webhook che riceve una POST quando il task è completato. |

## FAQ

### Posso usare Veo 3 in OpenClaw?

Sì. Gli agenti OpenClaw chiamano direttamente l&#39;endpoint RunAPI Veo 3 text_to_video. Imposta model su veo-3.1 e invia la richiesta con la stessa RUNAPI_API_KEY che usi per la chat. Non sono necessari skill aggiuntivi, plugin o account Google Cloud.

### Come genera Veo 3 l&#39;audio insieme al video?

Veo 3 produce audio sincronizzato nativamente dal prompt testuale. Includi i dialoghi tra virgolette e descrivi suoni ambientali o musica nel prompt — il modello genera l&#39;audio corrispondente senza una pipeline audio separata.

### Qual è la differenza tra veo-3.1 e veo-3.1-fast?

Entrambi producono video con audio nativo fino a 1080p. veo-3.1 usa la pipeline di qualità completa e costa di più per generazione. veo-3.1-fast sacrifica una parte della fedeltà visiva per un costo inferiore e una generazione più rapida — adatto per bozze e iterazioni.

### Posso estendere o aumentare la risoluzione di un video Veo 3 dopo la generazione?

Sì. RunAPI espone gli endpoint extend_video e upscale_video per Veo 3. Passa il source_task_id dalla generazione originale per estendere il clip, oppure effettua l&#39;upscale a risoluzione 1080p o 4K. Entrambi sono asincroni e fatturati separatamente.

### Qual è la durata massima e la risoluzione massima del video?

Veo 3 genera clip da 4, 6 o 8 secondi fino a 1080p di risoluzione base. Puoi aumentare la risoluzione dei video completati a 4K usando l&#39;endpoint upscale_video. Le opzioni di rapporto d&#39;aspetto sono 16:9, 9:16 e auto.


## Links

- [Guida di configurazione di OpenClaw →](https://runapi.ai/it/openclaw)
- [Veo 3 su RunAPI →](https://runapi.ai/it/models/veo-3)
- [Model catalog](https://runapi.ai/it/models)
- [API docs](https://runapi.ai/it/docs)
