---
title: &quot;Usa Veo 3 en OpenClaw con RunAPI — Guía de API de video&quot;
url: &quot;https://runapi.ai/pt-BR/openclaw-veo-3.md&quot;
canonical: &quot;https://runapi.ai/pt-BR/openclaw-veo-3&quot;
locale: &quot;pt-BR&quot;
model: &quot;veo-3&quot;
---

# Usa Veo 3 en OpenClaw.

Veo 3 es el modelo de generación de video de Google DeepMind que produce clips a 1080p de hasta 8 segundos con audio nativo — diálogo sincronizado, sonido ambiental y música generados junto con el video. Los agentes de OpenClaw lo llaman a través de la misma clave y endpoint de RunAPI usados para chat, sin necesidad de instalar skills adicionales.

## API example

```bash
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;veo-3.1&quot;,
    &quot;prompt&quot;: &quot;A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.&quot;,
    &quot;duration_seconds&quot;: 8,
    &quot;aspect_ratio&quot;: &quot;16:9&quot;
  }&#39;

```

### Response

```json
{
  &quot;task_id&quot;: &quot;tsk_abc123&quot;,
  &quot;status&quot;: &quot;pending&quot;,
  &quot;model&quot;: &quot;veo-3.1&quot;
}

```

## How it works

1. **Configura RunAPI** — Establece la variable de entorno RUNAPI_API_KEY. Si ya configuraste RunAPI como proveedor de OpenClaw para chat, la misma clave funciona para generación de video — no se necesita configuración adicional ni cuentas de proveedor.
2. **Llama a Veo 3 text_to_video** — Envía un POST al endpoint text_to_video con model establecido en veo-3.1. Incluye un prompt con descripciones de escena y pistas de audio (diálogo, sonidos ambientales). Establece duration_seconds en 4, 6 u 8 y aspect_ratio en 16:9 o 9:16.
3. **Consulta el resultado** — El endpoint devuelve un task_id inmediatamente. Consulta el endpoint de estado de la tarea hasta que el estado cambie a completado, luego recupera la URL del video de salida. El video incluye audio sincronizado generado a partir de tu prompt.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Obligatorio. veo-3.1 (calidad estándar) o veo-3.1-fast (menor coste, generación más rápida). |
| `prompt` | `string` | Obligatorio. Descripción de la escena incluyendo acción visual, movimiento de cámara y pistas de audio para diálogo o sonido ambiental. |
| `duration_seconds` | `integer` | Opcional. Duración del video en segundos. Valores aceptados: 4, 6, 8. Por defecto 8. |
| `aspect_ratio` | `string` | Opcional. Relación de aspecto de salida. Valores aceptados: 16:9, 9:16, auto. |
| `input_mode` | `string` | Opcional. Modo de generación. text (por defecto), first_and_last_frames (guiado por fotogramas clave), o reference (referencia de estilo). |
| `first_frame_image_url` | `string` | Opcional. URL de la imagen del primer fotograma. Se usa cuando input_mode es first_and_last_frames. |
| `last_frame_image_url` | `string` | Opcional. URL de la imagen del último fotograma. Se usa cuando input_mode es first_and_last_frames. |
| `reference_image_urls` | `array` | Opcional. URLs de imágenes de referencia de estilo. Se usa cuando input_mode es reference. |
| `callback_url` | `string` | Opcional. URL de webhook que recibe un POST cuando la tarea se completa. |

## FAQ

### ¿Puedo usar Veo 3 en OpenClaw?

Sí. Los agentes de OpenClaw llaman al endpoint text_to_video de Veo 3 en RunAPI directamente. Establece model en veo-3.1 y envía la solicitud con la misma RUNAPI_API_KEY que usas para chat. No se necesitan skills adicionales, plugins ni cuentas de Google Cloud.

### ¿Cómo genera Veo 3 audio junto con el video?

Veo 3 produce audio sincronizado de forma nativa a partir del prompt de texto. Incluye diálogos entre comillas y describe sonidos ambientales o música en el prompt — el modelo genera audio correspondiente sin necesidad de un pipeline de audio separado.

### ¿Cuál es la diferencia entre veo-3.1 y veo-3.1-fast?

Ambos producen video con audio nativo a hasta 1080p. veo-3.1 usa el pipeline de calidad completa y cuesta más por generación. veo-3.1-fast sacrifica algo de fidelidad visual a cambio de menor coste y mayor rapidez — adecuado para borradores e iteraciones.

### ¿Puedo extender o escalar un video de Veo 3 después de generarlo?

Sí. RunAPI expone endpoints extend_video y upscale_video para Veo 3. Pasa el source_task_id de la generación original para extender el clip, o escala a resolución 1080p o 4K. Ambos son asíncronos y se facturan por separado.

### ¿Cuál es la duración y resolución máxima del video?

Veo 3 genera clips de 4, 6 u 8 segundos a una resolución base de hasta 1080p. Puedes escalar los videos completados a 4K usando el endpoint upscale_video. Las opciones de relación de aspecto son 16:9, 9:16 y auto.


## Links

- [Guía de configuración de OpenClaw →](https://runapi.ai/pt-BR/openclaw)
- [Veo 3 en RunAPI →](https://runapi.ai/pt-BR/models/veo-3)
- [Model catalog](https://runapi.ai/pt-BR/models)
- [API docs](https://runapi.ai/pt-BR/docs)
