Gebruik Veo 3 in OpenClaw.
Veo 3 is het videogeneratiemodel van Google DeepMind dat 1080p-clips tot 8 seconden produceert met native audio — gesynchroniseerde dialoog, omgevingsgeluid en muziek gegenereerd naast de video. OpenClaw-agents roepen het aan via dezelfde RunAPI-sleutel en hetzelfde endpoint dat voor chat wordt gebruikt, zonder extra vaardigheden te installeren.
Generate a cinematic video clip with native audio using Google Veo 3 through RunAPI.
Requirements:
- Read the API key from RUNAPI_API_KEY. Do not hardcode the key.
- Send a POST request to https://runapi.ai/api/v1/veo_3_1/text_to_video
- Set model to "veo-3.1".
- Write a descriptive prompt including scene, camera movement, and audio cues.
- Set duration_seconds to 4, 6, or 8.
- Set aspect_ratio to "16:9", "9:16", or "auto".
- The task is async. Poll the returned task_id until status is "completed".
- When done, read the video URL from the response output.
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "veo-3.1",
"prompt": "A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.",
"duration_seconds": 8,
"aspect_ratio": "16:9"
}'
{
"task_id": "tsk_abc123",
"status": "pending",
"model": "veo-3.1"
}
Gebruik Veo 3 in OpenClaw in drie stappen
Configureer RunAPI
Stel de omgevingsvariabele RUNAPI_API_KEY in. Als je RunAPI al als OpenClaw-provider voor chat hebt geconfigureerd, werkt dezelfde sleutel voor videogeneratie — geen extra configuratie of provideraccounts nodig.
export RUNAPI_API_KEY=runapi_xxx
Roep Veo 3 text_to_video aan
Stuur een POST naar het text_to_video-endpoint met model ingesteld op veo-3.1. Voeg een prompt toe met scènebeschrijvingen en audioaccentuatie (dialoog, omgevingsgeluiden). Stel duration_seconds in op 4, 6 of 8 en aspect_ratio op 16:9 of 9:16.
POST /api/v1/veo_3_1/text_to_video
Poll voor het resultaat
Het endpoint retourneert direct een task_id. Poll het taakstatusendpoint totdat de status wijzigt naar voltooid en haal vervolgens de uitvoer-video-URL op. De video bevat gesynchroniseerde audio gegenereerd vanuit je prompt.
GET /api/v1/veo_3_1/text_to_video/tsk_abc123
Veo 3 text_to_video-parameters
| Parameter | Type | Beschrijving |
|---|---|---|
model |
string |
Verplicht. veo-3.1 (standaardkwaliteit) of veo-3.1-fast (lagere kosten, snellere generatie). |
prompt |
string |
Verplicht. Scènebeschrijving inclusief visuele actie, camerabeweging en audioaccentuatie voor dialoog of omgevingsgeluid. |
duration_seconds |
integer |
Optioneel. Videolengte in seconden. Toegestane waarden: 4, 6, 8. Standaard 8. |
aspect_ratio |
string |
Optioneel. Beeldverhouding van de uitvoer. Toegestane waarden: 16:9, 9:16, auto. |
input_mode |
string |
Optioneel. Generatiemodus. text (standaard), first_and_last_frames (keyframe-gestuurd) of reference (stijlreferentie). |
first_frame_image_url |
string |
Optioneel. URL van de eerste-frame-afbeelding. Gebruikt wanneer input_mode first_and_last_frames is. |
last_frame_image_url |
string |
Optioneel. URL van de laatste-frame-afbeelding. Gebruikt wanneer input_mode first_and_last_frames is. |
reference_image_urls |
array |
Optioneel. URL's van stijlreferentie-afbeeldingen. Gebruikt wanneer input_mode reference is. |
callback_url |
string |
Optioneel. Webhook-URL die een POST ontvangt wanneer de taak is voltooid. |
Wat is Veo 3 in OpenClaw?
Veo 3 is het videomodel van Google DeepMind dat levensechte, cinematografische visuals produceert met ingebouwde omgevingsaudio. Het genereert 1080p-clips tot 8 seconden met gesynchroniseerde dialoog, geluidseffecten en muziek — geen aparte audiopipeline nodig. OpenClaw-agents roepen het aan via het RunAPI-endpoint met dezelfde API-sleutel als voor chat.
Veo 3-toepassingen
Straatinterviews en gespreksscènes
Genereer korte videoscènes met personages die dialoog spreken, inclusief gesynchroniseerde lipsync en omgevingsgeluid.
Sfeervolle en landschapscontent
Maak reisscènes, regenachtige stadsomgevingen en natuurlandschappen met geluiden die er echt bij horen.
Productdemovideo's met voice-over
Genereer productshowcase-clips waarbij een verteller functies beschrijft, alles in één generatiestap.
Vragen over Veo 3 + OpenClaw
Ja. OpenClaw-agents roepen het RunAPI Veo 3 text_to_video-endpoint rechtstreeks aan. Stel model in op veo-3.1 en verstuur het verzoek met dezelfde RUNAPI_API_KEY die je voor chat gebruikt. Geen extra vaardigheden, plug-ins of Google Cloud-accounts vereist.
Veo 3 produceert gesynchroniseerde audio native vanuit de tekstprompt. Neem dialoog op tussen aanhalingstekens en beschrijf omgevingsgeluiden of muziek in de prompt — het model genereert bijpassende audio zonder een apart audiopijplijn.
Beide produceren video met native audio op maximaal 1080p. veo-3.1 gebruikt de volledige kwaliteitspijplijn en kost meer per generatie. veo-3.1-fast levert iets minder visuele scherpte in ruil voor lagere kosten en snellere doorlooptijd — geschikt voor concepten en iteraties.
Ja. RunAPI biedt extend_video- en upscale_video-endpoints voor Veo 3. Geef de source_task_id van de oorspronkelijke generatie door om de clip te verlengen, of schaal op naar 1080p of 4K resolutie. Beide zijn asynchroon en worden apart gefactureerd.
Veo 3 genereert clips van 4, 6 of 8 seconden op maximaal 1080p basisresolutie. Je kunt voltooide video's opschalen naar 4K met het upscale_video-endpoint. Beeldverhoudingsopties zijn 16:9, 9:16 en auto.
Algemene OpenClaw-configuratie
Nog niet geconfigureerd? Begin met de RunAPI-configuratiegids voor OpenClaw.
OpenClaw-configuratiegids →Probeer Veo 3 in OpenClaw vandaag.
Haal een gratis RunAPI-sleutel, plak de prompt in OpenClaw en genereer filmische video met native audio via Google Veo 3.