Utiliser Veo 3 dans OpenClaw.
Veo 3 est le modèle de génération vidéo de Google DeepMind qui produit des clips 1080p jusqu'à 8 secondes avec audio natif — dialogue synchronisé, sons ambiants et musique générés en même temps que la vidéo. Les agents OpenClaw l'appellent via la même clé RunAPI et le même endpoint utilisés pour le chat, sans compétences supplémentaires à installer.
Générez un clip vidéo cinématographique avec audio natif en utilisant Google Veo 3 via RunAPI.
Exigences :
- Lire la clé API depuis RUNAPI_API_KEY. Ne pas coder la clé en dur.
- Envoyer une requête POST à https://runapi.ai/api/v1/veo_3_1/text_to_video
- Définir le modèle sur "veo-3.1".
- Rédiger un prompt descriptif incluant la scène, le mouvement de caméra et les indices audio.
- Définir duration_seconds sur 4, 6 ou 8.
- Définir aspect_ratio sur "16:9", "9:16" ou "auto".
- La tâche est asynchrone. Interroger le task_id retourné jusqu'à ce que le statut soit "completed".
- Lorsque c'est fait, lire l'URL de la vidéo depuis la sortie de la réponse.
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "veo-3.1",
"prompt": "A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.",
"duration_seconds": 8,
"aspect_ratio": "16:9"
}'
{
"task_id": "tsk_abc123",
"status": "pending",
"model": "veo-3.1"
}
Utiliser Veo 3 dans OpenClaw en trois étapes
Configurer RunAPI
Définissez la variable d'environnement RUNAPI_API_KEY. Si vous avez déjà configuré RunAPI comme fournisseur OpenClaw pour le chat, la même clé fonctionne pour la génération vidéo — aucune configuration de compte supplémentaire.
export RUNAPI_API_KEY=runapi_xxx
Appeler Veo 3 text_to_video
Envoyez un POST à l'endpoint text_to_video avec le modèle défini sur veo-3.1. Incluez un prompt avec des descriptions de scène et des indices audio (dialogue, sons ambiants). Définissez duration_seconds sur 4, 6 ou 8 et aspect_ratio sur 16:9 ou 9:16.
POST /api/v1/veo_3_1/text_to_video
Obtenir le résultat
L'endpoint retourne immédiatement un task_id. Interrogez l'endpoint de statut de tâche jusqu'à ce que le statut passe à completed, puis récupérez l'URL de la vidéo de sortie. La vidéo inclut de l'audio synchronisé généré à partir de votre prompt.
GET /api/v1/veo_3_1/text_to_video/tsk_abc123
Paramètres text_to_video de Veo 3
| Paramètre | Type | Description |
|---|---|---|
model |
string |
Requis. veo-3.1 (qualité standard) ou veo-3.1-fast (coût inférieur, génération plus rapide). |
prompt |
string |
Requis. Description de la scène incluant l'action visuelle, le mouvement de caméra et les indices audio pour le dialogue ou les sons ambiants. |
duration_seconds |
integer |
Optionnel. Durée de la vidéo en secondes. Valeurs acceptées : 4, 6, 8. Par défaut 8. |
aspect_ratio |
string |
Optionnel. Rapport d'aspect de sortie. Valeurs acceptées : 16:9, 9:16, auto. |
input_mode |
string |
Optionnel. Mode de génération. text (par défaut), first_and_last_frames (guidé par images-clés) ou reference (référence de style). |
first_frame_image_url |
string |
Optionnel. URL de l'image du premier plan. Utilisé quand input_mode est first_and_last_frames. |
last_frame_image_url |
string |
Optionnel. URL de l'image du dernier plan. Utilisé quand input_mode est first_and_last_frames. |
reference_image_urls |
array |
Optionnel. URLs des images de référence de style. Utilisé quand input_mode est reference. |
callback_url |
string |
Optionnel. URL webhook qui reçoit un POST lorsque la tâche se termine. |
Qu'est-ce que Veo 3 sur OpenClaw ?
Veo 3 est le modèle vidéo de Google DeepMind qui produit des visuels cinématographiques vivants avec un audio ambiant précis intégré. Il génère des clips 1080p jusqu'à 8 secondes avec dialogue synchronisé, effets sonores et musique -- aucun pipeline audio séparé n'est nécessaire. Les agents OpenClaw l'appellent via l'endpoint RunAPI avec la même clé API configurée pour le chat.
Cas d'utilisation de Veo 3
Interviews de rue et scènes de dialogue
Générer de courtes scènes vidéo avec des personnages parlant un dialogue. Décrire la conversation dans votre prompt et Veo 3 produit des mouvements de lèvres synchronisés et du bruit ambiant urbain ensemble.
Contenu atmosphérique et paysager
Créer des scènes de vlog de voyage, des environnements urbains sous la pluie ou des plans de nature brumeuse où la génération de son ambiant de Veo 3 ajoute de la profondeur sans travail audio en post-production.
Vidéos de démonstration produit avec voix off
Générer des clips de présentation produit où un narrateur décrit les fonctionnalités. Inclure le texte de la voix off dans votre prompt et Veo 3 rend à la fois la démo visuelle et l'audio parlé en un seul passage.
Questions sur Veo 3 + OpenClaw
Oui. Les agents OpenClaw appellent l'endpoint text_to_video de Veo 3 via RunAPI directement. Définissez le modèle sur veo-3.1 et envoyez la requête avec la même RUNAPI_API_KEY utilisée pour le chat. Aucune compétence supplémentaire, plugin ou compte Google Cloud requis.
Veo 3 produit de l'audio synchronisé nativement à partir du prompt texte. Incluez des dialogues entre guillemets et décrivez les sons ambiants ou la musique dans le prompt — le modèle génère l'audio correspondant sans pipeline audio séparé.
Les deux produisent de la vidéo avec audio natif jusqu'à 1080p. veo-3.1 utilise le pipeline qualité complète et coûte plus par génération. veo-3.1-fast sacrifie un peu de fidélité visuelle pour un coût inférieur et un rendu plus rapide — adapté aux brouillons et aux itérations.
Oui. RunAPI expose les endpoints extend_video et upscale_video pour Veo 3. Passez le source_task_id de la génération originale pour prolonger le clip, ou l'upscaler en 1080p ou 4K. Les deux sont asynchrones et facturés séparément.
Veo 3 génère des clips de 4, 6 ou 8 secondes jusqu'à une résolution de base 1080p. Vous pouvez upscaler les vidéos terminées en 4K via l'endpoint upscale_video. Les options de rapport d'aspect sont 16:9, 9:16 et auto.
Configuration générale de OpenClaw
Pas encore configuré ? Commencez par le guide de configuration RunAPI pour OpenClaw.
Guide de configuration OpenClaw →Catalogue des modèles Veo 3
Voir les variantes de Veo 3, les niveaux de tarification et la documentation API.
Veo 3 sur RunAPI →Essayez Veo 3 dans OpenClaw dès aujourd'hui.
Obtenez une clé RunAPI gratuite, collez le prompt dans OpenClaw et générez des vidéos cinématographiques avec audio natif grâce à Google Veo 3.