OPENCLAW + VEO 3

Utiliser Veo 3 dans OpenClaw.

Veo 3 est le modèle de génération vidéo de Google DeepMind qui produit des clips 1080p jusqu'à 8 secondes avec audio natif — dialogue synchronisé, sons ambiants et musique générés en même temps que la vidéo. Les agents OpenClaw l'appellent via la même clé RunAPI et le même endpoint utilisés pour le chat, sans compétences supplémentaires à installer.

une seule clé API · endpoint text-to-video · sortie audio native
Générez un clip vidéo cinématographique avec audio natif en utilisant Google Veo 3 via RunAPI.


  Exigences :

  - Lire la clé API depuis RUNAPI_API_KEY. Ne pas coder la clé en dur.

  - Envoyer une requête POST à https://runapi.ai/api/v1/veo_3_1/text_to_video

  - Définir le modèle sur "veo-3.1".

  - Rédiger un prompt descriptif incluant la scène, le mouvement de caméra et les indices audio.

  - Définir duration_seconds sur 4, 6 ou 8.

  - Définir aspect_ratio sur "16:9", "9:16" ou "auto".

  - La tâche est asynchrone. Interroger le task_id retourné jusqu'à ce que le statut soit "completed".

  - Lorsque c'est fait, lire l'URL de la vidéo depuis la sortie de la réponse.

  
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "veo-3.1",
    "prompt": "A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.",
    "duration_seconds": 8,
    "aspect_ratio": "16:9"
  }'
{
  "task_id": "tsk_abc123",
  "status": "pending",
  "model": "veo-3.1"
}
Copiez la commande curl pour tester veo-3
FONCTIONNEMENT

Utiliser Veo 3 dans OpenClaw en trois étapes

1

Configurer RunAPI

Définissez la variable d'environnement RUNAPI_API_KEY. Si vous avez déjà configuré RunAPI comme fournisseur OpenClaw pour le chat, la même clé fonctionne pour la génération vidéo — aucune configuration de compte supplémentaire.

export RUNAPI_API_KEY=runapi_xxx
2

Appeler Veo 3 text_to_video

Envoyez un POST à l'endpoint text_to_video avec le modèle défini sur veo-3.1. Incluez un prompt avec des descriptions de scène et des indices audio (dialogue, sons ambiants). Définissez duration_seconds sur 4, 6 ou 8 et aspect_ratio sur 16:9 ou 9:16.

POST /api/v1/veo_3_1/text_to_video
3

Obtenir le résultat

L'endpoint retourne immédiatement un task_id. Interrogez l'endpoint de statut de tâche jusqu'à ce que le statut passe à completed, puis récupérez l'URL de la vidéo de sortie. La vidéo inclut de l'audio synchronisé généré à partir de votre prompt.

GET /api/v1/veo_3_1/text_to_video/tsk_abc123
PARAMÈTRES

Paramètres text_to_video de Veo 3

Paramètre Type Description
model string Requis. veo-3.1 (qualité standard) ou veo-3.1-fast (coût inférieur, génération plus rapide).
prompt string Requis. Description de la scène incluant l'action visuelle, le mouvement de caméra et les indices audio pour le dialogue ou les sons ambiants.
duration_seconds integer Optionnel. Durée de la vidéo en secondes. Valeurs acceptées : 4, 6, 8. Par défaut 8.
aspect_ratio string Optionnel. Rapport d'aspect de sortie. Valeurs acceptées : 16:9, 9:16, auto.
input_mode string Optionnel. Mode de génération. text (par défaut), first_and_last_frames (guidé par images-clés) ou reference (référence de style).
first_frame_image_url string Optionnel. URL de l'image du premier plan. Utilisé quand input_mode est first_and_last_frames.
last_frame_image_url string Optionnel. URL de l'image du dernier plan. Utilisé quand input_mode est first_and_last_frames.
reference_image_urls array Optionnel. URLs des images de référence de style. Utilisé quand input_mode est reference.
callback_url string Optionnel. URL webhook qui reçoit un POST lorsque la tâche se termine.

Qu'est-ce que Veo 3 sur OpenClaw ?

Veo 3 est le modèle vidéo de Google DeepMind qui produit des visuels cinématographiques vivants avec un audio ambiant précis intégré. Il génère des clips 1080p jusqu'à 8 secondes avec dialogue synchronisé, effets sonores et musique -- aucun pipeline audio séparé n'est nécessaire. Les agents OpenClaw l'appellent via l'endpoint RunAPI avec la même clé API configurée pour le chat.

Cas d'utilisation de Veo 3

Interviews de rue et scènes de dialogue

Générer de courtes scènes vidéo avec des personnages parlant un dialogue. Décrire la conversation dans votre prompt et Veo 3 produit des mouvements de lèvres synchronisés et du bruit ambiant urbain ensemble.

Contenu atmosphérique et paysager

Créer des scènes de vlog de voyage, des environnements urbains sous la pluie ou des plans de nature brumeuse où la génération de son ambiant de Veo 3 ajoute de la profondeur sans travail audio en post-production.

Vidéos de démonstration produit avec voix off

Générer des clips de présentation produit où un narrateur décrit les fonctionnalités. Inclure le texte de la voix off dans votre prompt et Veo 3 rend à la fois la démo visuelle et l'audio parlé en un seul passage.

FAQ

Questions sur Veo 3 + OpenClaw

Configuration générale de OpenClaw

Pas encore configuré ? Commencez par le guide de configuration RunAPI pour OpenClaw.

Guide de configuration OpenClaw →

Catalogue des modèles Veo 3

Voir les variantes de Veo 3, les niveaux de tarification et la documentation API.

Veo 3 sur RunAPI →

Essayez Veo 3 dans OpenClaw dès aujourd'hui.

Obtenez une clé RunAPI gratuite, collez le prompt dans OpenClaw et générez des vidéos cinématographiques avec audio natif grâce à Google Veo 3.