Alibaba · Vidéo

Hermes Agent x Wan

Wan est la suite complète de modèles vidéo et image d'Alibaba, l'une des familles de modèles vidéo open-weight les plus complètes disponibles. Via RunAPI, toutes les versions Wan partagent une seule clé et une facturation unifiée.

18 variants à partir de $0.05 / appel Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez wan-2.2-a14b-image-to-video-turbo lorsqu'il correspond à la tâche : Vidéo ancrée sur image sur l'architecture 2.2.

You have access to RunAPI task tools for Wan.

Available Wan models:
- wan-2.2-a14b-image-to-video-turbo: Vidéo ancrée sur image sur l'architecture 2.2
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.2-a14b-speech-to-video-turbo: L'entrée audio pilote le mouvement vidéo et le lip-sync
  endpoints: /api/v1/wan/speech_to_video
  request fields: model, source_image_url, source_audio_url, prompt
- wan-2.2-a14b-text-to-video-turbo: MoE A14B open-source ; qualité baseline
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.2-animate-move: Animation de mouvement spécialisée sur la base 2.2
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.2-animate-replace: Animation de remplacement de sujet sur la base 2.2
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.5-image-to-video: Ancré sur image avec audio natif sur 2.5
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, duration_seconds, output_resolution
- wan-2.5-text-to-video: Génération audio native + meilleur réalisme de mouvement vs 2.2
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt, output_resolution
- wan-2.6-edit-video: Édition vidéo avec contrôle sujet + caméra
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt
- wan-2.6-flash-edit-video: Édition vidéo 2.6 optimisée pour la vitesse
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, audio
- wan-2.6-flash-image-to-video: Version 2.6 optimisée vitesse ; coût réduit, inférence plus rapide
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, audio
- wan-2.6-image-to-video: Ancré sur image avec continuité de scène 2.6
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.6-text-to-video: Continuité de scène améliorée + support de scènes complexes
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-edit-video: wan-2.7-edit-video
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, source_video_url
- wan-2.7-image: Génération d'image standard sur l'architecture 2.7
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-pro: Grille d'images multi-angles 3×3 ; sortie image de la plus haute qualité
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-to-video: Ancré sur image avec support multi-référence 2.7
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.7-r2v: Texte-vers-vidéo R2V avec références d'apparence de personnage + voix
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-text-to-video: Contrôle première et dernière frame ; 5 références vidéo simultanées
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt

Use the model ID and endpoint that match the user's request.
Example prompt: Générez une vidéo de 5 secondes d'un chat sautant sur une étagère, éclairage intérieur naturel, sensation de caméra portée.
/api/v1/wan/image_to_video: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/image_to_video et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/image_to_video/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/wan/speech_to_video: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/speech_to_video et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/speech_to_video/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/wan/text_to_video: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/text_to_video et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/text_to_video/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/wan/animate: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/animate et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/animate/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/wan/edit_video: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/edit_video et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/edit_video/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/wan/text_to_image: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/wan/text_to_image et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/wan/text_to_image/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
wan-2.2-a14b-image-to-video-turbo
/api/v1/wan/image_to_video
$0.40 / appel Détail du modèle
wan-2.2-a14b-speech-to-video-turbo
/api/v1/wan/speech_to_video
$0.24 / seconde Détail du modèle
wan-2.2-a14b-text-to-video-turbo
/api/v1/wan/text_to_video
$0.40 / appel Détail du modèle
wan-2.2-animate-move
/api/v1/wan/animate
$0.13 / seconde Détail du modèle
wan-2.2-animate-replace
/api/v1/wan/animate
$0.13 / seconde Détail du modèle
wan-2.5-image-to-video
/api/v1/wan/image_to_video
$0.12 / seconde Détail du modèle
wan-2.5-text-to-video
/api/v1/wan/text_to_video
$0.12 / seconde Détail du modèle
wan-2.6-edit-video
/api/v1/wan/edit_video
$0.14 / seconde Détail du modèle
wan-2.6-flash-edit-video
/api/v1/wan/edit_video
$0.30 / appel Détail du modèle
wan-2.6-flash-image-to-video
/api/v1/wan/image_to_video
$9.44 / appel Détail du modèle
wan-2.6-image-to-video
/api/v1/wan/image_to_video
$0.58 / seconde Détail du modèle
wan-2.6-text-to-video
/api/v1/wan/text_to_video
$0.58 / seconde Détail du modèle
wan-2.7-edit-video
/api/v1/wan/edit_video
$0.16 / seconde Détail du modèle
wan-2.7-image
/api/v1/wan/text_to_image
$0.05 / appel Détail du modèle
wan-2.7-image-pro
/api/v1/wan/text_to_image
$0.12 / appel Détail du modèle
wan-2.7-image-to-video
/api/v1/wan/image_to_video
$0.16 / seconde Détail du modèle
wan-2.7-r2v
/api/v1/wan/text_to_video
$0.16 / seconde Détail du modèle
wan-2.7-text-to-video
/api/v1/wan/text_to_video
$0.16 / seconde Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.

  3. Vérifier le résultat

    Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.

Ce que vous pouvez créer avec Hermes Agent + Wan

  • Contenus de marque en volume

    Profitez de la cohérence des personnages de Wan pour produire des vidéos de marque à grande échelle, pendant que Hermes Agent lance en parallèle des tâches pour différentes gammes de produits.

  • Dialogues avec synchronisation labiale

    Enchaînez un modèle de synthèse vocale avec l'endpoint parole vers vidéo de Wan dans un workflow Hermes Agent pour passer du script à une vidéo parlée.

  • Prévisualisation pour cinéastes et agences

    Générez des clips de prévisualisation avec des images clés fixées, en définissant la première et la dernière image pour maîtriser les transitions lors de la validation client.

Pourquoi utiliser Wan avec RunAPI + Hermes Agent

  • 18 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Flux de tâches automatiques

    Envoyez, interrogez et récupérez les résultats asynchrones avec un flux de tâches uniforme, sans code d'interrogation manuel.

Questions sur Hermes Agent + Wan

Quels endpoints Wan puis-je appeler depuis Hermes Agent ?

Tous les endpoints Wan de cette page. Configurez RunAPI comme fournisseur une fois, puis changez d'endpoint et de version de modèle à chaque requête.

Wan demande-t-il une configuration supplémentaire dans Hermes Agent ?

Non. Le fournisseur RunAPI que vous utilisez déjà pour le chat accède à tous les endpoints Wan et à tous les autres modèles RunAPI, sans plugin supplémentaire.

Hermes Agent peut-il utiliser la parole vers vidéo de Wan avec un modèle TTS ?

Oui. Hermes Agent peut générer la voix avec un modèle de synthèse vocale, puis transmettre l'URL audio à l'endpoint parole vers vidéo de Wan dans le même workflow.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.

Commencer à utiliser Wan avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter