Alibaba · Video

OpenClaw x Wan

Wan ist Alibabas vollständige Video- und Bildmodell-Suite, eine der umfangreichsten verfügbaren Open-Weight-Videofamilien. Über RunAPI teilen alle Wan-Versionen einen gemeinsamen Key und einheitliche Abrechnung.

18 variants ab $0.05 / Aufruf Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende wan-2.2-a14b-image-to-video-turbo, wenn es zur Aufgabe passt: Bildverankertes Video auf der 2.2-Architektur.

You have access to RunAPI task tools for Wan.

Available Wan models:
- wan-2.2-a14b-image-to-video-turbo: Bildverankertes Video auf der 2.2-Architektur
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.2-a14b-speech-to-video-turbo: Audio-Eingabe steuert Videobewegung und Lip-Sync
  endpoints: /api/v1/wan/speech_to_video
  request fields: model, source_image_url, source_audio_url, prompt
- wan-2.2-a14b-text-to-video-turbo: Open-Source A14B MoE; Baseline-Qualität
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.2-animate-move: Spezialisierte Bewegungsanimation auf 2.2-Basis
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.2-animate-replace: Subjekt-Ersetzungsanimation auf 2.2-Basis
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.5-image-to-video: Bildverankert mit nativem Audio auf 2.5
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, duration_seconds, output_resolution
- wan-2.5-text-to-video: Native Audio-Generierung + besserer Bewegungsrealismus vs. 2.2
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt, output_resolution
- wan-2.6-edit-video: Video-Editing mit Subjekt- und Kamerakontrolle
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt
- wan-2.6-flash-edit-video: Geschwindigkeitsoptimiertes 2.6-Video-Editing
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, audio
- wan-2.6-flash-image-to-video: Geschwindigkeitsoptimiertes 2.6; niedrigere Kosten, schnellere Inferenz
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, audio
- wan-2.6-image-to-video: Bildverankert mit 2.6-Szenenkontinuität
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.6-text-to-video: Verbesserte Szenenkontinuität + Unterstützung komplexer Szenen
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-edit-video: wan-2.7-edit-video
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, source_video_url
- wan-2.7-image: Standard-Bildgenerierung auf 2.7-Architektur
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-pro: 3×3-Multi-Winkel-Bildraster; höchste Bildausgabequalität
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-to-video: Bildverankert mit 2.7-Multi-Referenz-Unterstützung
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.7-r2v: R2V Text-zu-Video mit Charakter-Erscheinungs- und Stimm-Referenzen
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-text-to-video: Erster-und-letzter-Frame-Kontrolle; 5 gleichzeitige Video-Referenzen
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt

Use the model ID and endpoint that match the user's request.
Example prompt: Generiere ein 5-sekündiges Video einer Katze, die auf ein Bücherregal springt, natürliche Innenbeleuchtung, Handkamera-Feeling.
/api/v1/wan/image_to_video: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/image_to_video und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/image_to_video/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/wan/speech_to_video: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/speech_to_video und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/speech_to_video/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/wan/text_to_video: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/text_to_video und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/text_to_video/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/wan/animate: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/animate und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/animate/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/wan/edit_video: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/edit_video und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/edit_video/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/wan/text_to_image: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/wan/text_to_image und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/wan/text_to_image/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
wan-2.2-a14b-image-to-video-turbo
/api/v1/wan/image_to_video
$0.40 / Aufruf Modelldetails
wan-2.2-a14b-speech-to-video-turbo
/api/v1/wan/speech_to_video
$0.24 / Sekunde Modelldetails
wan-2.2-a14b-text-to-video-turbo
/api/v1/wan/text_to_video
$0.40 / Aufruf Modelldetails
wan-2.2-animate-move
/api/v1/wan/animate
$0.13 / Sekunde Modelldetails
wan-2.2-animate-replace
/api/v1/wan/animate
$0.13 / Sekunde Modelldetails
wan-2.5-image-to-video
/api/v1/wan/image_to_video
$0.12 / Sekunde Modelldetails
wan-2.5-text-to-video
/api/v1/wan/text_to_video
$0.12 / Sekunde Modelldetails
wan-2.6-edit-video
/api/v1/wan/edit_video
$0.14 / Sekunde Modelldetails
wan-2.6-flash-edit-video
/api/v1/wan/edit_video
$0.30 / Aufruf Modelldetails
wan-2.6-flash-image-to-video
/api/v1/wan/image_to_video
$9.44 / Aufruf Modelldetails
wan-2.6-image-to-video
/api/v1/wan/image_to_video
$0.58 / Sekunde Modelldetails
wan-2.6-text-to-video
/api/v1/wan/text_to_video
$0.58 / Sekunde Modelldetails
wan-2.7-edit-video
/api/v1/wan/edit_video
$0.16 / Sekunde Modelldetails
wan-2.7-image
/api/v1/wan/text_to_image
$0.05 / Aufruf Modelldetails
wan-2.7-image-pro
/api/v1/wan/text_to_image
$0.12 / Aufruf Modelldetails
wan-2.7-image-to-video
/api/v1/wan/image_to_video
$0.16 / Sekunde Modelldetails
wan-2.7-r2v
/api/v1/wan/text_to_video
$0.16 / Sekunde Modelldetails
wan-2.7-text-to-video
/api/v1/wan/text_to_video
$0.16 / Sekunde Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Setze RUNAPI_API_KEY, bevor du die Endpunktanfrage sendest.

  3. Ergebnis überprüfen

    Frage bei asynchronen Endpunkten denselben Endpunkt ab, bis die Task einen Endstatus erreicht.

Was du mit OpenClaw + Wan bauen kannst

  • Vom Storyboard zum Video

    Verankere Clips an Anfangs- und Endframes, um Storyboard-Panels in Videosequenzen mit visueller Kontinuität über mehrere Einstellungen zu verwandeln.

  • Virtuelle Präsentatoren und Markenmaskottchen

    Erzeuge Talking-Head-Videos aus einem Gesichtsbild und einer Audiodatei; Lippensynchronität und Kopfbewegung übernimmt das Modell.

  • Sequenzen mit konsistenten Figuren

    Baue erzählende Inhalte, in denen dieselbe Figur in mehreren Clips erscheint und Gesichter sowie Outfits zwischen den Einstellungen stabil bleiben.

Warum Wan über RunAPI + OpenClaw nutzen

  • 18 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Automatische Task-Workflows

    Sende Tasks, frage ihren Status ab und sammle asynchrone Ergebnisse in einem einheitlichen Ablauf ohne eigenen Polling-Code.

Fragen zu OpenClaw + Wan

Welche Wan-Endpunkte kann ich aus OpenClaw aufrufen?

Jeden Wan-Endpunkt auf dieser Seite, darunter Videoerzeugung, Bild-zu-Video, Sprache-zu-Video, Videobearbeitung und Bilderzeugung. Jeder Endpunkt nutzt seine eigene Modellversion.

Wie funktioniert Sprache-zu-Video mit Wan?

Übergib eine Audiodatei und ein Gesichtsbild. Wan erzeugt ein lippensynchrones Video, in dem das Gesicht den Ton spricht.

Ist Wan Open Source?

Wan wird mit offenen Gewichten veröffentlicht. Über RunAPI sparst du dir die GPU-Einrichtung und nutzt es mit einem API-Schlüssel; wenn du eine selbst gehostete Pipeline brauchst, laufen dieselben Gewichte auf deiner eigenen Infrastruktur.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Nein. Diese Modelllinie verwendet den hier gezeigten Endpunktablauf und wird nicht als Agent-Chatmodell dargestellt.

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen