Alibaba · 비디오

Hermes Agent x Wan

Wan은 사용 가능한 가장 완전한 오픈 웨이트 비디오 패밀리 중 하나인 Alibaba의 전 스펙트럼 비디오 및 이미지 모델 스위트입니다. RunAPI를 통해 모든 Wan 버전이 단일 키와 통합 과금 방식을 공유합니다.

18 variants 최저 $0.05 / 회 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 wan-2.2-a14b-image-to-video-turbo를 사용하세요: 2.2 아키텍처 기반 이미지 고정 비디오.

You have access to RunAPI task tools for Wan.

Available Wan models:
- wan-2.2-a14b-image-to-video-turbo: 2.2 아키텍처 기반 이미지 고정 비디오
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.2-a14b-speech-to-video-turbo: 오디오 입력이 비디오 모션과 립싱크를 구동
  endpoints: /api/v1/wan/speech_to_video
  request fields: model, source_image_url, source_audio_url, prompt
- wan-2.2-a14b-text-to-video-turbo: 오픈소스 A14B MoE; 기본 품질
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.2-animate-move: 2.2 베이스의 전문 모션 애니메이션
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.2-animate-replace: 2.2 베이스의 피사체 교체 애니메이션
  endpoints: /api/v1/wan/animate
  request fields: model, source_image_url, reference_video_url
- wan-2.5-image-to-video: 2.5에서 네이티브 오디오가 포함된 이미지 고정
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, duration_seconds, output_resolution
- wan-2.5-text-to-video: 네이티브 오디오 생성 + 2.2 대비 향상된 모션 사실감
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt, output_resolution
- wan-2.6-edit-video: 피사체 + 카메라 제어를 갖춘 비디오 편집
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt
- wan-2.6-flash-edit-video: 속도 최적화된 2.6 비디오 편집
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, audio
- wan-2.6-flash-image-to-video: 속도 최적화된 2.6; 더 낮은 비용, 빠른 추론
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url, audio
- wan-2.6-image-to-video: 2.6 장면 연속성이 포함된 이미지 고정
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.6-text-to-video: 향상된 장면 연속성 + 복잡한 장면 지원
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-edit-video: wan-2.7-edit-video
  endpoints: /api/v1/wan/edit_video
  request fields: model, source_video_urls, prompt, source_video_url
- wan-2.7-image: 2.7 아키텍처 기반 표준 이미지 생성
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-pro: 3×3 다각도 이미지 그리드; 최고 품질 이미지 출력
  endpoints: /api/v1/wan/text_to_image
  request fields: model, prompt
- wan-2.7-image-to-video: 2.7 다중 참조 지원이 포함된 이미지 고정
  endpoints: /api/v1/wan/image_to_video
  request fields: model, prompt, first_frame_image_url
- wan-2.7-r2v: 캐릭터 외형 + 음성 참조가 포함된 R2V 텍스트-비디오
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt
- wan-2.7-text-to-video: 첫-마지막 프레임 제어; 동시 비디오 참조 5개
  endpoints: /api/v1/wan/text_to_video
  request fields: model, prompt

Use the model ID and endpoint that match the user's request.
Example prompt: 자연스러운 실내 조명과 핸드헬드 카메라 느낌으로 고양이가 책장 위로 뛰어오르는 5초짜리 영상을 생성해 주세요.
/api/v1/wan/image_to_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/image_to_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/image_to_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/wan/speech_to_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/speech_to_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/speech_to_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/wan/text_to_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/text_to_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/text_to_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/wan/animate: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/animate를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/animate/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/wan/edit_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/edit_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/edit_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/wan/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/wan/text_to_image를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/wan/text_to_image/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
wan-2.2-a14b-image-to-video-turbo
/api/v1/wan/image_to_video
$0.40 / 회 모델 상세
wan-2.2-a14b-speech-to-video-turbo
/api/v1/wan/speech_to_video
$0.24 / 초 모델 상세
wan-2.2-a14b-text-to-video-turbo
/api/v1/wan/text_to_video
$0.40 / 회 모델 상세
wan-2.2-animate-move
/api/v1/wan/animate
$0.13 / 초 모델 상세
wan-2.2-animate-replace
/api/v1/wan/animate
$0.13 / 초 모델 상세
wan-2.5-image-to-video
/api/v1/wan/image_to_video
$0.12 / 초 모델 상세
wan-2.5-text-to-video
/api/v1/wan/text_to_video
$0.12 / 초 모델 상세
wan-2.6-edit-video
/api/v1/wan/edit_video
$0.14 / 초 모델 상세
wan-2.6-flash-edit-video
/api/v1/wan/edit_video
$0.30 / 회 모델 상세
wan-2.6-flash-image-to-video
/api/v1/wan/image_to_video
$9.44 / 회 모델 상세
wan-2.6-image-to-video
/api/v1/wan/image_to_video
$0.58 / 초 모델 상세
wan-2.6-text-to-video
/api/v1/wan/text_to_video
$0.58 / 초 모델 상세
wan-2.7-edit-video
/api/v1/wan/edit_video
$0.16 / 초 모델 상세
wan-2.7-image
/api/v1/wan/text_to_image
$0.05 / 회 모델 상세
wan-2.7-image-pro
/api/v1/wan/text_to_image
$0.12 / 회 모델 상세
wan-2.7-image-to-video
/api/v1/wan/image_to_video
$0.16 / 초 모델 상세
wan-2.7-r2v
/api/v1/wan/text_to_video
$0.16 / 초 모델 상세
wan-2.7-text-to-video
/api/v1/wan/text_to_video
$0.16 / 초 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.

  3. 결과 검증

    비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.

Hermes Agent + Wan로 만들 수 있는 것

  • 대량 브랜드 콘텐츠

    Wan의 캐릭터 일관성을 활용해 브랜드 영상을 대규모로 제작하고, Hermes Agent가 제품 라인별 작업을 병렬로 배분합니다.

  • 립싱크가 들어간 대화 콘텐츠

    하나의 Hermes Agent 워크플로에서 음성 합성 모델과 Wan의 음성 투 비디오 엔드포인트를 연결해 대본에서 말하는 영상까지 완성합니다.

  • 영상 제작자와 에이전시를 위한 사전 시각화

    키프레임을 고정한 사전 시각화 클립을 생성하고, 첫 프레임과 마지막 프레임을 설정해 고객 검토용 장면 전환을 제어합니다.

Wan을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 18개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 자동화된 작업 워크플로

    수동 폴링 코드를 작성하지 않고 일관된 작업 흐름으로 비동기 결과를 제출하고 확인하고 수집하세요.

Hermes Agent + Wan 자주 묻는 질문

Hermes Agent에서 어떤 Wan 엔드포인트를 호출할 수 있나요?

이 페이지에 표시된 모든 Wan 엔드포인트를 호출할 수 있습니다. RunAPI를 공급자로 한 번 설정하면 요청마다 엔드포인트와 모델 버전을 바꿀 수 있습니다.

Hermes Agent에서 Wan을 쓰려면 추가 설정이 필요한가요?

아니요. 채팅에 이미 쓰고 있는 RunAPI 공급자로 추가 플러그인 없이 모든 Wan 엔드포인트와 다른 RunAPI 모델에 접근할 수 있습니다.

Hermes Agent가 Wan의 음성 투 비디오를 TTS 모델과 함께 쓸 수 있나요?

네. Hermes Agent는 음성 합성 모델로 음성을 만든 뒤, 같은 워크플로에서 오디오 URL을 Wan의 음성 투 비디오 엔드포인트에 넘길 수 있습니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.

Hermes Agent에서 Wan 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기