MeiGen-AI · 비디오

Hermes Agent x InfiniteTalk

InfiniteTalk는 초상 이미지와 오디오 입력으로부터 립싱크 애니메이션을 생성하는 MeiGen-AI의 오디오 구동 아바타 모델입니다. RunAPI를 통해 통합 API 액세스와 과금 방식을 공유합니다.

1 variants 최저 $0.12 / 초 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 infinitetalk-from-audio를 사용하세요: infinitetalk-from-audio.

You have access to RunAPI task tools for InfiniteTalk.

Available InfiniteTalk models:
- infinitetalk-from-audio: infinitetalk-from-audio
  endpoints: /api/v1/infinitetalk/audio_to_video
  request fields: model, source_image_url, source_audio_url, prompt

Use the model ID and endpoint that match the user's request.
Example prompt: 이 초상 사진을 첨부된 오디오 나레이션으로 자연스러운 머리 움직임과 립싱크로 애니메이션화해 주세요.
/api/v1/infinitetalk/audio_to_video: Submit the task, poll for its status, then verify the completed output. POST /api/v1/infinitetalk/audio_to_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/infinitetalk/audio_to_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
infinitetalk-from-audio
/api/v1/infinitetalk/audio_to_video
$0.12 / 초 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

POST /api/v1/infinitetalk/audio_to_video를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/infinitetalk/audio_to_video/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.

설정

가이드 엔드포인트: /api/v1/infinitetalk/audio_to_video

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/infinitetalk/audio_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "infinitetalk-from-audio",
  "source_image_url": "https://file.runapi.ai/portrait.png",
  "source_audio_url": "https://file.runapi.ai/narration.mp3",
  "prompt": "A natural speaking portrait."
}'
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.

  3. 결과 검증

    비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.

Hermes Agent + InfiniteTalk로 만들 수 있는 것

  • AI 진행자가 등장하는 YouTube 콘텐츠

    사진 한 장으로 YouTube 채널용 토킹 헤드 영상을 생성해, 직접 촬영하지 않고도 모든 영상에서 같은 진행자를 유지합니다.

  • 립싱크 영상 더빙

    다른 언어로 된 새 오디오 트랙에 맞춰 진행자를 움직여, 입 모양이 번역된 음성을 따라가게 합니다.

  • 긴 강의와 프레젠테이션 영상

    녹음한 내레이션과 강사 사진 한 장을 온라인 강좌, 웨비나, 사내 교육용 말하는 아바타 영상으로 바꿉니다.

InfiniteTalk을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 1개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 자동화된 작업 워크플로

    수동 폴링 코드를 작성하지 않고 일관된 작업 흐름으로 비동기 결과를 제출하고 확인하고 수집하세요.

Hermes Agent + InfiniteTalk 자주 묻는 질문

Hermes Agent에서 InfiniteTalk를 사용할 수 있나요?

네. Hermes Agent에서 RunAPI를 공급자로 설정하면, 에이전트는 RunAPI API 키로 오디오 파일과 참조 이미지를 담은 InfiniteTalk 작업을 보낼 수 있습니다.

InfiniteTalk 영상은 얼마나 길게 만들 수 있나요?

길이는 원본 오디오에 따라 정해집니다. InfiniteTalk는 제공한 음성 트랙 전체 길이 동안 참조 이미지를 움직입니다.

Hermes Agent 워크플로에서 InfiniteTalk를 다른 모델과 연결할 수 있나요?

네. Hermes Agent는 먼저 음성 합성 모델로 음성을 만든 뒤, 같은 실행에서 오디오 URL을 InfiniteTalk에 넘겨 아바타 영상을 생성할 수 있습니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.

Hermes Agent에서 InfiniteTalk 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기