ElevenLabs · 오디오 & 음악

Hermes Agent x ElevenLabs

ElevenLabs는 TTS, 대화, 음향 효과, 변환, 오디오 분리를 포함하는 모델을 갖춘 음성 AI 회사입니다. RunAPI를 통해 모든 ElevenLabs 엔드포인트가 하나의 키와 호출별 과금 방식을 공유합니다.

6 variants 최저 $0.04 / 분 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 audio-isolation를 사용하세요: 혼합 오디오 소스에서 보컬 추출.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: 혼합 오디오 소스에서 보컬 추출
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: 게임, 비디오, 팟캐스트용 텍스트-사운드 이펙트
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: 화자 분리 기능이 포함된 29개 이상 언어 전사
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: 자연스러운 순서 교대로 다중 화자 대화 생성
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29개 언어; 가장 생동감 있는 감정 표현; 오디오북에 이상적
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32개 언어; 비영어 3배 빠름; 40K 문자 제한
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: 이 단락을 따뜻한 영국 남성 목소리로 보통 속도로 자연스러운 음성으로 변환해 주세요.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/isolate_audio를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/isolate_audio/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_sound를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_sound/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/speech_to_text를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/speech_to_text/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_dialogue를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_dialogue/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_speech를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_speech/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / 분 모델 상세
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / 분 모델 상세
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / 분 모델 상세
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1,000자 모델 상세
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1,000자 모델 상세
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1,000자 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.

  3. 결과 검증

    비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.

Hermes Agent + ElevenLabs로 만들 수 있는 것

  • 대화형 음성 에이전트

    지연이 낮은 음성으로 자연스럽게 말하는 음성 에이전트를 만들어 고객 지원 봇, 어시스턴트, 전화 인터페이스에 활용합니다.

  • YouTube 콘텐츠 내레이션

    시리즈 전체에서 일관된 캐릭터 목소리로 YouTube 영상 보이스오버를 제작합니다.

  • 텍스트에서 말하는 영상까지의 파이프라인

    Hermes Agent 워크플로에서 ElevenLabs 음성과 토킹 아바타 모델을 연결해 텍스트로 내레이션 영상을 만듭니다.

ElevenLabs을(를) RunAPI + Hermes Agent로 사용하는 이유

  • 6개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 자동화된 작업 워크플로

    수동 폴링 코드를 작성하지 않고 일관된 작업 흐름으로 비동기 결과를 제출하고 확인하고 수집하세요.

Hermes Agent + ElevenLabs 자주 묻는 질문

Hermes Agent에서 ElevenLabs를 사용할 수 있나요?

네. Hermes Agent에서 RunAPI를 공급자로 설정하면 음성 합성, 전사, 대화, 효과음, 오디오 분리 등 이 페이지에 표시된 모든 ElevenLabs 엔드포인트를 호출할 수 있습니다.

Hermes Agent에서 ElevenLabs로 오디오를 전사할 수 있나요?

네. 오디오 URL로 음성 인식 엔드포인트를 호출하세요. 화자 구분과 오디오 이벤트 태깅을 지원하며, 결과는 비동기로 반환됩니다.

Hermes Agent가 ElevenLabs를 영상 생성과 연결할 수 있나요?

네. Hermes Agent는 ElevenLabs로 음성을 생성한 뒤, 같은 실행에서 오디오 URL을 토킹 아바타나 음성 투 비디오 모델에 넘길 수 있습니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.

Hermes Agent에서 ElevenLabs 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기