ElevenLabs · 오디오 & 음악

OpenClaw x ElevenLabs

ElevenLabs는 TTS, 대화, 음향 효과, 변환, 오디오 분리를 포함하는 모델을 갖춘 음성 AI 회사입니다. RunAPI를 통해 모든 ElevenLabs 엔드포인트가 하나의 키와 호출별 과금 방식을 공유합니다.

6 variants 최저 $0.04 / 분 상업적 사용 지원

Prerequisite: npx runapi mcp install

Prompt

프롬프트 모델

작업에 맞는 경우 audio-isolation를 사용하세요: 혼합 오디오 소스에서 보컬 추출.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: 혼합 오디오 소스에서 보컬 추출
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: 게임, 비디오, 팟캐스트용 텍스트-사운드 이펙트
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: 화자 분리 기능이 포함된 29개 이상 언어 전사
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: 자연스러운 순서 교대로 다중 화자 대화 생성
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29개 언어; 가장 생동감 있는 감정 표현; 오디오북에 이상적
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32개 언어; 비영어 3배 빠름; 40K 문자 제한
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: 이 단락을 따뜻한 영국 남성 목소리로 보통 속도로 자연스러운 음성으로 변환해 주세요.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/isolate_audio를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/isolate_audio/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_sound를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_sound/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/speech_to_text를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/speech_to_text/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_dialogue를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_dialogue/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. POST /api/v1/elevenlabs/text_to_speech를 실행하고 반환된 Task ID를 저장합니다.
상태가 completed 또는 failed가 될 때까지 GET /api/v1/elevenlabs/text_to_speech/<task-id>를 실행합니다.
completed 응답에 API 레퍼런스의 엔드포인트별 출력이 포함되는지 확인합니다.

공개 버전 및 엔드포인트

모델 ID 엔드포인트 시작 가격 모델 카탈로그
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / 분 모델 상세
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / 분 모델 상세
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / 분 모델 상세
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1,000자 모델 상세
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1,000자 모델 상세
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1,000자 모델 상세

검증

Task가 최종 상태에 도달할 때까지 폴링합니다

<model-id>를 선택하면 검증 명령을 생성합니다.

설정

가이드 엔드포인트: <endpoint>

<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
사용 절차

3단계로 시작하기

  1. 모델 ID 선택

    공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.

  2. RunAPI 설정

    엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.

  3. 결과 검증

    비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.

OpenClaw + ElevenLabs로 만들 수 있는 것

  • 오디오북과 팟캐스트 내레이션

    긴 텍스트를 음성으로 변환하고, 몇 시간 분량의 콘텐츠에서도 캐릭터 목소리를 일관되게 유지합니다.

  • 여러 언어로 영상 더빙

    같은 음성 프로필로 영상을 다른 언어로 더빙해, 화자의 목소리 특징을 유지한 현지화 버전을 만듭니다.

  • 영상과 게임용 효과음

    스톡 오디오 라이브러리를 뒤지는 대신 텍스트 설명으로 폴리, 환경음, 효과음을 생성합니다.

ElevenLabs을(를) RunAPI + OpenClaw로 사용하는 이유

  • 6개 변형 모델, 하나의 API 키

    하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.

  • 명확한 사용 요금

    요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.

  • 자동화된 작업 워크플로

    수동 폴링 코드를 작성하지 않고 일관된 작업 흐름으로 비동기 결과를 제출하고 확인하고 수집하세요.

OpenClaw + ElevenLabs 자주 묻는 질문

어떤 음성 설정이 가장 자연스럽게 들리나요?

안정성을 높이면 목소리가 일정해지지만 표현력은 줄고, 유사도를 높이면 원래 음성 프로필에 더 가까워집니다. 내레이션에는 안정성을 높이고, 대화형 콘텐츠에는 낮추세요.

오디오북 같은 긴 콘텐츠는 어떻게 처리하나요?

긴 텍스트를 여러 조각으로 나누어 조각마다 요청을 하나씩 보내고, 장을 순서대로가 아니라 병렬로 처리하세요.

OpenClaw에서 여러 화자의 오디오를 만들 수 있나요?

네. 각 대사에 음성을 지정한 목록으로 대화 엔드포인트를 호출하면 ElevenLabs가 여러 화자가 참여하는 대화 하나를 반환합니다.

어떤 모델 ID를 사용해야 하나요?

버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.

이 가이드는 채팅 모델을 설정하나요?

아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.

OpenClaw에서 ElevenLabs 사용 시작하기

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기