공개 버전 및 엔드포인트
| 모델 ID | 엔드포인트 | 시작 가격 | 모델 카탈로그 |
|---|---|---|---|
audio-isolation
|
/api/v1/elevenlabs/isolate_audio
|
$0.12 / 분 | 모델 상세 |
sound-effect-v2
|
/api/v1/elevenlabs/text_to_sound
|
$0.15 / 분 | 모델 상세 |
speech-to-text
|
/api/v1/elevenlabs/speech_to_text
|
$0.04 / 분 | 모델 상세 |
text-to-dialogue-v3
|
/api/v1/elevenlabs/text_to_dialogue
|
$0.14 / 1,000자 | 모델 상세 |
text-to-speech-multilingual-v2
|
/api/v1/elevenlabs/text_to_speech
|
$0.12 / 1,000자 | 모델 상세 |
text-to-speech-turbo-v2.5
|
/api/v1/elevenlabs/text_to_speech
|
$0.06 / 1,000자 | 모델 상세 |
검증
Task가 최종 상태에 도달할 때까지 폴링합니다
<model-id>를 선택하면 검증 명령을 생성합니다.
설정
가이드 엔드포인트: <endpoint>
<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
3단계로 시작하기
-
모델 ID 선택
공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.
-
RunAPI 설정
엔드포인트 요청 전에 RUNAPI_API_KEY를 설정합니다.
-
결과 검증
비동기 엔드포인트는 Task가 최종 상태가 될 때까지 같은 엔드포인트를 폴링합니다.
Hermes Agent + ElevenLabs로 만들 수 있는 것
-
대화형 음성 에이전트
지연이 낮은 음성으로 자연스럽게 말하는 음성 에이전트를 만들어 고객 지원 봇, 어시스턴트, 전화 인터페이스에 활용합니다.
-
YouTube 콘텐츠 내레이션
시리즈 전체에서 일관된 캐릭터 목소리로 YouTube 영상 보이스오버를 제작합니다.
-
텍스트에서 말하는 영상까지의 파이프라인
Hermes Agent 워크플로에서 ElevenLabs 음성과 토킹 아바타 모델을 연결해 텍스트로 내레이션 영상을 만듭니다.
ElevenLabs을(를) RunAPI + Hermes Agent로 사용하는 이유
-
6개 변형 모델, 하나의 API 키
하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.
-
명확한 사용 요금
요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.
-
자동화된 작업 워크플로
수동 폴링 코드를 작성하지 않고 일관된 작업 흐름으로 비동기 결과를 제출하고 확인하고 수집하세요.
Hermes Agent + ElevenLabs 자주 묻는 질문
Hermes Agent에서 ElevenLabs를 사용할 수 있나요?
네. Hermes Agent에서 RunAPI를 공급자로 설정하면 음성 합성, 전사, 대화, 효과음, 오디오 분리 등 이 페이지에 표시된 모든 ElevenLabs 엔드포인트를 호출할 수 있습니다.
Hermes Agent에서 ElevenLabs로 오디오를 전사할 수 있나요?
네. 오디오 URL로 음성 인식 엔드포인트를 호출하세요. 화자 구분과 오디오 이벤트 태깅을 지원하며, 결과는 비동기로 반환됩니다.
Hermes Agent가 ElevenLabs를 영상 생성과 연결할 수 있나요?
네. Hermes Agent는 ElevenLabs로 음성을 생성한 뒤, 같은 실행에서 오디오 URL을 토킹 아바타나 음성 투 비디오 모델에 넘길 수 있습니다.
어떤 모델 ID를 사용해야 하나요?
버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.
이 가이드는 채팅 모델을 설정하나요?
아니요. 이 Model Line은 여기에 표시된 엔드포인트 절차를 사용하며 Agent 채팅 모델로 제공되지 않습니다.