ElevenLabs · Áudio & Música

Hermes Agent x ElevenLabs

ElevenLabs é uma empresa de voz com IA cujos modelos cobrem TTS, diálogo, efeitos sonoros, transcrição e isolamento de áudio. Pelo RunAPI, todos os endpoints da ElevenLabs compartilham uma única key e cobrança por chamada.

6 variants a partir de $0.04 / minuto Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use audio-isolation quando ele corresponder à tarefa: Extração vocal de fontes de áudio mistas.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Extração vocal de fontes de áudio mistas
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Text-to-sound effects para jogos, vídeo e podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transcrição em 29+ idiomas com diarização de falantes
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Geração de diálogos multi-falantes com turnos naturais
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 idiomas; expressão emocional mais realista; ideal para audiobooks
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 idiomas; 3× mais rápido em não-inglês; limite de 40K chars
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Converta este parágrafo em fala natural com uma voz masculina britânica calorosa em ritmo moderado.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Envie POST para /api/v1/elevenlabs/isolate_audio e salve o ID da Task retornada.
Envie GET para /api/v1/elevenlabs/isolate_audio/<task-id> até o status ser completed ou failed.
Verifique se a resposta completed contém a saída específica do endpoint documentada na referência da API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Envie POST para /api/v1/elevenlabs/text_to_sound e salve o ID da Task retornada.
Envie GET para /api/v1/elevenlabs/text_to_sound/<task-id> até o status ser completed ou failed.
Verifique se a resposta completed contém a saída específica do endpoint documentada na referência da API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Envie POST para /api/v1/elevenlabs/speech_to_text e salve o ID da Task retornada.
Envie GET para /api/v1/elevenlabs/speech_to_text/<task-id> até o status ser completed ou failed.
Verifique se a resposta completed contém a saída específica do endpoint documentada na referência da API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Envie POST para /api/v1/elevenlabs/text_to_dialogue e salve o ID da Task retornada.
Envie GET para /api/v1/elevenlabs/text_to_dialogue/<task-id> até o status ser completed ou failed.
Verifique se a resposta completed contém a saída específica do endpoint documentada na referência da API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Envie POST para /api/v1/elevenlabs/text_to_speech e salve o ID da Task retornada.
Envie GET para /api/v1/elevenlabs/text_to_speech/<task-id> até o status ser completed ou failed.
Verifique se a resposta completed contém a saída específica do endpoint documentada na referência da API.

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minuto Detalhes do modelo
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minuto Detalhes do modelo
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minuto Detalhes do modelo
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K caracteres Detalhes do modelo
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K caracteres Detalhes do modelo
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K caracteres Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Defina RUNAPI_API_KEY antes de enviar a solicitação ao endpoint.

  3. Verifique o resultado

    Para endpoints assíncronos, consulte o mesmo endpoint até que a Task alcance um estado final.

O que criar com Hermes Agent + ElevenLabs

  • Agentes de voz conversacionais

    Crie agentes de voz que falam com naturalidade, com fala de baixa latência para bots de atendimento, assistentes ou interfaces por telefone.

  • Narração para conteúdo do YouTube

    Produza locuções para vídeos do YouTube com vozes de personagens consistentes em uma série inteira.

  • Pipelines de texto para vídeo falado

    Encadeie a fala do ElevenLabs com um modelo de avatar falante em um fluxo do Hermes Agent para ir do texto a um vídeo narrado.

Por que usar ElevenLabs pelo RunAPI + Hermes Agent

  • 6 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Fluxos de tarefas automáticos

    Envie tarefas, consulte seu status e reúna resultados assíncronos em um fluxo uniforme, sem escrever código de consulta manual.

Perguntas sobre Hermes Agent + ElevenLabs

Posso usar o ElevenLabs no Hermes Agent?

Sim. Configure a RunAPI como provedor no Hermes Agent e chame qualquer endpoint do ElevenLabs desta página, incluindo fala, transcrição, diálogo, efeitos sonoros e isolamento de áudio.

Posso transcrever áudio com o ElevenLabs no Hermes Agent?

Sim. Chame o endpoint de fala para texto com uma URL de áudio. Ele separa falantes e marca eventos de áudio, e os resultados são retornados de forma assíncrona.

O Hermes Agent pode encadear o ElevenLabs com geração de vídeo?

Sim. O Hermes Agent pode gerar a fala com o ElevenLabs e passar a URL do áudio a um modelo de avatar falante ou de fala para vídeo na mesma execução.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Não. Esta linha de modelos usa o fluxo de endpoint mostrado aqui e não é apresentada como modelo de chat do agente.

Comece a usar ElevenLabs com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco