ElevenLabs · Audio y música

Hermes Agent x ElevenLabs

ElevenLabs es una empresa de IA de voz cuyos modelos cubren TTS, diálogo, efectos de sonido, transcripción y separación de audio. A través de RunAPI, todos los endpoints de ElevenLabs comparten una sola key y facturación por llamada.

6 variants desde $0.04 / minuto Uso comercial compatible

Prerequisite: npx runapi mcp install

Prompt

Modelos del prompt

Usa audio-isolation cuando encaje con la tarea: Extracción vocal de fuentes de audio mixtas.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Extracción vocal de fuentes de audio mixtas
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Efectos de sonido desde texto para juegos, vídeo y podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transcripción en más de 29 idiomas con diarización de hablantes
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Generación de diálogos multi-hablante con turnos naturales
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 idiomas; expresión emocional más natural; ideal para audiolibros
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 idiomas; 3× más rápido en idiomas no ingleses; límite 40K caracteres
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Convierte este párrafo en voz natural con una voz masculina británica cálida, a ritmo moderado.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/isolate_audio y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/isolate_audio/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_sound y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_sound/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/speech_to_text y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/speech_to_text/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_dialogue y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_dialogue/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_speech y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_speech/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.

Versiones y endpoints públicos

ID del modelo Endpoints Precio inicial Catálogo
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minuto Detalle del modelo
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minuto Detalle del modelo
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minuto Detalle del modelo
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K caracteres Detalle del modelo
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K caracteres Detalle del modelo
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K caracteres Detalle del modelo

Verificar

Consulta hasta que la tarea alcance un estado final

Selecciona <model-id> para generar los comandos de verificación.

Configuración

Endpoint de la guía: <endpoint>

Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Cómo funciona

Empieza en 3 pasos

  1. Elige un ID de modelo

    Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.

  2. Configura RunAPI

    Define RUNAPI_API_KEY antes de enviar la solicitud al endpoint.

  3. Verifica el resultado

    Para endpoints asíncronos, consulta el mismo endpoint hasta que la Task alcance un estado final.

Qué puedes crear con Hermes Agent + ElevenLabs

  • Agentes de voz conversacionales

    Crea agentes de voz que hablan con naturalidad, con voz de baja latencia para bots de atención al cliente, asistentes o interfaces telefónicas.

  • Narración para contenido de YouTube

    Produce locuciones para vídeos de YouTube con voces de personaje coherentes en toda una serie.

  • Pipelines de texto a vídeo hablado

    Encadena la voz de ElevenLabs con un modelo de avatar parlante en un flujo de Hermes Agent para pasar de un texto a un vídeo narrado.

Por qué usar ElevenLabs con RunAPI + Hermes Agent

  • 6 variantes, una clave de API

    Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.

  • Precios de uso claros

    Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.

  • Flujos de tareas automáticos

    Envía tareas, consulta su estado y recopila resultados asíncronos con un flujo uniforme, sin escribir código de consulta manual.

Preguntas sobre Hermes Agent + ElevenLabs

¿Puedo usar ElevenLabs en Hermes Agent?

Sí. Configura RunAPI como proveedor en Hermes Agent y llama a cualquier endpoint de ElevenLabs de esta página, incluidos voz, transcripción, diálogo, efectos de sonido y aislamiento de audio.

¿Puedo transcribir audio con ElevenLabs en Hermes Agent?

Sí. Llama al endpoint de voz a texto con una URL de audio. Puede separar hablantes y etiquetar eventos de audio, y los resultados se devuelven de forma asíncrona.

¿Hermes Agent puede encadenar ElevenLabs con generación de vídeo?

Sí. Hermes Agent puede generar la voz con ElevenLabs y pasar la URL del audio a un modelo de avatar parlante o de voz a vídeo en la misma ejecución.

¿Qué ID de modelo debo usar?

Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.

¿Esta guía configura un modelo de chat?

No. Esta línea de modelos usa el flujo de endpoint mostrado y no se presenta como modelo de chat del agente.

Empieza a usar ElevenLabs con Hermes Agent

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros