ElevenLabs · Audio y música

OpenClaw x ElevenLabs

ElevenLabs es una empresa de IA de voz cuyos modelos cubren TTS, diálogo, efectos de sonido, transcripción y separación de audio. A través de RunAPI, todos los endpoints de ElevenLabs comparten una sola key y facturación por llamada.

6 variants desde $0.04 / minuto Uso comercial compatible

Prerequisite: npx runapi mcp install

Prompt

Modelos del prompt

Usa audio-isolation cuando encaje con la tarea: Extracción vocal de fuentes de audio mixtas.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Extracción vocal de fuentes de audio mixtas
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Efectos de sonido desde texto para juegos, vídeo y podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transcripción en más de 29 idiomas con diarización de hablantes
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Generación de diálogos multi-hablante con turnos naturales
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 idiomas; expresión emocional más natural; ideal para audiolibros
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 idiomas; 3× más rápido en idiomas no ingleses; límite 40K caracteres
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Convierte este párrafo en voz natural con una voz masculina británica cálida, a ritmo moderado.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/isolate_audio y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/isolate_audio/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_sound y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_sound/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/speech_to_text y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/speech_to_text/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_dialogue y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_dialogue/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Haz POST a /api/v1/elevenlabs/text_to_speech y guarda el ID de la Task devuelta.
Haz GET a /api/v1/elevenlabs/text_to_speech/<task-id> hasta que el estado sea completed o failed.
Comprueba que la respuesta completed incluya la salida específica del endpoint documentada en la referencia de la API.

Versiones y endpoints públicos

ID del modelo Endpoints Precio inicial Catálogo
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minuto Detalle del modelo
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minuto Detalle del modelo
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minuto Detalle del modelo
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K caracteres Detalle del modelo
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K caracteres Detalle del modelo
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K caracteres Detalle del modelo

Verificar

Consulta hasta que la tarea alcance un estado final

Selecciona <model-id> para generar los comandos de verificación.

Configuración

Endpoint de la guía: <endpoint>

Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Cómo funciona

Empieza en 3 pasos

  1. Elige un ID de modelo

    Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.

  2. Configura RunAPI

    Define RUNAPI_API_KEY antes de enviar la solicitud al endpoint.

  3. Verifica el resultado

    Para endpoints asíncronos, consulta el mismo endpoint hasta que la Task alcance un estado final.

Qué puedes crear con OpenClaw + ElevenLabs

  • Narración de audiolibros y pódcasts

    Convierte textos largos en audio hablado con voces de personaje coherentes durante horas de contenido.

  • Doblaje de vídeo a varios idiomas

    Dobla contenido de vídeo a otros idiomas con el mismo perfil de voz y crea versiones localizadas que conservan el carácter vocal del hablante.

  • Efectos de sonido para vídeo y videojuegos

    Genera efectos de sala, sonido ambiente y señales sonoras a partir de descripciones de texto en lugar de buscar en bibliotecas de audio de archivo.

Por qué usar ElevenLabs con RunAPI + OpenClaw

  • 6 variantes, una clave de API

    Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.

  • Precios de uso claros

    Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.

  • Flujos de tareas automáticos

    Envía tareas, consulta su estado y recopila resultados asíncronos con un flujo uniforme, sin escribir código de consulta manual.

Preguntas sobre OpenClaw + ElevenLabs

¿Qué ajustes de voz suenan más naturales?

Una estabilidad mayor hace la voz más constante pero menos expresiva, y una similitud mayor la mantiene más cerca del perfil original. Usa más estabilidad para narración y menos para contenido conversacional.

¿Cómo gestiono contenido largo como audiolibros?

Divide los textos largos en fragmentos, envía una petición por fragmento y procesa los capítulos en paralelo en lugar de uno tras otro.

¿Puedo crear audio con varios hablantes en OpenClaw?

Sí. Llama al endpoint de diálogo con una lista de líneas, cada una asociada a una voz, y ElevenLabs devuelve una conversación con varios hablantes.

¿Qué ID de modelo debo usar?

Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.

¿Esta guía configura un modelo de chat?

No. Esta línea de modelos usa el flujo de endpoint mostrado y no se presenta como modelo de chat del agente.

Empieza a usar ElevenLabs con OpenClaw

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros