Audio & Music · ElevenLabs

ElevenLabs API

Acceso a la API de ElevenLabs para síntesis de voz, texto a voz, efectos de sonido, voz a texto y separación de audio.

Operativo · 6 variants · desde $0.040
runapi.ai
curl -X POST https://runapi.ai/api/v1/elevenlabs/isolate_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "text-to-speech-turbo-v2.5",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { ElevenlabsClient } from "@runapi.ai/elevenlabs";

const client = new ElevenlabsClient();
const result = await client.isolateAudio.run({
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\Elevenlabs\ElevenlabsClient;

$client = new ElevenlabsClient();
$result = $client->isolateAudio->run([
        'model' => 'text-to-speech-turbo-v2.5',
        'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
]);
require "runapi/elevenlabs"

client = RunApi::Elevenlabs::Client.new
result = client.isolate_audio.run(
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/elevenlabs -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/elevenlabs v1
RESUMEN

ElevenLabs ofrece un conjunto de modelos de IA de voz que cubren texto a voz, generación de diálogos, creación de efectos de sonido, transcripción de voz a texto y separación de audio. Sus modelos TTS soportan múltiples idiomas con prosodia natural.

  • Variantes para distintos objetivos de calidad y latencia
  • API key unificada
  • El model skill incluye documentación, schemas y notas de setup
  • Las generaciones fallidas no se cobran
VARIANTES

Variantes

Variant Billing Pricing
audio-isolation minute $0.120 Ver →
sound-effect-v2 minute $0.150 Ver →
speech-to-text minute $0.040 Ver →
text-to-dialogue-v3 1K chars $0.140 Ver →
text-to-speech-multilingual-v2 1K chars $0.120 Ver →
text-to-speech-turbo-v2.5 1K chars $0.060 Ver →
MODELS

Instala el skill de ElevenLabs para desarrollar apps

Carga documentación del modelo, schemas, notas de precios y pasos de setup en tu workspace de código.

# Install the model skill for app development workflows
npx skills add runapi-ai/elevenlabs -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the ElevenLabs skill for this app:

1. Add runapi-ai/elevenlabs with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
CÓMO FUNCIONA

Cómo construir con este model skill

01

Elige el modelo

Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

02

Autentica una vez

Usa tu clave RunAPI para todos los modelos compatibles.

03

Instala el skill

Añade el model skill a tu workspace de código antes de implementar la función.

04

Recibe la salida

Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja ElevenLabs

ElevenLabs es una empresa de IA de voz cuyos modelos cubren TTS, diálogo, efectos de sonido, transcripción y separación de audio. A través de RunAPI, todos los endpoints de ElevenLabs comparten una sola key y facturación por llamada.

Provider
ElevenLabs
Modality
Audio & Music
POR QUÉ RUNAPI

Por qué usar ElevenLabs mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

FAQ

Preguntas frecuentes

¿Cuál es la latencia del texto a voz?

Turbo v2.5 ofrece una latencia de primer byte de ~250ms. Tanto Turbo v2.5 como Multilingual v2 soportan streaming para que la reproducción comience antes de que finalice la generación.

¿Cuántos idiomas están soportados?

Hasta 70+ idiomas con los últimos modelos. Turbo v2.5 soporta 32 idiomas; Multilingual v2 soporta 29.

¿Puedo clonar una voz personalizada?

La clonación de voz está disponible en la plataforma de ElevenLabs. A través de RunAPI, especificas un ID de voz de tu biblioteca de voces de ElevenLabs.

¿Para qué sirve el endpoint de diálogo?

Genera audio de conversación con múltiples hablantes a partir de un guion, con voces distintas para cada personaje y turnos naturales.

¿La separación de audio elimina el ruido de fondo?

Sí — separa la voz del ruido de fondo, la música y el sonido ambiental, produciendo audio vocal limpio.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

¿Las generaciones fallidas cuestan dinero?

Las generaciones fallidas no se cobran

¿Puedo llamarlo desde mi aplicación?

Sí. Instala el model skill en tu workspace de código y úsalo mientras añades la función del modelo.

EMPEZAR

Empieza a construir con ElevenLabs.