Audio & Music · ElevenLabs

ElevenLabs API

Accès API ElevenLabs pour la synthèse vocale, le texte-vers-parole, les effets sonores, la parole-vers-texte et l'isolation audio.

Opérationnel · 6 variants · à partir de $0.040
runapi.ai
curl -X POST https://runapi.ai/api/v1/elevenlabs/isolate_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "text-to-speech-turbo-v2.5",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { ElevenlabsClient } from "@runapi.ai/elevenlabs";

const client = new ElevenlabsClient();
const result = await client.isolateAudio.run({
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\Elevenlabs\ElevenlabsClient;

$client = new ElevenlabsClient();
$result = $client->isolateAudio->run([
        'model' => 'text-to-speech-turbo-v2.5',
        'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
]);
require "runapi/elevenlabs"

client = RunApi::Elevenlabs::Client.new
result = client.isolate_audio.run(
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/elevenlabs -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/elevenlabs v1
APERÇU

ElevenLabs fournit une suite de modèles d'IA vocale couvrant le texte-vers-parole en plusieurs langues, la génération de dialogue, la création d'effets sonores, la transcription parole-vers-texte et l'isolation audio pour l'extraction vocale.

  • Variantes de modèle pour différents objectifs de qualité et de latence
  • API key unifiée
  • Le model skill inclut docs, schémas et notes de setup
  • Les générations échouées ne sont pas facturées
VARIANTES

Variantes

Variant Billing Pricing
audio-isolation minute $0.120 Voir →
sound-effect-v2 minute $0.150 Voir →
speech-to-text minute $0.040 Voir →
text-to-dialogue-v3 1K chars $0.140 Voir →
text-to-speech-multilingual-v2 1K chars $0.120 Voir →
text-to-speech-turbo-v2.5 1K chars $0.060 Voir →
MODELS

Installez le skill ElevenLabs pour développer des apps

Chargez les docs du modèle, les schémas, les notes de tarifs et les étapes de setup dans votre workspace de code.

# Install the model skill for app development workflows
npx skills add runapi-ai/elevenlabs -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the ElevenLabs skill for this app:

1. Add runapi-ai/elevenlabs with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
FONCTIONNEMENT

Construire avec ce model skill

01

Choisir le modèle

Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.

02

S'authentifier une fois

Utilisez votre clé RunAPI pour tous les modèles pris en charge.

03

Installer le skill

Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.

04

Recevoir la sortie

Interrogez par task ID ou traitez le callback quand la génération se termine.

CONTEXTE

Où utiliser ElevenLabs

ElevenLabs est une entreprise d'IA vocale dont les modèles couvrent le TTS, le dialogue, les effets sonores, la transcription et l'isolation audio. Via RunAPI, tous les endpoints ElevenLabs partagent une seule clé et une facturation par appel.

Provider
ElevenLabs
Modality
Audio & Music
POURQUOI RUNAPI

Pourquoi utiliser ElevenLabs via RunAPI

Une API key

Utilisez les mêmes identifiants pour les modèles et les fournisseurs.

Prêt pour les skills

Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.

Facturation prévisible

Les tarifs à l'usage sont visibles avant l'appel.

FAQ

Questions fréquentes

Quelle est la latence pour le texte-vers-parole ?

Turbo v2.5 offre ~250 ms de latence au premier octet. Turbo v2.5 et Multilingual v2 supportent tous les deux le streaming afin que la lecture commence avant la fin de la génération.

Combien de langues sont supportées ?

Jusqu'à 70+ langues avec les derniers modèles. Turbo v2.5 supporte 32 langues ; Multilingual v2 en supporte 29.

Puis-je cloner une voix personnalisée ?

Le clonage vocal est disponible sur la plateforme ElevenLabs. Via RunAPI, vous spécifiez un identifiant de voix depuis votre bibliothèque de voix ElevenLabs.

À quoi sert l'endpoint dialogue ?

Il génère de l'audio de conversation multi-locuteurs depuis un script, avec des voix distinctes pour chaque personnage et une prise de parole naturelle.

L'isolation audio supprime-t-elle le bruit de fond ?

Oui — elle sépare la parole du bruit de fond, de la musique et du son ambiant, produisant un audio vocal propre.

Comment appeler ce modèle ?

Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.

Les générations échouées coûtent-elles quelque chose ?

Les générations échouées ne sont pas facturées

Puis-je l'appeler depuis mon application ?

Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.

COMMENCER

Commencez à construire avec ElevenLabs.