Audio & Music · ElevenLabs

ElevenLabs API

ElevenLabs API-Zugang für Sprachsynthese, Text-zu-Sprache, Soundeffekte, Speech-zu-Text und Audio-Isolation.

Betriebsbereit · 6 variants · ab $0.040
runapi.ai
curl -X POST https://runapi.ai/api/v1/elevenlabs/isolate_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "text-to-speech-turbo-v2.5",
  "audio_url": "https://cdn.runapi.ai/public/samples/voice.mp3"
}'
import { ElevenlabsClient } from "@runapi.ai/elevenlabs";

const client = new ElevenlabsClient();
const result = await client.isolateAudio.run({
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\Elevenlabs\ElevenlabsClient;

$client = new ElevenlabsClient();
$result = $client->isolateAudio->run([
        'model' => 'text-to-speech-turbo-v2.5',
        'audio_url' => 'https://cdn.runapi.ai/public/samples/voice.mp3',
]);
require "runapi/elevenlabs"

client = RunApi::Elevenlabs::Client.new
result = client.isolate_audio.run(
    model: "text-to-speech-turbo-v2.5",
    audio_url: "https://cdn.runapi.ai/public/samples/voice.mp3"
)
npx skills add runapi-ai/elevenlabs -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/elevenlabs v1
ÜBERBLICK

ElevenLabs bietet eine Suite von Sprach-KI-Modellen, die Text-zu-Sprache, Dialog-Generierung, Soundeffekt-Erstellung, Speech-zu-Text-Transkription und Audio-Isolation abdecken. Die TTS-Modelle unterstützen mehrere Sprachen mit natürlicher Prosodie.

  • Modellvarianten für verschiedene Qualitäts- und Latenzziele
  • Einheitlicher API Key
  • Model Skill enthält Docs, Schemas und Setup-Hinweise
  • Fehlgeschlagene Generierungen werden nicht berechnet
VARIANTEN

Varianten

Variant Billing Pricing
audio-isolation minute $0.120 Ansehen →
sound-effect-v2 minute $0.150 Ansehen →
speech-to-text minute $0.040 Ansehen →
text-to-dialogue-v3 1K chars $0.140 Ansehen →
text-to-speech-multilingual-v2 1K chars $0.120 Ansehen →
text-to-speech-turbo-v2.5 1K chars $0.060 Ansehen →
MODELS

Installiere den ElevenLabs Skill für App-Entwicklung

Lade Modelldokumentation, Schemas, Preishinweise und Setup-Schritte in deinen Coding-Workspace.

# Install the model skill for app development workflows
npx skills add runapi-ai/elevenlabs -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the ElevenLabs skill for this app:

1. Add runapi-ai/elevenlabs with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
SO FUNKTIONIERT ES

Mit diesem Model Skill bauen

01

Modell wählen

Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

02

Einmal authentifizieren

Nutze deinen RunAPI Key für jedes unterstützte Modell.

03

Skill installieren

Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

04

Ergebnis empfangen

Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo ElevenLabs passt

ElevenLabs ist ein Voice-AI-Unternehmen, dessen Modelle TTS, Dialog, Soundeffekte, Transkription und Audio-Isolation abdecken. Über RunAPI teilen alle ElevenLabs-Endpunkte einen gemeinsamen Key und Abrechnung pro Aufruf.

Provider
ElevenLabs
Modality
Audio & Music
WARUM RUNAPI

Warum ElevenLabs über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

FAQ

Häufige Fragen

Wie hoch ist die Latenz bei Text-zu-Sprache?

Turbo v2.5 liefert ~250ms First-Byte-Latenz. Sowohl Turbo v2.5 als auch Multilingual v2 unterstützen Streaming, sodass die Wiedergabe beginnt, bevor die Generierung abgeschlossen ist.

Wie viele Sprachen werden unterstützt?

Bis zu 70+ Sprachen mit den neuesten Modellen. Turbo v2.5 unterstützt 32 Sprachen; Multilingual v2 unterstützt 29.

Kann ich eine benutzerdefinierte Stimme klonen?

Voice Cloning ist auf der ElevenLabs-Plattform verfügbar. Über RunAPI gibst du eine Stimmen-ID aus deiner ElevenLabs-Stimmbibliothek an.

Wofür ist der Dialog-Endpunkt?

Er generiert Multi-Speaker-Konversationsaudio aus einem Skript mit unterschiedlichen Stimmen für jeden Charakter und natürlichem Sprecherwechsel.

Entfernt Audio-Isolation Hintergrundgeräusche?

Ja — es trennt Sprache von Hintergrundgeräuschen, Musik und Umgebungsklang und gibt sauberes Vokal-Audio aus.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

Kosten fehlgeschlagene Generierungen Geld?

Fehlgeschlagene Generierungen werden nicht berechnet

Kann ich es aus meiner Anwendung aufrufen?

Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.

JETZT STARTEN

Mit ElevenLabs bauen.