ElevenLabs · Audio & Musik

OpenClaw x ElevenLabs

ElevenLabs ist ein Voice-AI-Unternehmen, dessen Modelle TTS, Dialog, Soundeffekte, Transkription und Audio-Isolation abdecken. Über RunAPI teilen alle ElevenLabs-Endpunkte einen gemeinsamen Key und Abrechnung pro Aufruf.

6 variants ab $0.04 / Minute Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende audio-isolation, wenn es zur Aufgabe passt: Vokal-Extraktion aus gemischten Audio-Quellen.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Vokal-Extraktion aus gemischten Audio-Quellen
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Text-zu-Soundeffekten für Spiele, Video und Podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transkription in 29+ Sprachen mit Sprecher-Diarisierung
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Mehrsprecher-Dialog-Generierung mit natürlichem Sprecherwechsel
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 Sprachen; natürlichster emotionaler Ausdruck; ideal für Hörbücher
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 Sprachen; 3× schneller für Nicht-Englisch; 40K-Zeichen-Limit
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Konvertiere diesen Absatz in natürliche Sprache mit einer warmen britischen Männerstimme, moderatem Tempo.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/isolate_audio und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/isolate_audio/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_sound und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_sound/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/speech_to_text und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/speech_to_text/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_dialogue und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_dialogue/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_speech und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_speech/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / Minute Modelldetails
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / Minute Modelldetails
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / Minute Modelldetails
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K Zeichen Modelldetails
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K Zeichen Modelldetails
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K Zeichen Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Setze RUNAPI_API_KEY, bevor du die Endpunktanfrage sendest.

  3. Ergebnis überprüfen

    Frage bei asynchronen Endpunkten denselben Endpunkt ab, bis die Task einen Endstatus erreicht.

Was du mit OpenClaw + ElevenLabs bauen kannst

  • Hörbuch- und Podcast-Erzählung

    Wandle lange Texte in gesprochenes Audio mit konsistenten Figurenstimmen über Stunden an Inhalten um.

  • Videos in mehrere Sprachen synchronisieren

    Synchronisiere Videoinhalte in andere Sprachen mit demselben Stimmprofil und erstelle lokalisierte Fassungen, die den Stimmcharakter des Sprechers behalten.

  • Soundeffekte für Video und Spiele

    Erzeuge eigene Foley-Geräusche, Atmo und Sound-Cues aus Textbeschreibungen, statt Stock-Audio-Bibliotheken zu durchsuchen.

Warum ElevenLabs über RunAPI + OpenClaw nutzen

  • 6 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Automatische Task-Workflows

    Sende Tasks, frage ihren Status ab und sammle asynchrone Ergebnisse in einem einheitlichen Ablauf ohne eigenen Polling-Code.

Fragen zu OpenClaw + ElevenLabs

Welche Stimmeinstellungen klingen am natürlichsten?

Höhere Stabilität macht eine Stimme gleichmäßiger, aber weniger ausdrucksstark, während höhere Ähnlichkeit sie näher am ursprünglichen Profil hält. Nutze mehr Stabilität für Erzählungen und weniger für Gesprächsinhalte.

Wie gehe ich mit langen Inhalten wie Hörbüchern um?

Teile lange Texte in Abschnitte auf, sende pro Abschnitt eine Anfrage und verarbeite Kapitel parallel statt nacheinander.

Kann ich in OpenClaw Audio mit mehreren Sprechern erstellen?

Ja. Rufe den Dialog-Endpunkt mit einer Liste von Zeilen auf, die jeweils einer Stimme zugeordnet sind, und ElevenLabs gibt ein Gespräch mit mehreren Sprechern zurück.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Nein. Diese Modelllinie verwendet den hier gezeigten Endpunktablauf und wird nicht als Agent-Chatmodell dargestellt.

ElevenLabs mit OpenClaw nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen