ElevenLabs · Audio & Musik

Hermes Agent x ElevenLabs

ElevenLabs ist ein Voice-AI-Unternehmen, dessen Modelle TTS, Dialog, Soundeffekte, Transkription und Audio-Isolation abdecken. Über RunAPI teilen alle ElevenLabs-Endpunkte einen gemeinsamen Key und Abrechnung pro Aufruf.

6 variants ab $0.04 / Minute Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende audio-isolation, wenn es zur Aufgabe passt: Vokal-Extraktion aus gemischten Audio-Quellen.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Vokal-Extraktion aus gemischten Audio-Quellen
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Text-zu-Soundeffekten für Spiele, Video und Podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transkription in 29+ Sprachen mit Sprecher-Diarisierung
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Mehrsprecher-Dialog-Generierung mit natürlichem Sprecherwechsel
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 Sprachen; natürlichster emotionaler Ausdruck; ideal für Hörbücher
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 Sprachen; 3× schneller für Nicht-Englisch; 40K-Zeichen-Limit
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Konvertiere diesen Absatz in natürliche Sprache mit einer warmen britischen Männerstimme, moderatem Tempo.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/isolate_audio und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/isolate_audio/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_sound und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_sound/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/speech_to_text und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/speech_to_text/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_dialogue und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_dialogue/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Sende POST an /api/v1/elevenlabs/text_to_speech und speichere die ID der zurückgegebenen Task.
Sende GET an /api/v1/elevenlabs/text_to_speech/<task-id>, bis der Status completed oder failed ist.
Prüfe, ob die completed-Antwort die in der API-Referenz dokumentierte endpunktspezifische Ausgabe enthält.

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / Minute Modelldetails
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / Minute Modelldetails
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / Minute Modelldetails
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K Zeichen Modelldetails
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K Zeichen Modelldetails
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K Zeichen Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Setze RUNAPI_API_KEY, bevor du die Endpunktanfrage sendest.

  3. Ergebnis überprüfen

    Frage bei asynchronen Endpunkten denselben Endpunkt ab, bis die Task einen Endstatus erreicht.

Was du mit Hermes Agent + ElevenLabs bauen kannst

  • Sprachagenten für Gespräche

    Baue Sprachagenten, die natürlich sprechen, mit Sprache in geringer Latenz für Kundenservice-Bots, Assistenten oder Telefonschnittstellen.

  • Erzählung für YouTube-Inhalte

    Produziere Voiceover für YouTube-Videos mit konsistenten Figurenstimmen über eine ganze Serie.

  • Pipelines von Text zu gesprochenem Video

    Verkette Sprache von ElevenLabs mit einem Talking-Avatar-Modell in einem Hermes-Agent-Workflow, um aus Text ein vertontes Video zu machen.

Warum ElevenLabs über RunAPI + Hermes Agent nutzen

  • 6 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Automatische Task-Workflows

    Sende Tasks, frage ihren Status ab und sammle asynchrone Ergebnisse in einem einheitlichen Ablauf ohne eigenen Polling-Code.

Fragen zu Hermes Agent + ElevenLabs

Kann ich ElevenLabs in Hermes Agent verwenden?

Ja. Richte RunAPI als Provider in Hermes Agent ein und rufe jeden ElevenLabs-Endpunkt auf dieser Seite auf, darunter Sprache, Transkription, Dialog, Soundeffekte und Audio-Isolierung.

Kann ich mit ElevenLabs in Hermes Agent Audio transkribieren?

Ja. Rufe den Speech-to-Text-Endpunkt mit einer Audio-URL auf. Er kann Sprecher trennen und Audioereignisse markieren; die Ergebnisse kommen asynchron zurück.

Kann Hermes Agent ElevenLabs mit Videoerzeugung verketten?

Ja. Hermes Agent kann mit ElevenLabs Sprache erzeugen und die Audio-URL im selben Durchlauf an ein Talking-Avatar- oder Sprache-zu-Video-Modell übergeben.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Nein. Diese Modelllinie verwendet den hier gezeigten Endpunktablauf und wird nicht als Agent-Chatmodell dargestellt.

ElevenLabs mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen