ElevenLabs · Audio e musica

Hermes Agent x ElevenLabs

ElevenLabs è un'azienda di voice AI i cui modelli coprono TTS, dialoghi, effetti sonori, trascrizione e isolamento audio. Tramite RunAPI tutti gli endpoint di ElevenLabs condividono una sola chiave e una fatturazione a chiamata.

6 variants da $0.04 / minuto Uso commerciale consentito

Prerequisite: npx runapi mcp install

Prompt

Modelli del prompt

Usa audio-isolation quando è adatto all'attività: Estrazione della voce da sorgenti audio miste.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Estrazione della voce da sorgenti audio miste
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Effetti sonori da testo per giochi, video e podcast
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Trascrizione in oltre 29 lingue con speaker diarization
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Generazione di dialoghi con più parlanti e alternanza naturale dei turni
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 lingue; l'espressività emotiva più realistica; ideale per gli audiolibri
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 lingue; 3× più veloce per le lingue diverse dall'inglese; limite di 40K caratteri
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Converti questo paragrafo in parlato naturale con una voce maschile britannica calda e un ritmo moderato.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/elevenlabs/isolate_audio e salva l’ID della Task restituita.
Invia GET a /api/v1/elevenlabs/isolate_audio/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/elevenlabs/text_to_sound e salva l’ID della Task restituita.
Invia GET a /api/v1/elevenlabs/text_to_sound/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/elevenlabs/speech_to_text e salva l’ID della Task restituita.
Invia GET a /api/v1/elevenlabs/speech_to_text/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/elevenlabs/text_to_dialogue e salva l’ID della Task restituita.
Invia GET a /api/v1/elevenlabs/text_to_dialogue/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/elevenlabs/text_to_speech e salva l’ID della Task restituita.
Invia GET a /api/v1/elevenlabs/text_to_speech/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.

Versioni ed endpoint pubblici

ID modello Endpoint Prezzo iniziale Catalogo
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minuto Dettagli modello
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minuto Dettagli modello
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minuto Dettagli modello
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1K caratteri Dettagli modello
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1K caratteri Dettagli modello
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1K caratteri Dettagli modello

Verifica

Esegui il polling finché la Task non raggiunge uno stato terminale

Seleziona <model-id> per generare i comandi di verifica.

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.
Come funziona

Inizia in 3 passaggi

  1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Cosa puoi creare con Hermes Agent + ElevenLabs

  • Agenti vocali conversazionali

    Crea agenti vocali dal parlato naturale, con sintesi a bassa latenza per bot di assistenza clienti, assistenti o interfacce telefoniche.

  • Narrazione per contenuti YouTube

    Produci voice-over per video YouTube con voci dei personaggi coerenti in un'intera serie.

  • Pipeline dal testo al video parlato

    Concatena la voce di ElevenLabs con un modello di avatar parlante in un workflow di Hermes Agent per passare da un testo a un video narrato.

Perché usare ElevenLabs con RunAPI + Hermes Agent

  • 6 varianti, una chiave API

    Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.

  • Prezzi d'uso chiari

    Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.

  • Flussi di attività automatici

    Invia, controlla e raccogli risultati asincroni con un flusso di attività uniforme, senza scrivere codice di polling manuale.

Domande su Hermes Agent + ElevenLabs

Posso usare ElevenLabs in Hermes Agent?

Sì. Configura RunAPI come provider in Hermes Agent e chiama qualsiasi endpoint ElevenLabs di questa pagina, tra cui voce, trascrizione, dialogo, effetti sonori e isolamento dell'audio.

Posso trascrivere audio con ElevenLabs in Hermes Agent?

Sì. Chiama l'endpoint speech-to-text con un URL audio. Può separare gli interlocutori e etichettare gli eventi audio, e i risultati vengono restituiti in modo asincrono.

Hermes Agent può concatenare ElevenLabs con la generazione video?

Sì. Hermes Agent può generare la voce con ElevenLabs e passare l'URL dell'audio a un modello di avatar parlante o da voce a video nella stessa esecuzione.

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.

Inizia a usare ElevenLabs con Hermes Agent

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci