ElevenLabs · Audio & Musique

Hermes Agent x ElevenLabs

ElevenLabs est une entreprise d'IA vocale dont les modèles couvrent le TTS, le dialogue, les effets sonores, la transcription et l'isolation audio. Via RunAPI, tous les endpoints ElevenLabs partagent une seule clé et une facturation par appel.

6 variants à partir de $0.04 / minute Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez audio-isolation lorsqu'il correspond à la tâche : Extraction vocale depuis des sources audio mixées.

You have access to RunAPI task tools for ElevenLabs.

Available ElevenLabs models:
- audio-isolation: Extraction vocale depuis des sources audio mixées
  endpoints: /api/v1/elevenlabs/isolate_audio
  request fields: source_audio_url
- sound-effect-v2: Effets sonores texte-vers-son pour jeux, vidéos et podcasts
  endpoints: /api/v1/elevenlabs/text_to_sound
  request fields: text, loop, duration_seconds, prompt_influence, output_format
- speech-to-text: Transcription dans 29+ langues avec diarisation des locuteurs
  endpoints: /api/v1/elevenlabs/speech_to_text
  request fields: source_audio_url, language_code, diarize
- text-to-dialogue-v3: Génération de dialogue multi-locuteurs avec prise de parole naturelle
  endpoints: /api/v1/elevenlabs/text_to_dialogue
  request fields: dialogue, stability, language_code
- text-to-speech-multilingual-v2: 29 langues ; expression émotionnelle la plus naturelle ; idéal pour les livres audio
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code
- text-to-speech-turbo-v2.5: 32 langues ; 3× plus rapide hors anglais ; limite 40K car.
  endpoints: /api/v1/elevenlabs/text_to_speech
  request fields: model, text, voice, language_code

Use the model ID and endpoint that match the user's request.
Example prompt: Convertissez ce paragraphe en parole naturelle avec une voix masculine britannique chaleureuse, à un rythme modéré.
/api/v1/elevenlabs/isolate_audio: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/elevenlabs/isolate_audio et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/elevenlabs/isolate_audio/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/elevenlabs/text_to_sound: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/elevenlabs/text_to_sound et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/elevenlabs/text_to_sound/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/elevenlabs/speech_to_text: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/elevenlabs/speech_to_text et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/elevenlabs/speech_to_text/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/elevenlabs/text_to_dialogue: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/elevenlabs/text_to_dialogue et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/elevenlabs/text_to_dialogue/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.
/api/v1/elevenlabs/text_to_speech: Submit the task, poll for its status, then verify the completed output. Envoyez POST à /api/v1/elevenlabs/text_to_speech et conservez l’ID de la Task renvoyée.
Envoyez GET à /api/v1/elevenlabs/text_to_speech/<task-id> jusqu’à ce que le statut soit completed ou failed.
Vérifiez que la réponse completed contient la sortie propre à l’endpoint documentée dans la référence API.

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
audio-isolation
/api/v1/elevenlabs/isolate_audio
$0.12 / minute Détail du modèle
sound-effect-v2
/api/v1/elevenlabs/text_to_sound
$0.15 / minute Détail du modèle
speech-to-text
/api/v1/elevenlabs/speech_to_text
$0.04 / minute Détail du modèle
text-to-dialogue-v3
/api/v1/elevenlabs/text_to_dialogue
$0.14 / 1 000 caractères Détail du modèle
text-to-speech-multilingual-v2
/api/v1/elevenlabs/text_to_speech
$0.12 / 1 000 caractères Détail du modèle
text-to-speech-turbo-v2.5
/api/v1/elevenlabs/text_to_speech
$0.06 / 1 000 caractères Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.

  3. Vérifier le résultat

    Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.

Ce que vous pouvez créer avec Hermes Agent + ElevenLabs

  • Agents vocaux conversationnels

    Créez des agents vocaux au phrasé naturel, avec une synthèse à faible latence pour des bots de service client, des assistants ou des interfaces téléphoniques.

  • Narration de contenus YouTube

    Produisez des voix off pour des vidéos YouTube avec des voix de personnages cohérentes sur toute une série.

  • Pipelines du texte à la vidéo parlée

    Enchaînez la voix ElevenLabs avec un modèle d'avatar parlant dans un workflow Hermes Agent pour passer d'un texte à une vidéo narrée.

Pourquoi utiliser ElevenLabs avec RunAPI + Hermes Agent

  • 6 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Flux de tâches automatiques

    Envoyez, interrogez et récupérez les résultats asynchrones avec un flux de tâches uniforme, sans code d'interrogation manuel.

Questions sur Hermes Agent + ElevenLabs

Puis-je utiliser ElevenLabs dans Hermes Agent ?

Oui. Configurez RunAPI comme fournisseur dans Hermes Agent, puis appelez n'importe quel endpoint ElevenLabs de cette page, dont la voix, la transcription, le dialogue, les effets sonores et l'isolation audio.

Puis-je transcrire de l'audio avec ElevenLabs dans Hermes Agent ?

Oui. Appelez l'endpoint de transcription avec une URL audio. Il peut séparer les locuteurs et étiqueter les événements sonores, et les résultats sont renvoyés de façon asynchrone.

Hermes Agent peut-il enchaîner ElevenLabs avec la génération vidéo ?

Oui. Hermes Agent peut générer la voix avec ElevenLabs, puis transmettre l'URL audio à un modèle d'avatar parlant ou de parole vers vidéo dans la même exécution.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.

Commencer à utiliser ElevenLabs avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter