Google · Audio & Music

Hermes Agent x Gemini TTS

Gemini TTS fait partie du catalogue Google de RunAPI et donne accès à Gemini 2.5 Pro TTS et Gemini 3.1 Flash TTS via des interfaces cohérentes dans l’API, les SDK et la CLI.

Versions et endpoints publics

ID du modèleVersionEndpointsPrix de départCatalogue
gemini-2.5-pro-ttsVoix multi-locuteurs haute fidélité avec contrôle expressif pour les dialogues longs
/api/v1/gemini_tts/text_to_speech
$0.0014Détail du modèle
gemini-3.1-flash-ttsVoix multi-locuteurs rapide pour les dialogues réactifs et les volumes audio élevés
/api/v1/gemini_tts/text_to_speech
$0.0014Détail du modèle

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.

Vérification

Sélectionnez <model-id> pour générer les commandes de vérification.

Fonctionnement

  1. 1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. 2. Configurer RunAPI

    Définissez RUNAPI_API_KEY avant d’envoyer la requête à l’endpoint.

  3. 3. Vérifier le résultat

    Pour les endpoints asynchrones, interrogez le même endpoint jusqu’à ce que la Task atteigne un état final.

FAQ

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Non. Cette ligne de modèles utilise le parcours d’endpoint présenté ici et n’est pas décrite comme un modèle de chat de l’agent.