Google · Audio & Music

Hermes Agent x Gemini TTS

Gemini TTS fa parte del catalogo Google disponibile su RunAPI e rende accessibili Gemini 2.5 Pro TTS e Gemini 3.1 Flash TTS tramite interfacce API, SDK e CLI coerenti.

Versioni ed endpoint pubblici

ID modelloVersioneEndpointPrezzo inizialeCatalogo
gemini-2.5-pro-ttsVoce multi-speaker ad alta fedeltà con controllo espressivo per dialoghi lunghi
/api/v1/gemini_tts/text_to_speech
$0.0014Dettagli modello
gemini-3.1-flash-ttsVoce multi-speaker rapida per dialoghi reattivi e flussi audio ad alto volume
/api/v1/gemini_tts/text_to_speech
$0.0014Dettagli modello

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.

Verifica

Seleziona <model-id> per generare i comandi di verifica.

Come funziona

  1. 1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. 2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. 3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Domande frequenti

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.