It looks like you may prefer a different language. Switch anytime.

Google · Audio & Music

OpenClaw x Gemini TTS

Gemini TTS fa parte del catalogo Google disponibile su RunAPI e rende accessibili Gemini 2.5 Pro TTS e Gemini 3.1 Flash TTS tramite interfacce API, SDK e CLI coerenti.

2 variants da $0.0014 Uso commerciale consentito

Prerequisite: npx runapi mcp install

Prompt

Modelli del prompt

Usa gemini-2.5-pro-tts quando è adatto all'attività: Voce multi-speaker ad alta fedeltà con controllo espressivo per dialoghi lunghi.

You have access to RunAPI task tools for Gemini TTS.

Available Gemini TTS models:
- gemini-2.5-pro-tts: Voce multi-speaker ad alta fedeltà con controllo espressivo per dialoghi lunghi
  endpoints: /api/v1/gemini_tts/text_to_speech
  request fields: model, temperature, scene, sample_context, speakers, dialogue_turns
- gemini-3.1-flash-tts: Voce multi-speaker rapida per dialoghi reattivi e flussi audio ad alto volume
  endpoints: /api/v1/gemini_tts/text_to_speech
  request fields: model, temperature, scene, sample_context, speakers, dialogue_turns

Use the model ID and endpoint that match the user's request.
Example prompt: Genera l'introduzione di un podcast a due voci, con un conduttore britannico dal tono pacato e un ospite americano energico.
/api/v1/gemini_tts/text_to_speech: Submit the task, poll for its status, then verify the completed output. Invia POST a /api/v1/gemini_tts/text_to_speech e salva l’ID della Task restituita.
Invia GET a /api/v1/gemini_tts/text_to_speech/<task-id> finché lo stato non è completed o failed.
Verifica che la risposta completed contenga l’output specifico dell’endpoint documentato nel riferimento API.

Versioni ed endpoint pubblici

ID modello Endpoint Prezzo iniziale Catalogo
gemini-2.5-pro-tts
/api/v1/gemini_tts/text_to_speech
$0.0014 Dettagli modello
gemini-3.1-flash-tts
/api/v1/gemini_tts/text_to_speech
$0.0014 Dettagli modello

Verifica

Esegui il polling finché la Task non raggiunge uno stato terminale

Seleziona <model-id> per generare i comandi di verifica.

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.
Come funziona

Inizia in 3 passaggi

  1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. Configura RunAPI

    Imposta RUNAPI_API_KEY prima di inviare la richiesta all’endpoint.

  3. Verifica il risultato

    Per gli endpoint asincroni, interroga lo stesso endpoint finché la Task non raggiunge uno stato finale.

Cosa puoi creare con OpenClaw + Gemini TTS

  • Video dimostrativi di prodotto

    Genera animazioni di prodotto di 5-10 secondi da descrizioni testuali, ideali per e-commerce e annunci social.

  • Contenuti con avatar AI

    Crea video con avatar parlanti e labiale sincronizzato per formazione, assistenza clienti e marketing.

  • Produzione video in batch

    Metti in coda centinaia di generazioni video e raccogli i risultati tramite webhook.

Perché usare Gemini TTS con RunAPI + OpenClaw

  • 2 varianti, una chiave API

    Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.

  • Prezzi d'uso chiari

    Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.

  • Flussi di attività automatici

    Invia, controlla e raccogli risultati asincroni con un flusso di attività uniforme, senza scrivere codice di polling manuale.

Domande su OpenClaw + Gemini TTS

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

No. Questa linea di modelli usa il flusso dell’endpoint mostrato e non viene presentata come modello di chat dell’agente.

Inizia a usare Gemini TTS con OpenClaw

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci