It looks like you may prefer a different language. Switch anytime.

Audio & Music Google

Gemini TTS API

Gebruik de Gemini TTS API via RunAPI met een modelskill, uniforme auth en pay-as-you-go prijzen.

runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-tts",
  "text": "Genereer een podcastintro met twee sprekers, met een rustige Britse presentator en een energieke Amerikaanse gast."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";

const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
    model: "gemini-3.1-flash-tts",
    text: "Genereer een podcastintro met twee sprekers, met een rustige Britse presentator en een energieke Amerikaanse gast.",
});
require "runapi/gemini_tts"

client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
    model: "gemini-3.1-flash-tts",
    text: "Genereer een podcastintro met twee sprekers, met een rustige Britse presentator en een energieke Amerikaanse gast."
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-tts v1
OVERVIEW

Over Gemini TTS

Gemini TTS zet een dialoog met een vaste beurtvolgorde om in spraak en bewaart voor iedere spreker een aparte stemconfiguratie. Verzoeken kunnen daarnaast de scène, de algemene voordrachtcontext en de samplingtemperatuur instellen.

Provider
Google
Modaliteit
Audio & Music

Vergelijk alle API-varianten

Variant Facturering Prijzen
gemini-2.5-pro-tts 1K tokens Input $1.40 / 1M tokens | Output $28.00 / 1M tokens Bekijken →
gemini-3.1-flash-tts 1K tokens Input $1.40 / 1M tokens | Output $28.00 / 1M tokens Bekijken →
PRICING

Gemini TTS-prijzen

Endpoint Resolutie Duur Prijs
text_to_speech Input $1.40 / 1M tokens | Output $28.00 / 1M tokens

Prijzen getoond voor gemini-2.5-pro-tts. Andere varianten behouden hun eigen endpoint-prijzen.

Agentintegratie

Gebruik Gemini TTS vanuit een agent

HOE HET WERKT

Aan de slag met Gemini TTS

  1. Kies het model

    Kies het model en de variant die passen bij je outputtype, kwaliteitslat en latencydoel.

  2. Configureren

    Stel je RunAPI-key in en installeer de modelskill in je codeworkspace.

  3. Bouwen

    Gebruik de skill-instructies om de modelfeature in je applicatie toe te voegen.

  4. Ontvangen

    Poll op task-ID, stream wanneer ondersteund of verwerk de webhook-callback.

CONTEXT

Wat is de Gemini TTS API?

Gemini TTS maakt deel uit van de Google-catalogus op RunAPI en maakt Gemini 2.5 Pro TTS en Gemini 3.1 Flash TTS beschikbaar via één uniforme API, SDK en CLI.

Provider
Google
Alles bekijken →
Modaliteit
Audio & Music
Modellen bekijken →

Waarom de Gemini TTS API via RunAPI gebruiken

Eén auth, elke provider

Met één RunAPI-sleutel ontgrendel je de hele catalogus. Geen aparte accounts, geen sleutelrotatie per integratie.

Uniforme prijzen & billing

Prijs per call in USD, maandelijks gefactureerd. Mislukte generaties worden niet in rekening gebracht.

Skill met schema's

Getypeerde schema's en setupnotities zitten in de modelskill, zodat implementatie start vanuit het juiste contract.

Vragen over Gemini TTS

Welke Gemini TTS-modellen zijn beschikbaar?

RunAPI ondersteunt Gemini 2.5 Pro TTS en Gemini 3.1 Flash TTS via hetzelfde tekst-naar-spraak-eindpunt en dezelfde verzoekstructuur.

Hoe stel ik meerdere sprekers in?

Voeg voor iedere deelnemer een sprekerconfiguratie met een unieke Speaker N-ID toe. Koppel daarna iedere dialoogbeurt aan een van die ID's.

Wat kan ik voor iedere spreker instellen?

Iedere spreker heeft een stem, accent, spreekstijl en spreektempo, met een optioneel audioprofiel voor aanvullende aanwijzingen voor de stem.

Welke invloed hebben de scène en voorbeeldcontext op het verzoek?

De scène beschrijft de opnameomgeving, terwijl de voorbeeldcontext de algemene toon en voordracht van de dialoog bepaalt.

Hoe worden voltooide audioresultaten geretourneerd?

Vraag de taakstatus op of ontvang na voltooiing een callback. Het antwoord bevat een `audios`-lijst met de URL van het gegenereerde bestand.

Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

VERGELIJKBARE MODELLEN

Als je de Gemini TTS API goed vindt, probeer deze dan eens

Begin met bouwen met de Gemini TTS API.