Audio & Music · Google

Gemini TTS API

Gemini TTS API-Zugang für Dialoge mit mehreren Sprechern und konfigurierbaren Stimmen, Akzenten, Sprechstilen und Sprechtempo.

Betriebsbereit · 2 variants · ab $0.0014
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-tts",
  "text": "Erstelle eine Podcast-Einleitung mit zwei Sprechern – einem ruhigen britischen Moderator und einem energiegeladenen amerikanischen Gast."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";

const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
    model: "gemini-3.1-flash-tts",
    text: "Erstelle eine Podcast-Einleitung mit zwei Sprechern – einem ruhigen britischen Moderator und einem energiegeladenen amerikanischen Gast.",
});
require "runapi/gemini_tts"

client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
    model: "gemini-3.1-flash-tts",
    text: "Erstelle eine Podcast-Einleitung mit zwei Sprechern – einem ruhigen britischen Moderator und einem energiegeladenen amerikanischen Gast."
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-tts v1
ÜBERBLICK

Gemini TTS wandelt Dialogbeiträge in der vorgegebenen Reihenfolge in Sprache um und behält für jeden Sprecher eine eigene Stimmkonfiguration bei. Anfragen können außerdem Szene, übergreifenden Kontext für die Sprechweise und Sampling-Temperatur festlegen.

  • Modellvarianten für verschiedene Qualitäts- und Latenzziele
  • Einheitlicher API Key
  • Model Skill enthält Docs, Schemas und Setup-Hinweise
  • Fehlgeschlagene Generierungen werden nicht berechnet
VARIANTEN

Varianten

Variant Billing From
gemini-2.5-pro-tts 1K tokens $0.0014 Ansehen →
gemini-3.1-flash-tts 1K tokens $0.0014 Ansehen →
MODELS

Installiere den Gemini TTS Skill für App-Entwicklung

Lade Modelldokumentation, Schemas, Preishinweise und Setup-Schritte in deinen Coding-Workspace.

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-tts -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini TTS skill for this app:

1. Add runapi-ai/gemini-tts with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
SO FUNKTIONIERT ES

Mit diesem Model Skill bauen

01

Modell wählen

Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

02

Einmal authentifizieren

Nutze deinen RunAPI Key für jedes unterstützte Modell.

03

Skill installieren

Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

04

Ergebnis empfangen

Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo Gemini TTS passt

Gemini TTS gehört zum Google-Katalog auf RunAPI und stellt Gemini 2.5 Pro TTS und Gemini 3.1 Flash TTS über einheitliche API-, SDK- und CLI-Schnittstellen bereit.

Provider
Google
Modality
Audio & Music
WARUM RUNAPI

Warum Gemini TTS über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

FAQ

Häufige Fragen

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

Kosten fehlgeschlagene Generierungen Geld?

Fehlgeschlagene Generierungen werden nicht berechnet

Kann ich es aus meiner Anwendung aufrufen?

Ja. Installiere den Model Skill im Coding-Workspace und nutze ihn beim Einbau des Modell-Features.

JETZT STARTEN

Mit Gemini TTS bauen.