Google · Audio & Music

Hermes Agent x Gemini TTS

Gemini TTS gehört zum Google-Katalog auf RunAPI und stellt Gemini 2.5 Pro TTS und Gemini 3.1 Flash TTS über einheitliche API-, SDK- und CLI-Schnittstellen bereit.

Öffentliche Versionen und Endpunkte

Modell-IDVersionEndpunkteStartpreisKatalog
gemini-2.5-pro-ttsHochwertige Mehrsprecher-Ausgabe mit Ausdruckskontrolle für längere Dialoge
/api/v1/gemini_tts/text_to_speech
$0.0014Modelldetails
gemini-3.1-flash-ttsSchnelle Mehrsprecher-Ausgabe für reaktive Dialoge und große Audiomengen
/api/v1/gemini_tts/text_to_speech
$0.0014Modelldetails

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.

Überprüfen

Wähle <model-id>, um Prüfkommandos zu erzeugen.

So funktioniert es

  1. 1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. 2. RunAPI konfigurieren

    Setze RUNAPI_API_KEY, bevor du die Endpunktanfrage sendest.

  3. 3. Ergebnis überprüfen

    Frage bei asynchronen Endpunkten denselben Endpunkt ab, bis die Task einen Endstatus erreicht.

Häufige Fragen

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Nein. Diese Modelllinie verwendet den hier gezeigten Endpunktablauf und wird nicht als Agent-Chatmodell dargestellt.