Google · Audio & Music

Hermes Agent x Gemini TTS

Gemini TTS jest częścią katalogu Google w RunAPI i udostępnia Gemini 2.5 Pro TTS oraz Gemini 3.1 Flash TTS przez jeden spójny interfejs API, SDK i CLI.

Publiczne wersje i endpointy

ID modeluWersjaEndpointyCena początkowaKatalog
gemini-2.5-pro-ttsWielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów
/api/v1/gemini_tts/text_to_speech
$0.0014Szczegóły modelu
gemini-3.1-flash-ttsSzybka wielogłosowa mowa do responsywnych dialogów i dużych wolumenów audio
/api/v1/gemini_tts/text_to_speech
$0.0014Szczegóły modelu

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.

Weryfikacja

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Jak to działa

  1. 1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. 2. Skonfiguruj RunAPI

    Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.

  3. 3. Zweryfikuj wynik

    Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.

Częste pytania

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.