Google · Audio & Music
Hermes Agent x Gemini TTS
Gemini TTS jest częścią katalogu Google w RunAPI i udostępnia Gemini 2.5 Pro TTS oraz Gemini 3.1 Flash TTS przez jeden spójny interfejs API, SDK i CLI.
Publiczne wersje i endpointy
| ID modelu | Wersja | Endpointy | Cena początkowa | Katalog |
|---|---|---|---|---|
gemini-2.5-pro-tts | Wielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów | /api/v1/gemini_tts/text_to_speech | $0.0014 | Szczegóły modelu |
gemini-3.1-flash-tts | Szybka wielogłosowa mowa do responsywnych dialogów i dużych wolumenów audio | /api/v1/gemini_tts/text_to_speech | $0.0014 | Szczegóły modelu |
Konfiguracja
Endpoint przewodnika: <endpoint>
Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.Weryfikacja
Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.Jak to działa
- 1. Wybierz ID modelu
Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.
- 2. Skonfiguruj RunAPI
Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.
- 3. Zweryfikuj wynik
Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.
Częste pytania
Którego ID modelu użyć?
Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.
Czy ten przewodnik konfiguruje model czatu?
Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.