It looks like you may prefer a different language. Switch anytime.

Google · Audio & Music

Hermes Agent x Gemini TTS

Gemini TTS jest częścią katalogu Google w RunAPI i udostępnia Gemini 2.5 Pro TTS oraz Gemini 3.1 Flash TTS przez jeden spójny interfejs API, SDK i CLI.

2 variants od $0.0014 Do użytku komercyjnego

Prerequisite: npx runapi mcp install

Prompt

Modele promptów

Użyj gemini-2.5-pro-tts, gdy pasuje do zadania: Wielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów.

You have access to RunAPI task tools for Gemini TTS.

Available Gemini TTS models:
- gemini-2.5-pro-tts: Wielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów
  endpoints: /api/v1/gemini_tts/text_to_speech
  request fields: model, temperature, scene, sample_context, speakers, dialogue_turns
- gemini-3.1-flash-tts: Szybka wielogłosowa mowa do responsywnych dialogów i dużych wolumenów audio
  endpoints: /api/v1/gemini_tts/text_to_speech
  request fields: model, temperature, scene, sample_context, speakers, dialogue_turns

Use the model ID and endpoint that match the user's request.
Example prompt: Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa.
/api/v1/gemini_tts/text_to_speech: Submit the task, poll for its status, then verify the completed output. Wyślij POST do /api/v1/gemini_tts/text_to_speech i zapisz ID zwróconej Task.
Wyślij GET do /api/v1/gemini_tts/text_to_speech/<task-id>, aż stan zmieni się na completed lub failed.
Sprawdź, czy odpowiedź completed zawiera wynik właściwy dla endpointu opisany w dokumentacji API.

Publiczne wersje i endpointy

ID modelu Endpointy Cena początkowa Katalog
gemini-2.5-pro-tts
/api/v1/gemini_tts/text_to_speech
$0.0014 Szczegóły modelu
gemini-3.1-flash-tts
/api/v1/gemini_tts/text_to_speech
$0.0014 Szczegóły modelu

Weryfikacja

Odpytywanie do momentu osiągnięcia przez Task stanu końcowego

Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.

Konfiguracja

Endpoint przewodnika: <endpoint>

Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Jak to działa

Zacznij w 3 krokach

  1. Wybierz ID modelu

    Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.

  2. Skonfiguruj RunAPI

    Ustaw RUNAPI_API_KEY przed wysłaniem żądania do endpointu.

  3. Zweryfikuj wynik

    Dla asynchronicznych endpointów odpytuj ten sam endpoint, aż Task osiągnie stan końcowy.

Co możesz zbudować za pomocą Hermes Agent + Gemini TTS

  • Filmy prezentujące produkty

    Twórz 5-10-sekundowe animacje produktów z opisów tekstowych, idealne do e-commerce i reklam społecznościowych.

  • Treści z awatarami AI

    Twórz filmy z awatarami i synchronizacją ust na potrzeby szkoleń, obsługi klienta i marketingu.

  • Produkcja filmów seryjnych

    Kolejkuj setki generacji filmów i odbieraj wyniki przez webhook.

Dlaczego warto używać Gemini TTS przez RunAPI + Hermes Agent

  • 2 wariantów, jeden klucz API

    Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.

  • Przejrzyste ceny użycia

    Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.

  • Automatyczne przepływy zadań

    Wysyłaj zadania, sprawdzaj ich status i odbieraj asynchroniczne wyniki w jednym przepływie, bez ręcznego kodu odpytywania.

Pytania o Hermes Agent + Gemini TTS

Którego ID modelu użyć?

Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.

Czy ten przewodnik konfiguruje model czatu?

Nie. Ta linia modeli korzysta z pokazanego procesu endpointu i nie jest przedstawiana jako model czatu agenta.

Zacznij używać Gemini TTS z Hermes Agent

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się