VARIANT · Google / Gemini TTS

gemini-2.5-pro-tts API

Google / Gemini TTS

Korzystaj z gemini-2.5-pro-tts z rodziny Gemini TTS przez RunAPI. Cennik za wywołanie, bez subskrypcji — nieudane generacje nie są rozliczane.

Operacyjny · audio_music · Do użytku komercyjnego
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-pro-tts",
  "text": "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";

const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
    model: "gemini-2.5-pro-tts",
    text: "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa.",
});
require "runapi/gemini_tts"

client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
    model: "gemini-2.5-pro-tts",
    text: "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-tts v1
Zmień wariant
gemini-3.1-flash-tts
OVERVIEW

gemini-2.5-pro-tts trafia w optymalny punkt między jakością a kosztem w rodzinie Gemini TTS.

  • Cennik za wywołanie w USD
  • Nieudane generacje nie są rozliczane
  • Streaming, gdy jest obsługiwany przez model
  • Setup model skilla
PRICING

Cennik

Nieudane generacje nie są rozliczane
Text to speech
Input $1.40 / 1M tokens
Output $28.00 / 1M tokens
SPECYFIKACJA

Szczegóły techniczne

ID modelu gemini-2.5-pro-tts
Dostawca Google
Modalność audio_music
Typ zadania asynchronous
Jednostka rozliczeniowa 1K tokens
API endpoint /api/v1/gemini_tts/text_to_speech
Licencja komercyjna Tak — wliczona przez API
Status katalogu Operacyjny
SKILLS

Szybki start — gemini-2.5-pro-tts

Ten sam format · wariant przypięty w modelu

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-tts -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini TTS skill for this app:

1. Add runapi-ai/gemini-tts with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
JAK TO DZIAŁA

Użyj gemini-2.5-pro-tts w czterech krokach

01

Instalacja

Zainstaluj model skill dla tej linii modeli.

02

Konfiguracja

Ustaw pole model na pełny identyfikator modelu widoczny na tej stronie.

03

Wywołanie

Wyślij typowane żądanie z promptem, danymi wejściowymi i ustawieniami callbacku.

04

Odbiór

Odczytaj odpowiedź zadania, webhook callback lub adres URL zapisanego wyniku z RunAPI.

DIFFERENCES

Co wyróżnia gemini-2.5-pro-tts

VS GEMINI-3.1-FLASH-TTS

Wielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów

Szybka wielogłosowa mowa do responsywnych dialogów i dużych wolumenów audio

PRZYPADKI UŻYCIA

Najlepiej sprawdza się w

Muzyka do podcastów i wideo

Generuj muzykę w tle bez tantiem, dopasowaną do nastroju odcinka i bez opłat licencyjnych.

Audio do gier

Generuj adaptacyjne ambientowe pejzaże dźwiękowe i efekty do proceduralnie generowanych poziomów.

Lektor i SFX do reklam

Generuj niestandardowe lektorskie nagrania i efekty dźwiękowe do spotów klienta bez studia nagrań.

FAQ

Najczęściej zadawane pytania o gemini-2.5-pro-tts

Czy identyfikator modelu jest stały między wersjami?

RunAPI utrzymuje stały identyfikator modelu i obsługuje zgodne odświeżenia wersji bez zmiany kształtu żądania.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

ZACZNIJ TERAZ

Zacznij budować z Gemini TTS.