Elastyczne parametry
Skonfiguruj 5 udokumentowanych parametrów, w tym dialogue_turns, sample_context, scene, speakers, temperature.
Wielogłosowa mowa wysokiej jakości z kontrolą ekspresji do długich dialogów
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-pro-tts",
"text": "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-2.5-pro-tts",
text: "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa.",
});
import os
import requests
response = requests.post(
"https://runapi.ai/api/v1/gemini_tts/text_to_speech",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gemini-2.5-pro-tts","text":"Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/api/v1/gemini_tts/text_to_speech");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gemini-2.5-pro-tts',
'text' => 'Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa.',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.textToSpeech().run({"model":"gemini-2.5-pro-tts","text":"Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."});
task.waitForResult();
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-2.5-pro-tts",
text: "Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.textToSpeech.Run({"model":"gemini-2.5-pro-tts","text":"Wygeneruj wstęp do podcastu prowadzony przez dwie osoby: spokojnego brytyjskiego gospodarza i energicznego amerykańskiego gościa."})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gemini-2.5-pro-tts \
--endpoint text_to_speech \
--wait
2 dostępnych wariantów
Wybierz dowolny model i generuj w kilka sekund.
Wybierz dowolny model i generuj w kilka sekund.
| Dostawca | |
| ID modelu | gemini-2.5-pro-tts |
| Modalność | Audio & Music |
| Typy zadań | Asynchronous |
| Endpoint API | /api/v1/gemini_tts/text_to_speech |
| Jednostka rozliczeniowa | 1K tokens |
| Parametry wejściowe | callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature |
| Status katalogu | Operacyjny |
Zarejestruj się bezpłatnie i utwórz klucz API dla gemini-2.5-pro-tts w panelu.
Wyślij żądanie POST do /api/v1/gemini_tts/text_to_speech z identyfikatorem modelu gemini-2.5-pro-tts i parametrami.
Odpytywać zadanie lub skorzystaj z callbacku, aby pobrać ukończony wynik gemini-2.5-pro-tts.
Skonfiguruj 5 udokumentowanych parametrów, w tym dialogue_turns, sample_context, scene, speakers, temperature.
Udostępnia 1 publiczny(-e) endpoint(-y): text_to_speech.
Zadania asynchroniczne akceptują callback URL do powiadomień o zakończeniu.
Rozliczane według 1K tokens bez wymogu subskrypcji.
sceneScene and recording environment.
speakersNon-empty speaker configurations with unique Speaker N identifiers.
temperatureSampling temperature.
callback_urlWebhook URL for async notifications.
dialogue_turnsNon-empty ordered dialogue turns whose speaker ids reference configured speakers.
sample_contextOverall delivery context and tone.
Generuj muzykę w tle bez tantiem, dopasowaną do nastroju odcinka i bez opłat licencyjnych.
Generuj adaptacyjne ambientowe pejzaże dźwiękowe i efekty do proceduralnie generowanych poziomów.
Generuj niestandardowe lektorskie nagrania i efekty dźwiękowe do spotów klienta bez studia nagrań.
Przekaż identyfikator modelu wyświetlony w quickstarcie.
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.
Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.
Skontaktuj się