Parâmetros flexíveis
Configure 5 parâmetros documentados, incluindo dialogue_turns, sample_context, scene, speakers, temperature.
Fala multivoz de alta fidelidade com controle expressivo para diálogos longos
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-pro-tts",
"text": "Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-2.5-pro-tts",
text: "Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico.",
});
import os
import requests
response = requests.post(
"https://runapi.ai/api/v1/gemini_tts/text_to_speech",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gemini-2.5-pro-tts","text":"Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/api/v1/gemini_tts/text_to_speech");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gemini-2.5-pro-tts',
'text' => 'Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico.',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.textToSpeech().run({"model":"gemini-2.5-pro-tts","text":"Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."});
task.waitForResult();
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-2.5-pro-tts",
text: "Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.textToSpeech.Run({"model":"gemini-2.5-pro-tts","text":"Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gemini-2.5-pro-tts \
--endpoint text_to_speech \
--wait
2 variantes disponíveis
Escolha qualquer modelo e gere em segundos.
Escolha qualquer modelo e gere em segundos.
| Provedor | |
| ID do modelo | gemini-2.5-pro-tts |
| Modalidade | Audio & Music |
| Tipos de tarefa | Asynchronous |
| Endpoint da API | /api/v1/gemini_tts/text_to_speech |
| Unidade de cobrança | 1K tokens |
| Parâmetros de entrada | callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature |
| Status do catálogo | Operacional |
Cadastre-se gratuitamente e crie uma chave de API para gemini-2.5-pro-tts no painel.
Envie uma solicitação POST para /api/v1/gemini_tts/text_to_speech com o identificador do modelo gemini-2.5-pro-tts e seus parâmetros.
Consulte a tarefa ou siga o callback para recuperar o resultado concluído de gemini-2.5-pro-tts.
Configure 5 parâmetros documentados, incluindo dialogue_turns, sample_context, scene, speakers, temperature.
Expõe 1 endpoint(s) público(s): text_to_speech.
Tarefas assíncronas aceitam uma URL de callback para notificações de conclusão.
Medido por 1K tokens, sem exigência de assinatura.
sceneScene and recording environment.
speakersNon-empty speaker configurations with unique Speaker N identifiers.
temperatureSampling temperature.
callback_urlWebhook URL for async notifications.
dialogue_turnsNon-empty ordered dialogue turns whose speaker ids reference configured speakers.
sample_contextOverall delivery context and tone.
Crie faixas e assets de áudio.
Construa pipelines de fala e áudio.
Exponha ferramentas de áudio ao ambiente de desenvolvimento.
Envie o ID de modelo mostrado no quickstart.
Sim. O preço é medido por chamada ou unidade.
Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.
Fale conosco