Parámetros flexibles
Configura 5 parámetros documentados, incluidos dialogue_turns, sample_context, scene, speakers, temperature.
Voz multihablante rápida para diálogos ágiles y flujos de audio de gran volumen
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-tts",
"text": "Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";
const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
model: "gemini-3.1-flash-tts",
text: "Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico.",
});
import os
import requests
response = requests.post(
"https://runapi.ai/api/v1/gemini_tts/text_to_speech",
headers={"Authorization": f"Bearer {os.environ['RUNAPI_API_KEY']}"},
json={"model":"gemini-3.1-flash-tts","text":"Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico."}
)
response.raise_for_status()
<?php
$client = curl_init("https://runapi.ai/api/v1/gemini_tts/text_to_speech");
curl_setopt_array($client, [
CURLOPT_HTTPHEADER => ["Authorization: Bearer " . getenv("RUNAPI_API_KEY"), "Content-Type: application/json"],
CURLOPT_POSTFIELDS => json_encode([
'model' => 'gemini-3.1-flash-tts',
'text' => 'Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico.',
])
]);
$response = curl_exec($client);
RunApi client = new RunApi(System.getenv("RUNAPI_API_KEY"));
Task task = client.textToSpeech().run({"model":"gemini-3.1-flash-tts","text":"Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico."});
task.waitForResult();
require "runapi/gemini_tts"
client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
model: "gemini-3.1-flash-tts",
text: "Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico."
)
client := runapi.NewClient(os.Getenv("RUNAPI_API_KEY"))
task, err := client.textToSpeech.Run({"model":"gemini-3.1-flash-tts","text":"Genera una introducción de podcast para dos hablantes, con un presentador británico de tono tranquilo y un invitado estadounidense enérgico."})
if err != nil { log.Fatal(err) }
task.Wait()
$ runapi generate \
--model gemini-3.1-flash-tts \
--endpoint text_to_speech \
--wait
2 versiones disponibles
Elige cualquier modelo y genera en segundos.
Elige cualquier modelo y genera en segundos.
| Proveedor | |
| ID del modelo | gemini-3.1-flash-tts |
| Modalidad | Audio & Music |
| Tipos de tarea | Asynchronous |
| Endpoint de API | /api/v1/gemini_tts/text_to_speech |
| Unidad de facturación | 1K tokens |
| Parámetros de entrada | callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para gemini-3.1-flash-tts desde el panel de control.
Envía una solicitud POST a /api/v1/gemini_tts/text_to_speech con el identificador del modelo gemini-3.1-flash-tts y tus parámetros.
Consulta la tarea o sigue el callback para recuperar el resultado completado de gemini-3.1-flash-tts.
Configura 5 parámetros documentados, incluidos dialogue_turns, sample_context, scene, speakers, temperature.
Expone 1 endpoint(s) público(s): text_to_speech.
Las tareas asíncronas aceptan una URL de callback para notificaciones de finalización.
Medido por 1K tokens sin requisito de suscripción.
sceneScene and recording environment.
speakersNon-empty speaker configurations with unique Speaker N identifiers.
temperatureSampling temperature.
callback_urlWebhook URL for async notifications.
dialogue_turnsNon-empty ordered dialogue turns whose speaker ids reference configured speakers.
sample_contextOverall delivery context and tone.
Crea pistas y assets de audio.
Construye pipelines de voz y audio.
Expón herramientas de audio a tu entorno de desarrollo.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros