It looks like you may prefer a different language. Switch anytime.

Google

Gemini TTS gemini 2.5 pro tts

Audio & Music

Fala multivoz de alta fidelidade com controle expressivo para diálogos longos

Input $1.40 / 1M tokens | Output $28.00 / 1M tokens Gemini TTS gemini 2.5 pro tts Ler a documentação →
Saúde do modelo Dados insuficientes
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-pro-tts",
  "text": "Gere a abertura de um podcast com dois locutores, usando um apresentador britânico de voz calma e um convidado americano enérgico."
}'
https://runapi.ai 1 endpoint

2 variantes disponíveis

Playground

Experimente Gemini TTS gemini 2.5 pro tts

Escolha qualquer modelo e gere em segundos.

Experimente um modelo agora

Escolha qualquer modelo e gere em segundos.

Modelo
Mode
Estimado: Input $1.40 / 1M tokens | Output $28.00 / 1M tokens
Gerar

Entre para gerar com a RunAPI.

Especificações

FICHA TÉCNICA

Provedor Google
ID do modelo gemini-2.5-pro-tts
Modalidade Audio & Music
Tipos de tarefa Asynchronous
Endpoint da API /api/v1/gemini_tts/text_to_speech
Unidade de cobrança 1K tokens
Parâmetros de entrada callback_url, dialogue_turns, model, sample_context, scene, speakers, temperature
Status do catálogo Operacional
COMO FUNCIONA

Use este modelo em 3 etapas

  1. Crie sua chave

    Cadastre-se gratuitamente e crie uma chave de API para gemini-2.5-pro-tts no painel.

  2. Envie uma solicitação

    Envie uma solicitação POST para /api/v1/gemini_tts/text_to_speech com o identificador do modelo gemini-2.5-pro-tts e seus parâmetros.

  3. Obtenha os resultados

    Consulte a tarefa ou siga o callback para recuperar o resultado concluído de gemini-2.5-pro-tts.

O que este modelo oferece

Parâmetros flexíveis

Configure 5 parâmetros documentados, incluindo dialogue_turns, sample_context, scene, speakers, temperature.

Cobertura de endpoints

Expõe 1 endpoint(s) público(s): text_to_speech.

Entrega via webhook

Tarefas assíncronas aceitam uma URL de callback para notificações de conclusão.

Cobrança por uso

Medido por 1K tokens, sem exigência de assinatura.

Gemini TTS gemini 2.5 pro tts PREÇOS

Endpoint
Resolução
Duração
Preço
text_to_speech
Indisponível
1K tokens
Input: $1.40 / 1M tokens Output: $28.00 / 1M tokens
REFERÊNCIA DA API

Especificação do endpoint

Endpoint
POST /api/v1/gemini_tts/text_to_speech
ID do modelo
gemini-2.5-pro-tts
Tipos de tarefa
text_to_speech
Duração máxima
Indisponível
Resoluções
Indisponível
Proporções
Indisponível
Formato de saída
Indisponível
Tempo médio de geração
Indisponível

Parâmetros da solicitação

scene

Opcional string

Scene and recording environment.

speakers

Obrigatório array

Non-empty speaker configurations with unique Speaker N identifiers.

temperature

Opcional number

Sampling temperature.

callback_url

Opcional string

Webhook URL for async notifications.

dialogue_turns

Obrigatório array

Non-empty ordered dialogue turns whose speaker ids reference configured speakers.

sample_context

Opcional string

Overall delivery context and tone.

CASOS DE USO

Geração de música

Crie faixas e assets de áudio.

Fluxos de voz

Construa pipelines de fala e áudio.

Criação assistida por tools

Exponha ferramentas de áudio ao ambiente de desenvolvimento.

FAQ

Perguntas frequentes sobre Gemini TTS gemini 2.5 pro tts

Como seleciono gemini-2.5-pro-tts?

Envie o ID de modelo mostrado no quickstart.

O preço é por uso?

Sim. O preço é medido por chamada ou unidade.

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco