Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
Texto para fala, clonagem de voz, transcrição e efeitos sonoros com ElevenLabs, Fish Audio, Google e o catálogo público de áudio.
Exemplos
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Uma chave para todos os modelos de TTS e voz.
Explore as vozes disponíveis nos modelos de áudio compatíveis.
Envie seu texto e a voz escolhida para /api/v1/elevenlabs/text_to_speech.
Receba o áudio gerado a partir do resultado da tarefa.
Pare de alternar entre chaves de API. Uma integração dá acesso a mais de 200 modelos de todos os provedores.
Nossos acordos de volume com provedores oferecem preços menores que os diretos, sem margem adicional.
Se um provedor cair, roteamos para a próxima melhor opção. Seu aplicativo continua no ar.
Substituição direta do SDK da OpenAI. Altere uma linha de código para acessar qualquer modelo.
Pague apenas pelo que usar. Preços por solicitação sem mínimos e custos por modelo e projeto.
Autentique solicitações à API de áudio com sua chave API RunAPI.
Combine TTS em streaming com um LLM e transcrição para criar um loop de voz full duplex com uma única chave.
Duble vídeos existentes em novos idiomas com uma voz clonada que continua reconhecível.
Transcreva com rótulos de locutor e depois resuma pelo endpoint LLM na mesma pipeline.
Adicione narração a artigos, documentos e conteúdo no aplicativo sem uma sessão de gravação.
| Recurso | RunAPI | ElevenLabs direto | OpenAI TTS |
|---|---|---|---|
| Modelos de voz | 32 modelos de áudio | 1 provedor | 6 vozes |
| Preços | A partir de $0.12 / minute | Preço oficial | Preço oficial |
| Streaming em tempo real | Sim | Sim | Não |
| Cobrança unificada | Sim | Não | Não |
| Servidor MCP | Sim | Não | Não |
| Failover de provedor | Sim | Não | Não |
Por 1.000 caracteres de texto de entrada, à taxa do modelo. A transcrição é cobrada por minuto de áudio.
Sim. Envie uma amostra de referência para criar um voice id e depois passe esse id em qualquer requisição futura.
O suporte a streaming depende do endpoint selecionado. Consulte o formato de resposta documentado antes de integrar a reprodução.
Os idiomas suportados variam conforme o modelo. Consulte a documentação do modelo selecionado.
O conteúdo das requisições e respostas pode ser armazenado. Consulte a política de privacidade para detalhes sobre o tratamento dos dados.
O suporte e a precisão dos timestamps dependem do endpoint de transcrição. Consulte os campos de resposta documentados; os rótulos de locutor são um recurso separado.
Síntese, clonagem e transcrição com uma única chave. Comece grátis, sem cartão de crédito.