Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
Sintesi vocale, clonazione della voce, trascrizione ed effetti sonori con ElevenLabs, Fish Audio, Google e il catalogo audio pubblico.
Esempi
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Una chiave per tutti i modelli TTS e vocali.
Esplora le voci disponibili nei modelli audio supportati.
Invia il testo e la voce scelta a /api/v1/elevenlabs/text_to_speech.
Ricevi l'audio generato dal risultato dell'attività.
Smetti di gestire chiavi API diverse. Una sola integrazione ti dà accesso a oltre 200 modelli di tutti i provider.
I nostri accordi sui volumi con i provider offrono prezzi inferiori a quelli diretti, senza maggiorazioni.
Se un provider non è disponibile, instradiamo la richiesta alla migliore alternativa. La tua app resta attiva.
Sostituzione diretta dell'SDK OpenAI. Cambia una riga di codice per accedere a qualsiasi modello.
Paghi solo ciò che usi. Prezzi per richiesta senza minimi, con costi tracciati per modello e progetto.
Autentica le richieste all'API audio con la tua API key RunAPI.
Abbina il TTS in streaming a un LLM e alla trascrizione per creare un flusso vocale full duplex con una sola chiave.
Doppia i video esistenti in nuove lingue con una voce clonata che rimane riconoscibile.
Trascrivi con le etichette dei parlanti, poi riassumi tramite l'endpoint LLM nella stessa pipeline.
Aggiungi la narrazione ad articoli, documenti e contenuti nell'app senza una sessione di registrazione.
| Funzionalità | RunAPI | ElevenLabs diretto | OpenAI TTS |
|---|---|---|---|
| Modelli vocali | 32 modelli audio | 1 provider | 6 voci |
| Prezzi | Da $0.12 / minute | Tariffa ufficiale | Tariffa ufficiale |
| Streaming in tempo reale | Sì | Sì | No |
| Fatturazione unificata | Sì | No | No |
| Server MCP | Sì | No | No |
| Failover del provider | Sì | No | No |
Per 1.000 caratteri di testo in input alla tariffa del modello. La trascrizione viene fatturata al minuto di audio.
Sì. Carica un campione di riferimento per creare un id voce, poi passa quell'id nelle richieste successive.
Il supporto streaming dipende dall'endpoint selezionato. Consulta il formato di risposta documentato prima di integrare la riproduzione.
Le lingue supportate variano in base al modello. Consulta la documentazione del modello selezionato.
Il contenuto delle richieste e delle risposte può essere conservato. Consulta l'informativa sulla privacy per i dettagli sul trattamento dei dati.
Il supporto e la precisione dei timestamp dipendono dall'endpoint di trascrizione. Consulta i campi di risposta documentati; le etichette dei parlanti sono una funzionalità separata.
Sintesi vocale, clonazione e trascrizione con una sola chiave. Inizia gratis, senza carta di credito.