API audio

API audio e voce con IA

Sintesi vocale, clonazione della voce, trascrizione ed effetti sonori con ElevenLabs, Fish Audio, Google e il catalogo audio pubblico.

32 modelli audio · endpoint audio pubblici
32
Modelli audio
6
Provider
89
Endpoint pubblici
Playground live
Modello
Testo
La tua prossima elaborazione audio inizia qui. Scegli un modello pubblico per vedere il prezzo attuale e i dettagli dell'endpoint.
Voce Voce predefinita
Formato mp3
Velocità 1.0x
Modalità text_to_speech

Esempi

Ascolta le voci

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

Tutto ciò che l'audio endpoint può fare

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
Avvio rapido

Sintetizza il parlato

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Come funziona

Quattro passaggi per la tua prima generazione

  1. Ottieni la tua chiave API

    Una chiave per tutti i modelli TTS e vocali.

  2. Scegli una voce

    Esplora le voci disponibili nei modelli audio supportati.

  3. Invia il testo

    Invia il testo e la voce scelta a /api/v1/elevenlabs/text_to_speech.

  4. Ottieni l'audio

    Ricevi l'audio generato dal risultato dell'attività.

Perché gli sviluppatori scelgono RunAPI

Una chiave, tutti i modelli

Smetti di gestire chiavi API diverse. Una sola integrazione ti dà accesso a oltre 200 modelli di tutti i provider.

Risparmi del 15-25%

I nostri accordi sui volumi con i provider offrono prezzi inferiori a quelli diretti, senza maggiorazioni.

Failover automatico

Se un provider non è disponibile, instradiamo la richiesta alla migliore alternativa. La tua app resta attiva.

Compatibile con OpenAI

Sostituzione diretta dell'SDK OpenAI. Cambia una riga di codice per accedere a qualsiasi modello.

Fatturazione in tempo reale

Paghi solo ciò che usi. Prezzi per richiesta senza minimi, con costi tracciati per modello e progetto.

Autenticazione con API key

Autentica le richieste all'API audio con la tua API key RunAPI.

Cosa costruiscono i team con questa API

Agenti vocali

Abbina il TTS in streaming a un LLM e alla trascrizione per creare un flusso vocale full duplex con una sola chiave.

Localizzazione

Doppia i video esistenti in nuove lingue con una voce clonata che rimane riconoscibile.

Note delle riunioni

Trascrivi con le etichette dei parlanti, poi riassumi tramite l'endpoint LLM nella stessa pipeline.

Accessibilità

Aggiungi la narrazione ad articoli, documenti e contenuti nell'app senza una sessione di registrazione.

RunAPI a confronto con le alternative

Funzionalità RunAPI ElevenLabs diretto OpenAI TTS
Modelli vocali 32 modelli audio 1 provider 6 voci
Prezzi Da $0.12 / minute Tariffa ufficiale Tariffa ufficiale
Streaming in tempo reale No
Fatturazione unificata No No
Server MCP No No
Failover del provider No No

Domande sull'Audio API

Come viene fatturato il TTS?

Per 1.000 caratteri di testo in input alla tariffa del modello. La trascrizione viene fatturata al minuto di audio.

Posso clonare una voce?

Sì. Carica un campione di riferimento per creare un id voce, poi passa quell'id nelle richieste successive.

Lo streaming è supportato?

Il supporto streaming dipende dall'endpoint selezionato. Consulta il formato di risposta documentato prima di integrare la riproduzione.

Quali lingue sono supportate?

Le lingue supportate variano in base al modello. Consulta la documentazione del modello selezionato.

Conservate l'audio o i campioni vocali?

Il contenuto delle richieste e delle risposte può essere conservato. Consulta l'informativa sulla privacy per i dettagli sul trattamento dei dati.

Posso ottenere i timestamp a livello di parola?

Il supporto e la precisione dei timestamp dipendono dall'endpoint di trascrizione. Consulta i campi di risposta documentati; le etichette dei parlanti sono una funzionalità separata.

Dai una voce al tuo prodotto

Sintesi vocale, clonazione e trascrizione con una sola chiave. Inizia gratis, senza carta di credito.

Accedi per generare

Crea una chiave API per eseguire richieste audio dal tuo account.