Audio-API

AI-audio- en spraak-API

Tekst-naar-spraak, stemklonen, transcriptie en geluidseffecten met ElevenLabs, Fish Audio, Google en de openbare audiocatalogus.

32 audiomodellen · openbare audio-eindpunten
32
Audiomodellen
6
Providers
89
Openbare eindpunten
Playground live
Model
Tekst
Je volgende audio begint hier. Kies een openbaar model om de actuele prijs en details van het eindpunt te bekijken.
Stem Standaardstem
Formaat mp3
Snelheid 1.0x
Modus text_to_speech

Voorbeelden

Hoor de stemmen

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

Alles wat de audio endpoint kan doen

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
Quickstart

Spraak synthetiseren

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Zo werkt het

Vier stappen naar je eerste generatie

  1. Je API-sleutel ophalen

    Eén sleutel voor alle TTS- en stemmodellen.

  2. Een stem kiezen

    Bekijk beschikbare stemmen in ondersteunde audiomodellen.

  3. Tekst verzenden

    Verstuur je tekst en stemkeuze naar /api/v1/elevenlabs/text_to_speech.

  4. Audio ophalen

    Ontvang de gegenereerde audio uit het taakresultaat.

Waarom ontwikkelaars voor RunAPI kiezen

Eén sleutel, alle modellen

Beheer niet langer meerdere API-sleutels. Eén integratie geeft toegang tot meer dan 200 modellen van alle providers.

15-25% kostenbesparing

Dankzij volumeafspraken met providers zijn onze prijzen lager dan rechtstreeks inkopen, zonder opslag.

Automatische failover

Bij een storing bij een provider sturen we door naar de beste volgende optie. Je app blijft beschikbaar.

OpenAI-compatibel

Directe vervanging voor de OpenAI SDK. Wijzig één regel code om elk model te gebruiken.

Realtime facturering

Betaal alleen voor wat je gebruikt. Prijzen per aanvraag zonder minimum en kosten per model en project.

API-key-authenticatie

Authenticeer audio-API-verzoeken met je RunAPI-API-key.

Wat teams ermee bouwen

Spraakagents

Combineer streaming-TTS met een LLM en transcriptie voor een volledige duplex-spraaklus met één sleutel.

Lokalisatie

Dub bestaande video in nieuwe talen met een gekloonde stem die herkenbaar blijft.

Vergadernotities

Transcribeer met sprekerlabels en vat daarna samen via het LLM-eindpunt in dezelfde pipeline.

Toegankelijkheid

Voeg zonder opnamesessie vertelling toe aan artikelen, documentatie en in-app content.

RunAPI versus alternatieven

Functie RunAPI ElevenLabs direct OpenAI TTS
Stemmodellen 32 audiomodellen 1 aanbieder 6 stemmen
Prijzen Vanaf $0.12 / minute Officieel tarief Officieel tarief
Realtime streaming Ja Ja Nee
Gecombineerde facturering Ja Nee Nee
MCP-server Ja Nee Nee
Failover tussen aanbieders Ja Nee Nee

Vragen over de Audio API

Hoe wordt TTS gefactureerd?

Per 1.000 tekens invoertekst tegen het tarief van het model. Transcriptie wordt per minuut audio gefactureerd.

Kan ik een stem klonen?

Ja. Upload een referentiefragment om een voice id aan te maken en geef dat id mee bij elk volgend verzoek.

Wordt streaming ondersteund?

Streamingondersteuning hangt af van het gekozen endpoint. Controleer het gedocumenteerde antwoordformaat voordat je afspelen integreert.

Welke talen worden ondersteund?

Ondersteunde talen verschillen per model. Raadpleeg de documentatie van het gekozen model.

Bewaren jullie audio- of stemopnamen?

De inhoud van verzoeken en antwoorden kan worden bewaard. Raadpleeg het privacybeleid voor informatie over gegevensverwerking.

Kan ik tijdcodes op woordniveau krijgen?

Ondersteuning en nauwkeurigheid van tijdcodes hangen af van het transcriptie-endpoint. Controleer de gedocumenteerde antwoordvelden; sprekerlabels zijn een aparte functie.

Geef je product een stem

Spraak, klonen en transcriptie achter één sleutel. Gratis starten, geen creditcard vereist.

Log in om te genereren

Maak een API-sleutel aan om audioaanvragen via je account uit te voeren.