Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
Text-to-Speech, Stimmenklonen, Transkription und Soundeffekte mit ElevenLabs, Fish Audio, Google und dem öffentlichen Audio-Katalog.
Beispiele
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Ein Schlüssel für alle TTS- und Sprachmodelle.
Verfügbare Stimmen für unterstützte Audiomodelle durchsuchen.
Text und Stimmauswahl an /api/v1/elevenlabs/text_to_speech senden.
Das erzeugte Audio aus dem Aufgabenergebnis erhalten.
Verwalte nicht länger viele API-Schlüssel. Eine Integration bietet Zugriff auf über 200 Modelle aller Anbieter.
Unsere Mengenvereinbarungen mit Anbietern ermöglichen niedrigere Preise als beim Direktbezug, ohne Aufschlag.
Wenn ein Anbieter ausfällt, leiten wir an die nächstbeste Option weiter. Deine App bleibt verfügbar.
Direkter Ersatz für das OpenAI SDK. Ändere eine Zeile Code und greife auf jedes Modell zu.
Bezahle nur, was du nutzt. Abrechnung pro Anfrage ohne Mindestvolumen, mit Kostenübersicht je Modell und Projekt.
Authentifiziere Audio-API-Anfragen mit deinem RunAPI-API-Key.
Verbinde Streaming-TTS mit einem LLM und Transkription zu einer vollständig bidirektionalen Sprachschleife mit einem Schlüssel.
Vertone vorhandene Videos in neuen Sprachen mit einer geklonten Stimme, die erkennbar bleibt.
Transkribiere mit Sprecherkennzeichnung und fasse anschließend über den LLM-Endpunkt in derselben Pipeline zusammen.
Füge Artikeln, Dokumenten und Inhalten in deiner App ohne Aufnahmesitzung eine Sprachspur hinzu.
| Funktion | RunAPI | ElevenLabs direkt | OpenAI TTS |
|---|---|---|---|
| Stimmenmodelle | 32 Audiomodelle | 1 Anbieter | 6 Stimmen |
| Preise | Ab $0.12 / minute | Offizieller Preis | Offizieller Preis |
| Echtzeit-Streaming | Ja | Ja | Nein |
| Einheitliche Abrechnung | Ja | Nein | Nein |
| MCP-Server | Ja | Nein | Nein |
| Anbieter-Failover | Ja | Nein | Nein |
Pro 1.000 Zeichen des Eingabetexts zum Modelltarif. Transkription wird pro Audiominute abgerechnet.
Ja. Lade ein Referenzsample hoch, um eine Voice-ID zu erstellen, und übergib diese ID bei späteren Anfragen.
Streaming hängt vom gewählten Endpunkt ab. Prüfe vor der Wiedergabeintegration das dokumentierte Antwortformat.
Die unterstützten Sprachen unterscheiden sich je nach Modell. Prüfe die Dokumentation des gewählten Modells.
Anfrage- und Antwortinhalte können gespeichert werden. Details zur Datenverarbeitung stehen in der Datenschutzerklärung.
Unterstützung und Genauigkeit von Zeitstempeln hängen vom Transkriptionsendpunkt ab. Prüfe die dokumentierten Antwortfelder; Sprecherlabels sind eine separate Funktion.
Sprache, Klonen und Transkription hinter einem einzigen Schlüssel. Kostenlos starten, keine Kreditkarte erforderlich.