Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
Synteza mowy, klonowanie głosu, transkrypcja i efekty dźwiękowe z ElevenLabs, Fish Audio, Google oraz publicznym katalogiem audio.
Przykłady
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Jeden klucz do wszystkich modeli TTS i głosowych.
Przeglądaj dostępne głosy w obsługiwanych modelach audio.
Wyślij tekst i wybrany głos do /api/v1/elevenlabs/text_to_speech.
Odbierz wygenerowany dźwięk z wyniku zadania.
Nie zarządzaj już wieloma kluczami API. Jedna integracja daje dostęp do ponad 200 modeli wszystkich dostawców.
Dzięki umowom wolumenowym z dostawcami oferujemy ceny niższe niż zakup bezpośredni, bez narzutu.
Gdy dostawca przestaje działać, kierujemy żądanie do kolejnej najlepszej opcji. Twoja aplikacja działa dalej.
Bezpośredni zamiennik OpenAI SDK. Zmień jedną linię kodu, aby uzyskać dostęp do dowolnego modelu.
Płacisz tylko za wykorzystanie. Ceny za żądanie bez minimów oraz śledzenie kosztów według modelu i projektu.
Uwierzytelniaj żądania do API audio za pomocą klucza API RunAPI.
Połącz strumieniowe TTS z LLM i transkrypcją, aby zbudować w pełni dwukierunkową pętlę głosową za pomocą jednego klucza.
Zdubbinguj istniejący film na nowe języki za pomocą sklonowanego głosu, który pozostaje rozpoznawalny.
Wykonuj transkrypcję z etykietami mówców, a następnie podsumowuj ją przez punkt końcowy LLM w tym samym potoku.
Dodaj narrację do artykułów, dokumentów i treści w aplikacji bez sesji nagraniowej.
| Funkcja | RunAPI | ElevenLabs bezpośrednio | OpenAI TTS |
|---|---|---|---|
| Modele głosowe | 32 modeli audio | 1 dostawca | 6 głosów |
| Ceny | Od $0.12 / minute | Stawka oficjalna | Stawka oficjalna |
| Przesyłanie strumieniowe w czasie rzeczywistym | Tak | Tak | Nie |
| Ujednolicone rozliczenia | Tak | Nie | Nie |
| Serwer MCP | Tak | Nie | Nie |
| Przełączanie dostawcy | Tak | Nie | Nie |
Za każde 1 000 znaków tekstu wejściowego według stawki modelu. Transkrypcja jest rozliczana za minutę nagrania.
Tak. Prześlij próbkę referencyjną, aby utworzyć identyfikator głosu, a następnie przekaż go w kolejnych żądaniach.
Obsługa streamingu zależy od wybranego endpointu. Przed integracją odtwarzania sprawdź udokumentowany format odpowiedzi.
Obsługiwane języki zależą od modelu. Sprawdź dokumentację wybranego modelu.
Treść żądań i odpowiedzi może być przechowywana. Szczegóły przetwarzania danych znajdziesz w polityce prywatności.
Obsługa i dokładność znaczników czasu zależą od endpointu transkrypcji. Sprawdź udokumentowane pola odpowiedzi; etykiety mówców to osobna funkcja.
Synteza mowy, klonowanie i transkrypcja za jednym kluczem. Zacznij za darmo, bez karty kredytowej.