Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
Synthèse vocale, clonage de voix, transcription et effets sonores avec ElevenLabs, Fish Audio, Google et le catalogue audio public.
Exemples
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
Une clé pour tous les modèles de synthèse vocale et de voix.
Parcourez les voix disponibles dans les modèles audio pris en charge.
Envoyez votre texte et votre voix à /api/v1/elevenlabs/text_to_speech.
Recevez l'audio généré depuis le résultat de la tâche.
Ne jonglez plus entre les clés API. Une intégration donne accès à plus de 200 modèles de tous les fournisseurs.
Nos accords de volume avec les fournisseurs permettent des prix inférieurs au direct, sans majoration.
Si un fournisseur tombe en panne, nous basculons vers la meilleure option suivante. Votre application reste active.
Remplacement direct du SDK OpenAI. Changez une ligne de code pour accéder à n'importe quel modèle.
Payez uniquement ce que vous utilisez. Prix par requête sans minimum, avec suivi par modèle et par projet.
Authentifiez les requêtes à l'API audio avec votre clé API RunAPI.
Associez la synthèse vocale en streaming à un LLM et à la transcription pour créer une boucle vocale full duplex avec une seule clé.
Doublez une vidéo existante dans de nouvelles langues avec une voix clonée qui reste reconnaissable.
Transcrivez avec les noms des intervenants, puis résumez via le point de terminaison LLM dans le même pipeline.
Ajoutez une narration aux articles, aux documents et au contenu intégré à l'application sans session d'enregistrement.
| Fonctionnalité | RunAPI | ElevenLabs direct | OpenAI TTS |
|---|---|---|---|
| Modèles vocaux | 32 modèles audio | 1 fournisseur | 6 voix |
| Tarifs | À partir de $0.12 / minute | Tarif officiel | Tarif officiel |
| Streaming en temps réel | Oui | Oui | Non |
| Facturation unifiée | Oui | Non | Non |
| Serveur MCP | Oui | Non | Non |
| Basculement de fournisseur | Oui | Non | Non |
Par tranche de 1 000 caractères de texte en entrée au tarif du modèle. La transcription est facturée à la minute d'audio.
Oui. Téléversez un échantillon de référence pour créer un voice id, puis transmettez cet identifiant dans toute requête ultérieure.
La prise en charge du streaming dépend du point de terminaison choisi. Consultez le format de réponse documenté avant d'intégrer la lecture.
Les langues prises en charge varient selon le modèle. Consultez la documentation du modèle choisi.
Le contenu des requêtes et des réponses peut être conservé. Consultez la politique de confidentialité pour les détails du traitement des données.
La disponibilité et la précision des horodatages dépendent du point de terminaison de transcription. Consultez les champs de réponse documentés ; les étiquettes de locuteur sont une fonctionnalité distincte.
Synthèse vocale, clonage et transcription derrière une seule clé. Démarrez gratuitement, sans carte bancaire.