Aria — Natural
"Every model, every provider, one API key. That's what RunAPI gives you."
تحويل النص إلى كلام، واستنساخ الأصوات، والتفريغ الصوتي، والمؤثرات الصوتية مع ElevenLabs, Fish Audio, Google وفهرس الصوت العام.
أمثلة
"Every model, every provider, one API key. That's what RunAPI gives you."
"Generate video, music, images, and audio from a single integration."
"Switch between providers without changing a single line of code."
"Production-ready AI infrastructure with built-in failover and monitoring."
Stream natural speech from text with per-request voice and speed control.
Build a reusable voice from a short reference sample, then call it by id like any other voice.
Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.
Generate foley and sound effects from a description — impacts, ambience, UI cues.
Render multi-speaker conversations with distinct voices and natural turn timing in one call.
ElevenLabs
$0.12 / minute
ElevenLabs
$0.15 / minute
ElevenLabs
$0.04 / minute
ElevenLabs
$0.14 / 1K chars
ElevenLabs
$0.12 / 1K chars
ElevenLabs
$0.06 / 1K chars
curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
مفتاح واحد لجميع نماذج تحويل النص إلى كلام والصوت.
تصفح الأصوات المتاحة عبر نماذج الصوت المدعومة.
أرسل النص واختيار الصوت إلى /api/v1/elevenlabs/text_to_speech.
استلم الصوت المُنشأ من نتيجة المهمة.
توقف عن إدارة مفاتيح API متعددة. يمنحك تكامل واحد الوصول إلى أكثر من 200 نموذج لدى جميع المزوّدين.
تمنحنا اتفاقيات الحجم مع المزوّدين أسعارًا أقل من الشراء المباشر، من دون هامش إضافي.
إذا توقف أحد المزوّدين، نوجّه الطلب إلى الخيار الأفضل التالي ليظل تطبيقك يعمل.
بديل مباشر لـ OpenAI SDK. غيّر سطرًا واحدًا للوصول إلى أي نموذج.
ادفع مقابل ما تستخدمه فقط، بتسعير لكل طلب ومن دون حد أدنى، مع تتبع التكلفة لكل نموذج ومشروع.
صادق على طلبات API الصوت باستخدام مفتاح RunAPI API الخاص بك.
اربط تحويل النص إلى كلام المتدفق مع نموذج لغوي والتفريغ الصوتي لإنشاء حلقة صوتية ثنائية الاتجاه بالكامل باستخدام مفتاح واحد.
دبلج الفيديو الحالي إلى لغات جديدة بصوت مستنسخ يظل مميزًا.
فرّغ الكلام مع تصنيفات المتحدثين، ثم لخّصه عبر نقطة نهاية النموذج اللغوي في المسار نفسه.
أضف السرد إلى المقالات والمستندات ومحتوى التطبيق دون جلسة تسجيل.
| الميزة | RunAPI | ElevenLabs مباشرة | OpenAI TTS |
|---|---|---|---|
| نماذج الأصوات | 32 نموذجًا صوتيًا | موفّر واحد | 6 أصوات |
| التسعير | بدءًا من $0.12 / minute | السعر الرسمي | السعر الرسمي |
| البث في الوقت الفعلي | نعم | نعم | لا |
| الفوترة الموحدة | نعم | لا | لا |
| خادم MCP | نعم | لا | لا |
| التحويل التلقائي بين المزوّدين | نعم | لا | لا |
لكل 1,000 حرف من نص الإدخال وفق سعر النموذج. يُحتسب النسخ بالدقيقة من الصوت.
نعم. ارفع نموذجاً مرجعياً لإنشاء معرّف صوت، ثم مرّر هذا المعرّف في أي طلب لاحق.
يعتمد دعم البث على نقطة النهاية المختارة. راجع تنسيق الاستجابة الموثق قبل دمج التشغيل.
تختلف اللغات المدعومة حسب النموذج. راجع وثائق النموذج المختار.
قد يتم الاحتفاظ بمحتوى الطلبات والاستجابات. راجع سياسة الخصوصية لمعرفة تفاصيل معالجة البيانات.
يعتمد دعم الطوابع الزمنية ودقتها على نقطة نهاية النسخ المختارة. راجع حقول الاستجابة الموثقة؛ تسميات المتحدثين ميزة منفصلة.
الكلام والاستنساخ والنسخ خلف مفتاح واحد. ابدأ مجاناً دون الحاجة لبطاقة ائتمان.