واجهة الصوت

واجهة الصوت والكلام بالذكاء الاصطناعي

تحويل النص إلى كلام، واستنساخ الأصوات، والتفريغ الصوتي، والمؤثرات الصوتية مع ElevenLabs, Fish Audio, Google وفهرس الصوت العام.

32 نماذج صوتية · نقاط نهاية صوتية عامة
32
النماذج الصوتية
6
المزوّدون
89
نقاط النهاية العامة
ساحة التجربة مباشر
النموذج
النص
ابدأ إنشاء الصوت التالي من هنا. اختر نموذجًا عامًا للاطلاع على السعر الحالي وتفاصيل نقطة النهاية.
الصوت الصوت الافتراضي
التنسيق mp3
السرعة 1.0x
الوضع text_to_speech

أمثلة

استمع إلى الأصوات

Aria — Natural

"Every model, every provider, one API key. That's what RunAPI gives you."

Miles — Narration

"Generate video, music, images, and audio from a single integration."

Nova — Conversational

"Switch between providers without changing a single line of code."

Kai — Broadcast

"Production-ready AI infrastructure with built-in failover and monitoring."

كل ما يمكن لـ audio endpoint فعله

Text to Speech

Stream natural speech from text with per-request voice and speed control.

Voice Cloning

Build a reusable voice from a short reference sample, then call it by id like any other voice.

Speech to Text

Transcribe long-form audio with timestamps, speaker labels, and word-level confidence.

Text to Sound

Generate foley and sound effects from a description — impacts, ambience, UI cues.

Text to Dialogue

Render multi-speaker conversations with distinct voices and natural turn timing in one call.

Audio models on one key

ElevenLabs/audio-isolation

ElevenLabs

$0.12 / minute

ElevenLabs/sound-effect-v2

ElevenLabs

$0.15 / minute

ElevenLabs/speech-to-text

ElevenLabs

$0.04 / minute

ElevenLabs/text-to-dialogue-v3

ElevenLabs

$0.14 / 1K chars

ElevenLabs/text-to-speech-multilingual-v2

ElevenLabs

$0.12 / 1K chars

ElevenLabs/text-to-speech-turbo-v2.5

ElevenLabs

$0.06 / 1K chars

View all 32 audio models
البدء السريع

تحويل النص إلى كلام

curl https://runapi.ai/api/v1/elevenlabs/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"text-to-speech-multilingual-v2","text":"Welcome to RunAPI.","voice":"Adam","language_code":"en"}'
كيف تعمل

أربع خطوات لأول عملية توليد

  1. احصل على مفتاح API

    مفتاح واحد لجميع نماذج تحويل النص إلى كلام والصوت.

  2. اختر صوتًا

    تصفح الأصوات المتاحة عبر نماذج الصوت المدعومة.

  3. أرسل النص

    أرسل النص واختيار الصوت إلى /api/v1/elevenlabs/text_to_speech.

  4. احصل على الصوت

    استلم الصوت المُنشأ من نتيجة المهمة.

لماذا يختار المطورون RunAPI

مفتاح واحد، جميع النماذج

توقف عن إدارة مفاتيح API متعددة. يمنحك تكامل واحد الوصول إلى أكثر من 200 نموذج لدى جميع المزوّدين.

توفير في التكلفة بنسبة 15-25%

تمنحنا اتفاقيات الحجم مع المزوّدين أسعارًا أقل من الشراء المباشر، من دون هامش إضافي.

تحويل تلقائي عند التعطل

إذا توقف أحد المزوّدين، نوجّه الطلب إلى الخيار الأفضل التالي ليظل تطبيقك يعمل.

متوافق مع OpenAI

بديل مباشر لـ OpenAI SDK. غيّر سطرًا واحدًا للوصول إلى أي نموذج.

فوترة فورية

ادفع مقابل ما تستخدمه فقط، بتسعير لكل طلب ومن دون حد أدنى، مع تتبع التكلفة لكل نموذج ومشروع.

المصادقة بمفتاح API

صادق على طلبات API الصوت باستخدام مفتاح RunAPI API الخاص بك.

ما تبنيه الفرق باستخدامه

الوكلاء الصوتيون

اربط تحويل النص إلى كلام المتدفق مع نموذج لغوي والتفريغ الصوتي لإنشاء حلقة صوتية ثنائية الاتجاه بالكامل باستخدام مفتاح واحد.

التوطين

دبلج الفيديو الحالي إلى لغات جديدة بصوت مستنسخ يظل مميزًا.

ملاحظات الاجتماعات

فرّغ الكلام مع تصنيفات المتحدثين، ثم لخّصه عبر نقطة نهاية النموذج اللغوي في المسار نفسه.

إمكانية الوصول

أضف السرد إلى المقالات والمستندات ومحتوى التطبيق دون جلسة تسجيل.

RunAPI مقابل البدائل

الميزة RunAPI ElevenLabs مباشرة OpenAI TTS
نماذج الأصوات 32 نموذجًا صوتيًا موفّر واحد 6 أصوات
التسعير بدءًا من $0.12 / minute السعر الرسمي السعر الرسمي
البث في الوقت الفعلي نعم نعم لا
الفوترة الموحدة نعم لا لا
خادم MCP نعم لا لا
التحويل التلقائي بين المزوّدين نعم لا لا

أسئلة حول Audio API

كيف تُحتسب تكلفة TTS؟

لكل 1,000 حرف من نص الإدخال وفق سعر النموذج. يُحتسب النسخ بالدقيقة من الصوت.

هل يمكنني استنساخ صوت؟

نعم. ارفع نموذجاً مرجعياً لإنشاء معرّف صوت، ثم مرّر هذا المعرّف في أي طلب لاحق.

هل البث (Streaming) مدعوم؟

يعتمد دعم البث على نقطة النهاية المختارة. راجع تنسيق الاستجابة الموثق قبل دمج التشغيل.

ما اللغات المدعومة؟

تختلف اللغات المدعومة حسب النموذج. راجع وثائق النموذج المختار.

هل تحتفظون بالصوت أو نماذج الأصوات؟

قد يتم الاحتفاظ بمحتوى الطلبات والاستجابات. راجع سياسة الخصوصية لمعرفة تفاصيل معالجة البيانات.

هل يمكنني الحصول على طوابع زمنية على مستوى الكلمة؟

يعتمد دعم الطوابع الزمنية ودقتها على نقطة نهاية النسخ المختارة. راجع حقول الاستجابة الموثقة؛ تسميات المتحدثين ميزة منفصلة.

امنح منتجك صوتاً

الكلام والاستنساخ والنسخ خلف مفتاح واحد. ابدأ مجاناً دون الحاجة لبطاقة ائتمان.

سجّل الدخول للإنشاء

أنشئ مفتاح API لتشغيل طلبات الصوت عبر حسابك.