Audio & Music · Google

Gemini TTS API

وصول API إلى Gemini TTS لحوار متعدد المتحدثين، مع أصوات ولهجات وأساليب إلقاء وإيقاع كلام قابلة للضبط.

جاهز للتشغيل · 2 variants · ابتداءً من $0.0014
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_tts/text_to_speech \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-tts",
  "text": "أنشئ مقدمة بودكاست بمتحدثين اثنين، مقدم بريطاني هادئ وضيف أمريكي حيوي."
}'
import { GeminiTtsClient } from "@runapi.ai/gemini-tts";

const client = new GeminiTtsClient();
const result = await client.textToSpeech.run({
    model: "gemini-3.1-flash-tts",
    text: "أنشئ مقدمة بودكاست بمتحدثين اثنين، مقدم بريطاني هادئ وضيف أمريكي حيوي.",
});
require "runapi/gemini_tts"

client = RunApi::GeminiTts::Client.new
result = client.text_to_speech.run(
    model: "gemini-3.1-flash-tts",
    text: "أنشئ مقدمة بودكاست بمتحدثين اثنين، مقدم بريطاني هادئ وضيف أمريكي حيوي."
)
npx skills add runapi-ai/gemini-tts -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-tts v1
OVERVIEW

يحوّل Gemini TTS تسلسل الحوار إلى كلام مع الاحتفاظ بإعداد صوت مستقل لكل متحدث. ويمكن للطلبات أيضًا ضبط المشهد وسياق الإلقاء العام ودرجة حرارة أخذ العينات.

  • عدة إصدارات لمستويات مختلفة من السرعة / الجودة
  • يتضمن model skill التوثيق والـschemas وملاحظات الإعداد
  • يعمل مع workflows موجهة لتطوير التطبيقات
  • لا يتم احتساب رسوم على عمليات التوليد الفاشلة
VARIANTS

قارن جميع إصدارات API

Variant Billing Pricing
gemini-2.5-pro-tts 1K tokens Input $1.40 / 1M tokens | Output $28.00 / 1M tokens عرض →
gemini-3.1-flash-tts 1K tokens Input $1.40 / 1M tokens | Output $28.00 / 1M tokens عرض →
SKILLS

ثبّت skill Gemini TTS لتطوير التطبيقات

حمّل توثيق النموذج والـschemas وملاحظات الأسعار وخطوات الإعداد إلى مساحة عمل الكود.

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-tts -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini TTS skill for this app:

1. Add runapi-ai/gemini-tts with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
كيف يعمل

من model skill إلى أول نتيجة في أربع خطوات

01

اختر النموذج

اختر النموذج والإصدار المناسبين لنوع المخرجات ومستوى الجودة وزمن الاستجابة المستهدف.

02

الإعداد

اضبط مفتاح RunAPI وثبّت model skill في مساحة عمل الكود.

03

التنفيذ

استخدم تعليمات المهارة لإضافة ميزة النموذج داخل تطبيقك.

04

الاستلام

استعلم عبر task ID أو استخدم البث عند دعمه أو عالج webhook callback.

CONTEXT

ما هي Gemini TTS API؟

يندرج Gemini TTS ضمن كتالوج Google على RunAPI، ويتيح Gemini 2.5 Pro TTS وGemini 3.1 Flash TTS عبر واجهات موحّدة لـ API وSDK وCLI.

Provider
Google
Modality
Audio & Music
لماذا RunAPI

لماذا تستخدم Gemini TTS API عبر RunAPI

مصادقة واحدة لكل مزود

مفتاح RunAPI واحد يفتح الوصول إلى الكتالوج بالكامل. لا حسابات منفصلة، ولا تدوير مفاتيح لكل تكامل.

تسعير وفوترة موحّدان

تسعير لكل استدعاء بالدولار الأمريكي، ويُفوتر شهريًا. لا تُحتسب التوليدات الفاشلة.

Skill مع schemas

تأتي الـschemas المعرّفة وملاحظات الإعداد داخل model skill حتى يبدأ التنفيذ من العقد الصحيح.

FAQ

أسئلة شائعة

ما نماذج Gemini TTS المتاحة؟

يدعم RunAPI Gemini 2.5 Pro TTS وGemini 3.1 Flash TTS من خلال نفس نقطة نهاية تحويل النص إلى كلام وبنية الطلب نفسها.

كيف أضبط إعدادات عدة متحدثين؟

أضف إعدادًا لكل مشارك باستخدام معرّف فريد بصيغة Speaker N، ثم اربط كل دور في الحوار بأحد هذه المعرّفات.

ما الذي يمكنني التحكم به لكل متحدث؟

لكل متحدث صوت ولهجة وأسلوب إلقاء وإيقاع كلام، مع ملف تعريف صوتي اختياري لإضافة توجيهات صوتية.

كيف يؤثر المشهد وسياق العينة في الطلب؟

يصف المشهد بيئة التسجيل، بينما يحدد سياق العينة النبرة العامة وتوجيهات إلقاء الحوار.

كيف تُعاد النتائج الصوتية المكتملة؟

استعلم عن المهمة أو استقبل رد الاتصال عند اكتمالها؛ وتتضمن الاستجابة قائمة audios تحتوي على رابط URL للملف المُنشأ.

أي نسخة ينبغي أن أبدأ بها؟

اختر أرخص نسخة تفي بمعيار الجودة لديك. يبدأ معظم الفرق بالنسخة السريعة ثم ينتقلون إلى pro للإنتاج.

هل توجد خطة مجانية؟

تحصل الحسابات الجديدة على أول طلبات مجانية على كل نموذج. بعد ذلك، الدفع حسب كل طلب.

هل تدعمون البث المباشر للنتائج؟

حيث يتوفر البث المباشر، يوفّر RunAPI البث من البداية إلى النهاية.

كيف يتم احتساب الرسوم عند الفشل؟

لا يتم تحصيل رسوم على عمليات التوليد الفاشلة.

هل يتم تخزين المخرجات مؤقتًا؟

يتم حفظ المخرجات المولدة ويمكن استرجاعها بواسطة task ID. لا يتم تخزين المدخلات مؤقتًا.

هل يمكنني الاستخدام تجاريًا؟

نعم — يشمل كل إصدار الاستخدام التجاري ما لم يقيّده ترخيص النموذج صراحةً، ويُشار إلى ذلك في صفحة الإصدار.

ماذا عن حدود المعدل؟

تتدرج حدود المعدل لكل مفتاح وفق فئة الاستخدام. راجع صفحة الأسعار للاطلاع على الحدود الحالية.

أين يمكنني الإبلاغ عن المشاكل؟

افتح issue في مستودع GitHub العام أو راسل الدعم عبر البريد الإلكتروني.

ابدأ الآن

ابدأ البناء باستخدام Gemini TTS API.