Gemini API
Google's multimodal LLM for chat, code generation, reasoning, and long-context tasks.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash",
"messages": [
{
"role": "user",
"content": "Analyze this codebase and suggest three performance improvements with before/after examples."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.5-flash",
messages=[{"role": "user", "content": "Analyze this codebase and suggest three performance improvements with before/after examples."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.5-flash",
messages: [{ role: "user", content: "Analyze this codebase and suggest three performance improvements with before/after examples." }]
});
Gemini is Google's multimodal large language model family supporting text, image, audio, and code understanding. Available in Flash and Pro variants, it handles tasks from quick summarization to deep reasoning and complex coding.
- عدة إصدارات لمستويات مختلفة من السرعة / الجودة
- يتضمن model skill التوثيق والـschemas وملاحظات الإعداد
- يعمل مع workflows موجهة لتطوير التطبيقات
- لا يتم احتساب رسوم على عمليات التوليد الفاشلة
قارن جميع إصدارات API
نقاط نهاية API لـ Gemini
استخدم SDK OpenAI أو Anthropic مع مفتاح RunAPI. لا حاجة لـ SDK إضافي.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
من model skill إلى أول نتيجة في أربع خطوات
اختر النموذج
اختر النموذج والإصدار المناسبين لنوع المخرجات ومستوى الجودة وزمن الاستجابة المستهدف.
الإعداد
اضبط مفتاح RunAPI وثبّت model skill في مساحة عمل الكود.
التنفيذ
استخدم تعليمات المهارة لإضافة ميزة النموذج داخل تطبيقك.
الاستلام
استعلم عبر task ID أو استخدم البث عند دعمه أو عالج webhook callback.
ما هي Gemini API؟
Gemini is Google's flagship multimodal LLM, available in Flash (fast) and Pro (frontier reasoning) variants. Through RunAPI, all Gemini models share the same API shape and billing.
لماذا تستخدم Gemini API عبر RunAPI
مصادقة واحدة لكل مزود
مفتاح RunAPI واحد يفتح الوصول إلى الكتالوج بالكامل. لا حسابات منفصلة، ولا تدوير مفاتيح لكل تكامل.
تسعير وفوترة موحّدان
تسعير لكل استدعاء بالدولار الأمريكي، ويُفوتر شهريًا. لا تُحتسب التوليدات الفاشلة.
Skill مع schemas
تأتي الـschemas المعرّفة وملاحظات الإعداد داخل model skill حتى يبدأ التنفيذ من العقد الصحيح.
أسئلة شائعة
What is the context window size for Gemini?
Up to 1 million tokens across all variants. This handles entire codebases, long documents, and multi-turn conversations without truncation.
What input modalities does Gemini accept?
Text, images, audio, and video. You can pass multimodal inputs in a single request for cross-modal reasoning.
What is Google Search grounding?
Gemini can ground responses in real-time Google Search results, reducing hallucination for factual and time-sensitive queries.
How do Flash and Pro compare?
Flash is optimized for speed and cost — ideal for high-volume tasks. Pro delivers deeper reasoning and is better for complex multi-step analysis.
Does Gemini support function calling?
Yes — Gemini supports structured function calling with typed JSON schemas, making it suitable for agentic workflows and tool use.
أي نسخة ينبغي أن أبدأ بها؟
اختر أرخص نسخة تفي بمعيار الجودة لديك. يبدأ معظم الفرق بالنسخة السريعة ثم ينتقلون إلى pro للإنتاج.
هل توجد خطة مجانية؟
تحصل الحسابات الجديدة على أول طلبات مجانية على كل نموذج. بعد ذلك، الدفع حسب كل طلب.
هل تدعمون البث المباشر للنتائج؟
حيث يتوفر البث المباشر، يوفّر RunAPI البث من البداية إلى النهاية.
كيف يتم احتساب الرسوم عند الفشل؟
لا يتم تحصيل رسوم على عمليات التوليد الفاشلة.
هل يتم تخزين المخرجات مؤقتًا؟
يتم حفظ المخرجات المولدة ويمكن استرجاعها بواسطة task ID. لا يتم تخزين المدخلات مؤقتًا.
هل يمكنني الاستخدام تجاريًا؟
نعم — يشمل كل إصدار الاستخدام التجاري ما لم يقيّده ترخيص النموذج صراحةً، ويُشار إلى ذلك في صفحة الإصدار.
ماذا عن حدود المعدل؟
تتدرج حدود المعدل لكل مفتاح وفق فئة الاستخدام. راجع صفحة الأسعار للاطلاع على الحدود الحالية.
أين يمكنني الإبلاغ عن المشاكل؟
افتح issue في مستودع GitHub العام أو راسل الدعم عبر البريد الإلكتروني.