Endpoint kapsamı
1 genel endpoint sunar: chat_completion.
Gemini 2.5 Flash-Lite; 1M bağlam, düşünme varsayılan olarak kapalı; OpenAI uyumlu Chat Completions
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash-lite",
"messages": [
{
"role": "user",
"content": "Bu kod tabanını analiz et ve önce/sonra örnekleriyle üç performans iyileştirmesi öner."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-2.5-flash-lite",
messages=[{"role": "user", "content": "Bu kod tabanını analiz et ve önce/sonra örnekleriyle üç performans iyileştirmesi öner."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-2.5-flash-lite",
messages: [{ role: "user", content: "Bu kod tabanını analiz et ve önce/sonra örnekleriyle üç performans iyileştirmesi öner." }]
});
11 varyant mevcut
Gemini 2.5 Flash-Lite, Google'ın Gemini 2.5 neslinin Flash-Lite katmanıdır ve yüksek hacimli sınıflandırma, bilgi çıkarma gibi düşük gecikme gerektiren işlere yöneliktir. 22 Temmuz 2025'te genel kullanıma sunuldu; bilgi kesim tarihi Ocak 2025'tir. Bağlam penceresi 1.048.576 token, çıktı en fazla 65.536 tokendir.
Düşünme varsayılan olarak kapalıdır; Google daha zor istemler için isteğe bağlı bir düşünme modu belgeliyor. Google bu modelde fonksiyon çağırma ve yapılandırılmış çıktıları destekler.
Google'ın modeli metin, görsel, video, ses ve PDF girdisi kabul eder. RunAPI'de metni OpenAI uyumlu Chat Completions uç noktası (/v1/chat/completions) üzerinden gönderin; RunAPI bu model için yalnızca metin girdisi kabul eder. Google yeni projeler için Gemini 3.5 Flash-Lite'ı öneriyor; RunAPI bu modeli gemini-3.5-flash-lite olarak sunar.
Herhangi bir modeli seçin ve saniyeler içinde oluşturun.
| Sağlayıcı | |
| Model kimliği | gemini-2.5-flash-lite |
| Modality | Metin |
| Görev türleri | Synchronous |
| API uç noktası | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-2.5-flash-lite:generateContent | |
| /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent | |
| Faturalandırma birimi | 1K token |
| Katalog durumu | Operasyonel |
Ücretsiz kaydolun ve kontrol panelinden gemini-2.5-flash-lite için bir API anahtarı oluşturun.
gemini-2.5-flash-lite model kimliği ve parametrelerinizle /v1/chat/completions adresine POST isteği gönderin.
Tamamlanan gemini-2.5-flash-lite yanıtını uç noktadan doğrudan okuyun.
1 genel endpoint sunar: chat_completion.
Abonelik gerektirmeksizin 1K token ile ölçülür.
Bu uç nokta için yayımlanmış istek parametresi yok.
Özel bir bilgi tabanından müşteri sorularını yanıtlayarak destek talebi sayısını azaltın.
Sözleşme özetleri hazırlayın ve avukat incelemesi için önemli maddeleri işaretleyin.
CI içinde birim testleri, kod incelemeleri ve refaktör önerilerini otomatik oluşturun.
Bu model için henüz doğrulanmış müşteri geri bildirimi mevcut değil.
Google yeni işler için Gemini 3.5 Flash-Lite veya Gemini 3.8 Flash'ı öneriyor. Mevcut bir iş yükü, istem seti veya değerlendirme gemini-2.5-flash-lite üzerine kurulduysa bu modeli seçin. İki model de RunAPI'de aynı API anahtarıyla kullanılabilir.
Evet. Google model için bir kapanış tarihi açıklamadı; ancak Google'ın kendi API'si artık 2.5 modellerine erişimi daha önce bu modelleri kullanmış kullanıcılarla sınırlıyor. RunAPI'de gemini-2.5-flash-lite her hesap için kullanılabilir.
Evet. OpenAI SDK'yı RunAPI API anahtarınızla https://runapi.ai/v1 adresine yönlendirin ve model değeri gemini-2.5-flash-lite olan Chat Completions istekleri gönderin. Araçlar standart OpenAI tools biçimini kullanır.
Varsayılan olarak hayır. Google modeli yüksek hacimli, düşük gecikmeli işler için düşünme kapalı olarak sunuyor ve isteğe bağlı bir düşünme modu belgeliyor.
Quickstart'ta gösterilen model ID'sini gönderin.
Anahtar bazlı hız limitleri kullanım kademesine göre ölçeklenir. Güncel limitler için fiyatlandırma sayfasına bakın.
Evet — varyant bir bayraktır. model parametresini değiştirerek geçiş yapın.
Streaming उपलब्ध olduğunda RunAPI uçtan uca stream eder.
Herkese açık GitHub reposunda bir issue açın veya desteğe e-posta gönderin.
Kurumsal kurulum, entegrasyonlar ve teknik sorular konusunda yardımcı oluruz.
İletişime geçin