Couverture des endpoints
Expose 1 endpoint(s) public(s) : chat_completion.
Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash-lite",
"messages": [
{
"role": "user",
"content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-2.5-flash-lite",
messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-2.5-flash-lite",
messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
11 versions disponibles
Gemini 2.5 Flash-Lite est le niveau Flash-Lite de la génération Gemini 2.5 de Google, conçu pour la classification et l'extraction à fort volume et les autres tâches à faible latence. Il est disponible pour tous depuis le 22 juillet 2025, avec une date limite des connaissances fixée à janvier 2025. La fenêtre de contexte atteint 1 048 576 tokens et la sortie jusqu'à 65 536 tokens.
Le thinking est désactivé par défaut, et Google documente un mode thinking optionnel pour les prompts plus difficiles. Google prend en charge l'appel de fonctions et les sorties structurées sur ce modèle.
Le modèle de Google accepte en entrée le texte, les images, la vidéo, l'audio et les PDF. Sur RunAPI, envoyez du texte via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions) ; RunAPI n'accepte que l'entrée texte pour ce modèle. Google recommande Gemini 3.5 Flash-Lite pour les nouveaux projets, que RunAPI propose sous l'ID gemini-3.5-flash-lite.
Choisissez un modèle et générez en quelques secondes.
| Fournisseur | |
| ID du modèle | gemini-2.5-flash-lite |
| Modalité | Texte |
| Types de tâche | Synchronous |
| Endpoint API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-2.5-flash-lite:generateContent | |
| /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent | |
| Unité de facturation | 1 000 jetons |
| État du catalogue | Opérationnel |
Inscrivez-vous gratuitement et créez une clé API pour gemini-2.5-flash-lite depuis le tableau de bord.
Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle gemini-2.5-flash-lite et vos paramètres.
Lisez directement la réponse gemini-2.5-flash-lite terminée depuis l’endpoint.
Expose 1 endpoint(s) public(s) : chat_completion.
Mesuré par 1 000 jetons, sans abonnement requis.
Aucun paramètre de requête n'est publié pour cet endpoint.
Utilisez les LLM pour le chat et le raisonnement.
Générez et révisez le travail d'implémentation.
Connectez les modèles aux tâches backend.
Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.
Google recommande Gemini 3.5 Flash-Lite ou Gemini 3.8 Flash pour les nouveaux travaux. Choisissez gemini-2.5-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API.
Oui. Google n'a annoncé aucune date d'arrêt, même si sa propre API réserve désormais l'accès aux modèles 2.5 aux utilisateurs qui s'en servaient déjà. Sur RunAPI, gemini-2.5-flash-lite est disponible pour tous les comptes.
Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-2.5-flash-lite. Les outils suivent le format standard d'OpenAI.
Pas par défaut. Google le livre avec le thinking désactivé pour les usages à fort volume et faible latence, et documente un mode thinking optionnel.
Passez l'ID de modèle affiché dans le quickstart.
Oui. Les tarifs sont mesurés par appel ou par unité.
Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.
Nous contacter