Google

Gemini 2.5 Flash-Lite

Texte

Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI

Entrée $0.10 / 1M de tokens | Sortie $0.40 / 1M de tokens Gemini 2.5 Flash-Lite Lire la documentation →
Santé du modèle Données insuffisantes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après." }]
});
https://runapi.ai 5 endpoints
APERÇU

À quoi sert Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite est le niveau Flash-Lite de la génération Gemini 2.5 de Google, conçu pour la classification et l'extraction à fort volume et les autres tâches à faible latence. Il est disponible pour tous depuis le 22 juillet 2025, avec une date limite des connaissances fixée à janvier 2025. La fenêtre de contexte atteint 1 048 576 tokens et la sortie jusqu'à 65 536 tokens.

Le thinking est désactivé par défaut, et Google documente un mode thinking optionnel pour les prompts plus difficiles. Google prend en charge l'appel de fonctions et les sorties structurées sur ce modèle.

Le modèle de Google accepte en entrée le texte, les images, la vidéo, l'audio et les PDF. Sur RunAPI, envoyez du texte via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions) ; RunAPI n'accepte que l'entrée texte pour ce modèle. Google recommande Gemini 3.5 Flash-Lite pour les nouveaux projets, que RunAPI propose sous l'ID gemini-3.5-flash-lite.

ID du modèle
gemini-2.5-flash-lite
Date de sortie
22 juillet 2025 (disponibilité générale)
Date limite des connaissances
Janvier 2025
Fenêtre de contexte
1 048 576 tokens
Sortie maximale
65 536 tokens
Thinking
Optionnel, désactivé par défaut
Point d'accès sur RunAPI
OpenAI Chat Completions, entrée texte
Playground

Essayez Gemini 2.5 Flash-Lite

Choisissez un modèle et générez en quelques secondes.

Estimé : Entrée $0.10 / 1M de tokens | Sortie $0.40 / 1M de tokens

Connectez-vous pour générer avec RunAPI.

Connectez-vous pour générer

Connectez-vous pour commencer à générer avec vos modèles de langage disponibles.

Spécifications

FICHE TECHNIQUE

Fournisseur Google
ID du modèle gemini-2.5-flash-lite
Modalité Texte
Types de tâche Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
Unité de facturation 1 000 jetons
État du catalogue Opérationnel
COMMENT ÇA MARCHE

Utilisez ce modèle en 3 étapes

  1. Créez votre clé

    Inscrivez-vous gratuitement et créez une clé API pour gemini-2.5-flash-lite depuis le tableau de bord.

  2. Envoyez une requête

    Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle gemini-2.5-flash-lite et vos paramètres.

  3. Obtenez les résultats

    Lisez directement la réponse gemini-2.5-flash-lite terminée depuis l’endpoint.

Ce que ce modèle propose

Couverture des endpoints

Expose 1 endpoint(s) public(s) : chat_completion.

Facturation à l'usage

Mesuré par 1 000 jetons, sans abonnement requis.

Gemini 2.5 Flash-Lite TARIFS

Endpoint
Prix
chat_completion
Entrée: $0.10 / 1M de tokens Sortie: $0.40 / 1M de tokens
  • Lecture du cache: $0.01 / 1M de tokens
RÉFÉRENCE API

Spécification de l'endpoint

Endpoint
POST /v1/chat/completions
ID du modèle
gemini-2.5-flash-lite
Types de tâche
chat_completion

Paramètres de requête

Aucun paramètre de requête n'est publié pour cet endpoint.

CAS D’USAGE

Chat

Utilisez les LLM pour le chat et le raisonnement.

Code

Générez et révisez le travail d'implémentation.

Automatisation

Connectez les modèles aux tâches backend.

Métriques d'utilisation

Utilisé par des développeurs
6
Appels API / Jour
100.0%
Taux de succès
1.8s
Génération moyenne

Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.

FAQ

Questions fréquentes sur Gemini 2.5 Flash-Lite

Faut-il utiliser Gemini 2.5 Flash-Lite ou Gemini 3.5 Flash-Lite ?

Google recommande Gemini 3.5 Flash-Lite ou Gemini 3.8 Flash pour les nouveaux travaux. Choisissez gemini-2.5-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API.

Puis-je encore utiliser Gemini 2.5 Flash-Lite ?

Oui. Google n'a annoncé aucune date d'arrêt, même si sa propre API réserve désormais l'accès aux modèles 2.5 aux utilisateurs qui s'en servaient déjà. Sur RunAPI, gemini-2.5-flash-lite est disponible pour tous les comptes.

Puis-je appeler Gemini 2.5 Flash-Lite avec le SDK OpenAI ?

Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-2.5-flash-lite. Les outils suivent le format standard d'OpenAI.

Gemini 2.5 Flash-Lite réfléchit-il avant de répondre ?

Pas par défaut. Google le livre avec le thinking désactivé pour les usages à fort volume et faible latence, et documente un mode thinking optionnel.

Comment sélectionner gemini-2.5-flash-lite ?

Passez l'ID de modèle affiché dans le quickstart.

Les tarifs sont-ils à l'usage ?

Oui. Les tarifs sont mesurés par appel ou par unité.

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter