---
title: 'API Gemini 2.5 Flash-Lite : ID, contexte 1M et SDK OpenAI | RunAPI'
description: Appelez gemini-2.5-flash-lite via l'API Chat Completions compatible OpenAI de RunAPI. Contexte 1M tokens, sortie 65K, thinking désactivé par défaut, entrée texte.
url: https://runapi.ai/fr/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/fr/models/gemini/2.5-flash-lite
locale: fr
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1 000 jetons
status: active
---

> HTML version: https://runapi.ai/fr/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite  API

Appelez gemini-2.5-flash-lite de la famille Gemini via RunAPI. La facturation se fait au token, sans abonnement, et une requête qui échoue avant le début de sa réponse n'est pas facturée.

**Google / [Gemini](https://runapi.ai/fr/models/gemini.md)**
**Opérationnel · text · Usage commercial pris en charge**

## À quoi sert Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite est le niveau Flash-Lite de la génération Gemini 2.5 de Google, conçu pour la classification et l'extraction à fort volume et les autres tâches à faible latence. Il est disponible pour tous depuis le 22 juillet 2025, avec une date limite des connaissances fixée à janvier 2025. La fenêtre de contexte atteint 1 048 576 tokens et la sortie jusqu'à 65 536 tokens.

Le thinking est désactivé par défaut, et Google documente un mode thinking optionnel pour les prompts plus difficiles. Google prend en charge l'appel de fonctions et les sorties structurées sur ce modèle.

Le modèle de Google accepte en entrée le texte, les images, la vidéo, l'audio et les PDF. Sur RunAPI, envoyez du texte via le point d'accès Chat Completions compatible OpenAI (/v1/chat/completions) ; RunAPI n'accepte que l'entrée texte pour ce modèle. Google recommande Gemini 3.5 Flash-Lite pour les nouveaux projets, que RunAPI propose sous l'ID gemini-3.5-flash-lite.

**ID du modèle:** gemini-2.5-flash-lite
**Date de sortie:** 22 juillet 2025 (disponibilité générale)
**Date limite des connaissances:** Janvier 2025
**Fenêtre de contexte:** 1 048 576 tokens
**Sortie maximale:** 65 536 tokens
**Thinking:** Optionnel, désactivé par défaut
**Point d'accès sur RunAPI:** OpenAI Chat Completions, entrée texte



<!-- catalog-model-detail-slot: model-playground -->

## Essayez Gemini 2.5 Flash-Lite

Choisissez un modèle et générez en quelques secondes.


**Modèle:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · Entrée $0.10 / 1M de tokens | Sortie $0.40 / 1M de tokens

**Prompt:** Décrivez ce que vous souhaitez créer...

**Estimé :** Entrée $0.10 / 1M de tokens | Sortie $0.40 / 1M de tokens

- [Générer](https://runapi.ai/fr/login)
Connectez-vous pour générer avec RunAPI.
<!-- /catalog-model-detail-slot: model-playground -->

### Changer de variante

- [gemini-2.5-flash](https://runapi.ai/fr/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/fr/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/fr/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/fr/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/fr/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/fr/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/fr/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/fr/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/fr/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/fr/models/gemini/3.8-flash.md)

11 versions disponibles





gemini-2.5-flash-lite est l'un des modèles Gemini disponibles sur RunAPI. Il utilise la même API key que tous les autres modèles, et vous basculez en changeant l'ID de modèle dans votre requête. Chaque appel est synchrone et facturé en USD selon les tokens d'entrée, de sortie et de cache, sans abonnement ni dépense minimale. Une requête qui échoue avant le début de la réponse n'est pas facturée ; une fois la réponse en streaming, les tokens déjà générés sont facturés, même si le client se déconnecte.

- Facturation au token en USD, sans abonnement
- Aucune facturation si une requête échoue avant sa réponse
- Streaming token par token
- Changement de modèle par un simple ID de modèle
- Une API key et une facture pour tous les modèles et fournisseurs

## Métriques d'utilisation

- **Appels API / Jour:** 6
- **Taux de succès:** 100.0%
- **Génération moyenne:** 1.8s

Les avis clients vérifiés ne sont pas encore disponibles pour ce modèle.



## FICHE TECHNIQUE

| Champ | Valeur |
|---|---|
| Fournisseur | Google |
| ID du modèle | gemini-2.5-flash-lite |
| Modalité | Texte |
| Types de tâche | Synchronous |
| Endpoint API | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| Unité de facturation | 1 000 jetons |
| État du catalogue | Opérationnel |



**COMMENT ÇA MARCHE**

## Utilisez ce modèle en 3 étapes

1. **Créez votre clé** - Inscrivez-vous gratuitement et créez une clé API pour gemini-2.5-flash-lite depuis le tableau de bord.
2. **Envoyez une requête** - Envoyez une requête POST à /v1/chat/completions avec l’identifiant du modèle gemini-2.5-flash-lite et vos paramètres.
3. **Obtenez les résultats** - Lisez directement la réponse gemini-2.5-flash-lite terminée depuis l’endpoint.



<!-- catalog-model-detail-slot: feature-cards -->

## Ce que ce modèle propose

- **Couverture des endpoints** — Expose 1 endpoint(s) public(s) : chat_completion.
- **Facturation à l'usage** — Mesuré par 1 000 jetons, sans abonnement requis.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite TARIFS

| Endpoint | Prix |
|---|---|
| `chat_completion` | Entrée: $0.10 / 1M de tokens<br>Sortie: $0.40 / 1M de tokens<br>Lecture du cache: $0.01 / 1M de tokens |



**RÉFÉRENCE API**

## Spécification de l'endpoint

| Field | Value |
|---|---|
| Endpoint | `POST /v1/chat/completions` |
| ID du modèle | `gemini-2.5-flash-lite` |
| Types de tâche | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Paramètres de requête

Aucun paramètre de requête n'est publié pour cet endpoint.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après."
    }
  ]
}
```

### Compétence de modèle — gemini-2.5-flash-lite

Installez la compétence une seule fois, puis utilisez l'identifiant de variant de cette page lors de votre développement.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Utilisez le SDK OpenAI / Anthropic / Google Gen AI avec votre API key RunAPI et `model: "gemini-2.5-flash-lite"`.

### Utiliser gemini-2.5-flash-lite

1. **Installer** — Installez le model skill de la gamme Gemini. Il charge documentation, formats de requête et notes tarifaires dans votre espace de développement.
2. **Configurer** — Pointez votre SDK vers https://runapi.ai et définissez votre API key RunAPI. La même clé fonctionne pour tous les modèles et fournisseurs.
3. **Appeler** — Envoyez une requête dans un format d'API pris en charge par ce modèle, avec le champ model réglé sur l'ID de modèle de cette page. RunAPI la transmet au fournisseur.
4. **Recevoir** — Lisez la réponse de ce même appel, ou recevez-la en streaming au fil de sa génération. Le champ usage indique les tokens facturés.

### Comparaison de gemini-2.5-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI** — Optimisé vitesse/coût ; contexte 1M ; référence de l'ancienne génération
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI** — Meilleur raisonnement de la génération 2.5 ; contexte 1M
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI** — gemini-3-flash-preview

## CAS D’USAGE

**Chat**

Utilisez les LLM pour le chat et le raisonnement.

**Code**

Générez et révisez le travail d'implémentation.

**Automatisation**

Connectez les modèles aux tâches backend.



## Questions fréquentes sur Gemini 2.5 Flash-Lite

### Faut-il utiliser Gemini 2.5 Flash-Lite ou Gemini 3.5 Flash-Lite ?

Google recommande Gemini 3.5 Flash-Lite ou Gemini 3.8 Flash pour les nouveaux travaux. Choisissez gemini-2.5-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API.

### Puis-je encore utiliser Gemini 2.5 Flash-Lite ?

Oui. Google n'a annoncé aucune date d'arrêt, même si sa propre API réserve désormais l'accès aux modèles 2.5 aux utilisateurs qui s'en servaient déjà. Sur RunAPI, gemini-2.5-flash-lite est disponible pour tous les comptes.

### Puis-je appeler Gemini 2.5 Flash-Lite avec le SDK OpenAI ?

Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-2.5-flash-lite. Les outils suivent le format standard d'OpenAI.

### Gemini 2.5 Flash-Lite réfléchit-il avant de répondre ?

Pas par défaut. Google le livre avec le thinking désactivé pour les usages à fort volume et faible latence, et documente un mode thinking optionnel.

### Comment sélectionner gemini-2.5-flash-lite ?

Passez l'ID de modèle affiché dans le quickstart.

### Les tarifs sont-ils à l'usage ?

Oui. Les tarifs sont mesurés par appel ou par unité.


### ASSOCIÉ

- [gemini-3.5-flash-lite](https://runapi.ai/fr/models/gemini/3.5-flash-lite.md) — par Google · Entrée $0.15 / 1M de tokens | Sortie $1.25 / 1M de tokens
- [gemini-3.1-flash-lite](https://runapi.ai/fr/models/gemini/3.1-flash-lite.md) — par Google · Entrée $0.25 / 1M de tokens | Sortie $1.50 / 1M de tokens
- [gemini-2.5-flash](https://runapi.ai/fr/models/gemini/2.5-flash.md) — par Google · Entrée $0.30 / 1M de tokens | Sortie $2.50 / 1M de tokens
- [gemini-3-flash-preview](https://runapi.ai/fr/models/gemini/3-flash-preview.md) — par Google · Entrée $0.50 / 1M de tokens | Sortie $3.00 / 1M de tokens · Entrée $0.30 / 1M de tokens | Sortie $1.80 / 1M de tokens

### Commencez avec Gemini aujourd'hui.

- [Créer un compte gratuit](https://runapi.ai/fr/login)
- [Lire le quickstart →](https://runapi.ai/fr/docs/api/openai/chat-completions)
## Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

[Nous contacter](https://runapi.ai/fr/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/fr/.md)
### Produit
- [Catalogue de modèles](https://runapi.ai/fr/models.md)
- [Tarifs](https://runapi.ai/fr/pricing.md)
- [Fournisseurs](https://runapi.ai/fr/models#all-models)
### Développeurs
- [Documentation](https://runapi.ai/fr/docs/guides)
- [SDK](https://runapi.ai/fr/sdk.md)
- [CLI](https://runapi.ai/fr/cli.md)
- [Serveur MCP](https://runapi.ai/fr/mcp.md)
- [x402](https://runapi.ai/fr/x402.md)
### Guides
- [Claude Code vs Cursor](https://runapi.ai/fr/claude-code-vs-cursor.md)
- [Configuration de l’API Cursor](https://runapi.ai/fr/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/fr/openrouter-alternative.md)
### Entreprise
- [Entreprise](https://runapi.ai/fr/contact.md)
- [Contact](https://runapi.ai/fr/contact.md)
### Légal
- [Conditions](https://runapi.ai/fr/terms.md)
- [Confidentialité](https://runapi.ai/fr/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/fr",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/fr/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/fr",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/fricon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/fr"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/fr/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/fr/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/fr/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "HowTo",
    "name": "Utiliser gemini-2.5-flash-lite",
    "description": "Appelez gemini-2.5-flash-lite de la famille Gemini via RunAPI : tarification au token, ID de modèle, formats d'API pris en charge et guide de démarrage.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Installer",
        "text": "Installez le model skill de la gamme Gemini. Il charge documentation, formats de requête et notes tarifaires dans votre espace de développement.",
        "url": "https://runapi.ai/fr/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Configurer",
        "text": "Pointez votre SDK vers https://runapi.ai et définissez votre API key RunAPI. La même clé fonctionne pour tous les modèles et fournisseurs.",
        "url": "https://runapi.ai/fr/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Appeler",
        "text": "Envoyez une requête dans un format d'API pris en charge par ce modèle, avec le champ model réglé sur l'ID de modèle de cette page. RunAPI la transmet au fournisseur.",
        "url": "https://runapi.ai/fr/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Recevoir",
        "text": "Lisez la réponse de ce même appel, ou recevez-la en streaming au fil de sa génération. Le champ usage indique les tokens facturés.",
        "url": "https://runapi.ai/fr/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "fr",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Faut-il utiliser Gemini 2.5 Flash-Lite ou Gemini 3.5 Flash-Lite ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google recommande Gemini 3.5 Flash-Lite ou Gemini 3.8 Flash pour les nouveaux travaux. Choisissez gemini-2.5-flash-lite quand une charge existante, un jeu de prompts ou une évaluation a été construit dessus. Les deux modèles sont disponibles sur RunAPI avec la même clé API."
        }
      },
      {
        "@type": "Question",
        "name": "Puis-je encore utiliser Gemini 2.5 Flash-Lite ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Oui. Google n'a annoncé aucune date d'arrêt, même si sa propre API réserve désormais l'accès aux modèles 2.5 aux utilisateurs qui s'en servaient déjà. Sur RunAPI, gemini-2.5-flash-lite est disponible pour tous les comptes."
        }
      },
      {
        "@type": "Question",
        "name": "Puis-je appeler Gemini 2.5 Flash-Lite avec le SDK OpenAI ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Oui. Configurez le SDK OpenAI sur https://runapi.ai/v1 avec votre clé API RunAPI et envoyez des requêtes Chat Completions avec model défini sur gemini-2.5-flash-lite. Les outils suivent le format standard d'OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite réfléchit-il avant de répondre ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Pas par défaut. Google le livre avec le thinking désactivé pour les usages à fort volume et faible latence, et documente un mode thinking optionnel."
        }
      },
      {
        "@type": "Question",
        "name": "Comment sélectionner gemini-2.5-flash-lite ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Passez l'ID de modèle affiché dans le quickstart."
        }
      },
      {
        "@type": "Question",
        "name": "Les tarifs sont-ils à l'usage ?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Oui. Les tarifs sont mesurés par appel ou par unité."
        }
      }
    ]
  }
]
```
