# Tarification API Gemini en 2026

Google facture $1.25–$10 par million de tokens pour Gemini 2.5 Pro et beaucoup moins pour Flash. L’offre gratuite vous donne environ 20 requêtes par minute avant d’atteindre la limite. RunAPI réplique chaque modèle Gemini à la moitié du tarif officiel — collez votre clé directement dans n’importe quel client compatible OpenAI.

*Updated June 18, 2026 · RunAPI Editorial*

## Quel est le coût actuel de l&#39;API Gemini ?

Google publie des prix par token pour deux niveaux principaux : Flash pour les tâches rapides et économiques, et Pro pour une capacité maximale. Il existe aussi une offre gratuite avec des limites de requêtes quotidiennes — utile pour les tests, mais les agents IA et les outils de codage peuvent l’épuiser rapidement. Tous les prix ci-dessous sont par million de tokens, l’unité de facturation utilisée par Google.

- **Option la moins chère**: Gemini 2.5 Flash à $0,08/M en entrée et $0,30/M en sortie via RunAPI. Tarif officiel : $0,15/$0,60.
- **Capacité maximale**: Gemini 2.5 Pro à $0,63/M en entrée et $5,00/M en sortie via RunAPI. Tarif officiel : $1,25/$10.
- **Niveau gratuit**: L’offre gratuite de Google vous donne environ 20 requêtes par minute et 500 requêtes par jour sur Flash — suffisant pour le prototypage, mais vous pouvez l’épuiser en quelques heures avec un agent IA.
- **Flagship le moins cher**: Gemini 2.5 Pro est moins cher que Claude Sonnet et GPT-5.4 sur le prix d&#39;entrée, ce qui en fait le flagship le moins cher des trois grands.

## Combien coûte chaque modèle Gemini par million de tokens ?

Le tableau ci-dessous présente la tarification officielle de Google ainsi que la tarification RunAPI. RunAPI applique une remise forfaitaire de 50 % sur tous les modèles Gemini. Sans engagement de volume, sans abonnement.

| Modèle | Entrée officielle /M | Sortie officielle /M | Entrée RunAPI /M | Sortie RunAPI /M | Fenêtre de contexte |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |

## Comment fonctionne le niveau gratuit Gemini de Google ?

Google propose une offre gratuite afin que vous puissiez prototyper avant de payer. L’offre gratuite limite les requêtes à environ 20 par minute et 500 par jour sur Gemini 2.5 Flash. Lorsque vous atteignez la limite, vous recevez une erreur — vous n’êtes pas facturé automatiquement. L’offre gratuite n’est disponible que dans certains pays ; si le point de terminaison gratuit n’est pas disponible dans votre région, l’API payante ou RunAPI est l’étape suivante.

### Limite de requêtes quotidienne

Jusqu’à 500 requêtes par jour sur Gemini 2.5 Flash via l’offre gratuite. Suffisant pour le prototypage et les projets annexes à faible volume, mais les agents IA et les outils de codage peuvent épuiser ce quota en quelques heures.

### Limites de débit

L’offre gratuite limite les requêtes à environ 20 par minute. Tout pic de trafic — comme l’exécution d’un agent IA — atteindra rapidement cette limite et commencera à renvoyer des erreurs.

### Conditions d&#39;utilisation des données

Les entrées du niveau gratuit peuvent être utilisées pour améliorer les produits de Google. Le trafic du niveau payant et RunAPI n&#39;est pas utilisé pour l&#39;entraînement, ce qui importe pour les données sensibles.

### Quand passer au niveau supérieur

Passez au niveau payant ou RunAPI dès que vous avez besoin d&#39;un débit régulier, de limites de débit plus élevées ou d&#39;une meilleure gestion des données. RunAPI facture 50 % du tarif payant officiel sans limite quotidienne.


## Gemini est-il moins cher que Claude et GPT ?

Les développeurs comparent souvent Gemini à Claude Sonnet et GPT-5.4. Voici comment les modèles phares se comparent sur la base du coût par million de tokens via RunAPI.

| Fournisseur | Modèle phare | Entrée /M | Sortie /M | Tarif RunAPI |
|---|---|---|---|---|
| Google | Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |

## Quel est le vrai coût de l&#39;API Gemini pour des charges de travail réelles ?

Les coûts en tokens semblent abstraits tant qu&#39;on ne les rattache pas à des tâches concrètes. Voici cinq charges de travail courantes pour les développeurs avec des coûts mensuels estimés à deux niveaux d&#39;utilisation via RunAPI.

| Charge de travail | Modèle | Utilisation légère (~50 tâches/jour) | Utilisation intensive (~200 tâches/jour) | Économie mensuelle vs officiel |
|---|---|---|---|---|
| Analyse de documents à long contexte | Gemini 2.5 Pro | $18/mois | $72/mois | $18–$72 |
| Classification à fort volume | Gemini 2.5 Flash | $3/mois | $12/mois | $3–$12 |
| Chatbot de documentation RAG | Gemini 2.5 Flash | $5/mois | $20/mois | $5–$20 |
| Pipeline de génération de contenu | Gemini 2.5 Pro | $15/mois | $60/mois | $15–$60 |
| Orchestrateur multi-agents | Gemini 2.5 Pro | $60/mois | $240/mois | $60–$240 |

## Comment utiliser l&#39;API Gemini via RunAPI

1. **Créer un compte RunAPI** — Inscrivez-vous sur runapi.ai. Aucune carte de crédit requise pour le niveau gratuit.
2. **Copier votre clé API** — Accédez à Tableau de bord → Clés API. Créez une clé et sauvegardez-la — vous l&#39;utiliserez comme votre clé API OpenAI.
3. **Pointer votre SDK vers RunAPI** — Définissez l&#39;URL de base sur https://runapi.ai/v1 et utilisez votre clé API RunAPI. Tout client compatible OpenAI fonctionne — Python, Node.js, Go, Ruby ou curl.
4. **Commencer à faire des requêtes** — Utilisez gemini-2.5-pro, gemini-2.5-flash ou n&#39;importe quel identifiant de modèle Gemini dans le paramètre model. RunAPI gère le routage et la facturation à 50 % du tarif officiel.

## FAQ Tarification API Gemini

### Combien coûte l&#39;API Gemini ?

La tarification officielle de Google pour Gemini 2.5 Pro est de $1,25/M en entrée et $10/M en sortie. Gemini 2.5 Flash est à $0,15/M en entrée et $0,60/M en sortie. Via RunAPI, chaque modèle Gemini est à la moitié de ce tarif, sans abonnement ni engagement de volume. Vous ne payez que les tokens utilisés par chaque requête.

### Gemini est-il moins cher que Claude et GPT ?

Sur le prix d&#39;entrée, oui. Gemini 2.5 Pro à $1,25/M en entrée est moins cher que GPT-5.4 ($2,50) et Claude Sonnet ($6) au tarif officiel, ce qui en fait le flagship le moins cher des trois grands. RunAPI réduit les trois de moitié, donc l&#39;écart se maintient.

### What are the rate limits on the free tier, and what happens when I hit them?

The free tier caps you at around 20 requests per minute and 500 requests per day on Gemini 2.5 Flash. When you hit the limit, requests return an error — you are not billed automatically. Free-tier inputs may be used to improve Google&#39;s products, so avoid sensitive data. Once you need steady throughput, move to paid.

### Pourquoi RunAPI est-il 50 % moins cher que l&#39;API officielle ?

RunAPI négocie des tarifs de volume avec les fournisseurs de modèles et répercute les économies sur les développeurs. Il n&#39;y a aucune différence de qualité — mêmes modèles, même API compatible OpenAI, même résultat. Il suffit de changer l&#39;URL de base et la clé, et votre code client existant continue de fonctionner sans modification.

### Puis-je utiliser Gemini avec le SDK OpenAI ?

Oui. RunAPI est compatible OpenAI. Pointez n&#39;importe quel client OpenAI vers runapi.ai/v1 et utilisez des identifiants de modèles Gemini comme gemini-2.5-pro. Le code SDK OpenAI existant fonctionne sans modification au-delà de l&#39;URL de base et de la clé.

### Pourquoi Gemini est-il bon pour les tâches à long contexte ?

Gemini 2.5 Pro et Flash offrent tous deux une fenêtre de contexte de 1M tokens, plus grande que la plupart des modèles Claude et GPT. Combiné à un faible prix d&#39;entrée, cela rend Gemini rentable pour analyser de longs documents, de grandes bases de code ou de nombreux fichiers à la fois.

### J’atteins sans cesse les limites de l’offre gratuite. Quelles sont mes options ?

RunAPI vous donne une seule clé API qui fonctionne avec Gemini, Claude et GPT — pas de configuration de projet Google Cloud, pas de compte de facturation à gérer. Si vous avez atteint les limites de l’offre gratuite ou constaté qu’aucune clé API gratuite ne fonctionne dans votre région, l’accès payant de RunAPI est disponible dans le monde entier à 50% des tarifs officiels.

### Comment fonctionne la facturation ?

Paiement à l&#39;usage. Vous alimentez votre compte avec un solde, et chaque appel API déduit le coût en tokens à la moitié du tarif officiel. Sans abonnement, sans factures, sans contrats. Vous pouvez surveiller les dépenses par clé depuis le tableau de bord RunAPI et configurer des alertes avant que le solde ne soit épuisé.

