Dagelijks verzoekslimiet
Tot 500 aanvragen per dag op Gemini 2.5 Flash via de gratis laag. Genoeg voor prototypes en sideprojects met laag volume, maar AI-agenten en codeertools kunnen dit binnen een paar uur opgebruiken.
Google rekent $1.25–$10 per miljoen tokens voor Gemini 2.5 Pro en veel minder voor Flash. De gratis laag geeft je ongeveer 20 aanvragen per minuut voordat je de limiet bereikt. RunAPI spiegelt elk Gemini-model voor de helft van het officiële tarief — plak je sleutel rechtstreeks in elke OpenAI-compatibele client.
Google publiceert prijzen per token voor twee hoofdniveaus: Flash voor snelle, goedkope taken en Pro voor maximale capaciteit. Er is ook een gratis laag met dagelijkse aanvraaglimieten — handig om te testen, maar AI-agenten en codeertools kunnen er snel doorheen branden. Alle prijzen hieronder zijn per miljoen tokens, de factureringseenheid die Google gebruikt.
Gemini 2.5 Flash voor $0,08/M invoer en $0,30/M uitvoer via RunAPI. Officieel tarief is $0,15/$0,60.
Gemini 2.5 Pro voor $0,63/M invoer en $5,00/M uitvoer via RunAPI. Officieel tarief is $1,25/$10.
De gratis laag van Google geeft je ongeveer 20 aanvragen per minuut en 500 aanvragen per dag op Flash — genoeg voor prototypes, maar je kunt dit binnen een paar uur opgebruiken met een AI-agent.
Gemini 2.5 Pro ondersnijdt Claude Sonnet en GPT-5.4 op invoerprijs, waardoor het het goedkoopste vlaggenschip van de grote drie is.
De onderstaande tabel toont de officiële Google-prijzen naast de RunAPI-prijzen. RunAPI past een vlakke korting van 50% toe op alle Gemini-modellen. Geen volumeverplichtingen, geen abonnementen.
| Model | Officiële invoer /M | Officiële uitvoer /M | RunAPI-invoer /M | RunAPI-uitvoer /M | Contextvenster |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1,25 | $10,00 | $0,63 | $5,00 | 1M |
| Gemini 2.5 Flash | $0,15 | $0,60 | $0,08 | $0,30 | 1M |
| Gemini 2.5 Flash-Lite | $0,10 | $0,40 | $0,05 | $0,20 | 1M |
Google biedt een gratis laag zodat je een prototype kunt maken voordat je betaalt. De gratis laag beperkt aanvragen tot ongeveer 20 per minuut en 500 per dag op Gemini 2.5 Flash. Wanneer je de limiet bereikt, krijg je een foutmelding — je wordt niet automatisch gefactureerd. De gratis laag is alleen beschikbaar in bepaalde landen; als het gratis eindpunt niet beschikbaar is in jouw regio, is de betaalde API of RunAPI de volgende stap.
Tot 500 aanvragen per dag op Gemini 2.5 Flash via de gratis laag. Genoeg voor prototypes en sideprojects met laag volume, maar AI-agenten en codeertools kunnen dit binnen een paar uur opgebruiken.
De gratis laag beperkt aanvragen tot ongeveer 20 per minuut. Piekverkeer — zoals het draaien van een AI-agent — bereikt deze limiet snel en begint fouten terug te geven.
Gratis-laag-invoer kan worden gebruikt om Google's producten te verbeteren. Betaald-laag- en RunAPI-verkeer wordt niet gebruikt voor training, wat relevant is voor gevoelige gegevens.
Ga over op betaald of RunAPI zodra u constante doorvoer, hogere snelheidslimieten of sterkere gegevensverwerking nodig heeft. RunAPI rekent 50% van het officiële betaalde tarief zonder dagelijks limiet.
Ontwikkelaars vergelijken Gemini vaak met Claude Sonnet en GPT-5.4. Hier is hoe de vlaggenschipmodellen zich verhouden op basis van per-miljoen-tokens via RunAPI.
| Aanbieder | Vlaggenschipmodel | Invoer /M | Uitvoer /M | RunAPI-tarief |
|---|---|---|---|---|
| Gemini 2.5 Pro | $1,25 | $10,00 | $0,63 / $5,00 | |
| OpenAI | GPT-5.4 | $2,50 | $15,00 | $1,25 / $7,50 |
| Anthropic | Claude Sonnet 4.6 | $6,00 | $30,00 | $3,00 / $15,00 |
RunAPI past 50% korting toe op alle bovenstaande aanbieders. Gemini 2.5 Pro is het goedkoopste vlaggenschip op invoerprijs. Prijzen geverifieerd juni 2026.
Tokenkosten lijken abstract totdat u ze aan echte taken koppelt. Hieronder vindt u vijf veelgebruikte ontwikkelaarswerklasten met geschatte maandelijkse kosten op twee gebruiksniveaus via RunAPI.
| Werklast | Model | Licht gebruik (~50 taken/dag) | Intensief gebruik (~200 taken/dag) | Maandelijkse besparing vs officieel |
|---|---|---|---|---|
| Documentanalyse met lange context | Gemini 2.5 Pro | $18/mnd | $72/mnd | $18–$72 |
| Classificatie op hoog volume | Gemini 2.5 Flash | $3/mnd | $12/mnd | $3–$12 |
| RAG-aangedreven documentenchatbot | Gemini 2.5 Flash | $5/mnd | $20/mnd | $5–$20 |
| Contentgeneratiepipeline | Gemini 2.5 Pro | $15/mnd | $60/mnd | $15–$60 |
| Multi-agent orkestrator | Gemini 2.5 Pro | $60/mnd | $240/mnd | $60–$240 |
Meld u aan op runapi.ai. Geen creditcard vereist voor de gratis laag.
Ga naar Dashboard → API-sleutels. Maak een sleutel aan en sla deze op — u gebruikt deze als uw OpenAI API-sleutel.
Stel de basis-URL in op https://runapi.ai/v1 en gebruik uw RunAPI API-sleutel. Elke OpenAI-compatibele client werkt — Python, Node.js, Go, Ruby of curl.
Gebruik gemini-2.5-pro, gemini-2.5-flash of een ander Gemini-model-ID in de modelparameter. RunAPI verzorgt de routering en facturering tegen 50% van het officiële tarief.
De officiële Google-prijs voor Gemini 2.5 Pro is $1,25/M invoer en $10/M uitvoer. Gemini 2.5 Flash kost $0,15/M invoer en $0,60/M uitvoer. Via RunAPI is elk Gemini-model de helft van dat tarief, zonder abonnement of volumeverplichting. U betaalt alleen voor de tokens die elk verzoek gebruikt.
Op invoerprijs wel. Gemini 2.5 Pro voor $1,25/M invoer ondersnijdt GPT-5.4 ($2,50) en Claude Sonnet ($6) op het officiële tarief, waardoor het het goedkoopste vlaggenschip van de grote drie is. RunAPI halveert alle drie, zodat het verschil behouden blijft.
De gratis tier begrenst je op ongeveer 20 verzoeken per minuut en 500 verzoeken per dag op Gemini 2.5 Flash. Wanneer je de limiet raakt, geven verzoeken een fout terug — je wordt niet automatisch gefactureerd. Invoer in de gratis tier kan worden gebruikt om Google's producten te verbeteren, dus vermijd gevoelige data. Zodra je constante doorvoer nodig hebt, stap je over naar betaald.
RunAPI onderhandelt over volumeprijzen met modelleveranciers en geeft de besparingen door aan ontwikkelaars. Er is geen kwaliteitsverschil — dezelfde modellen, dezelfde OpenAI-compatibele API, dezelfde uitvoer. U verandert alleen de basis-URL en sleutel, en uw bestaande clientcode blijft ongewijzigd werken.
Ja. RunAPI is OpenAI-compatibel. Wijs elke OpenAI-client naar runapi.ai/v1 en gebruik Gemini-model-ID's zoals gemini-2.5-pro. Bestaande OpenAI SDK-code werkt zonder wijzigingen buiten de basis-URL en sleutel.
Gemini 2.5 Pro en Flash bieden beide een contextvenster van 1M tokens, groter dan de meeste Claude- en GPT-modellen. In combinatie met lage invoerprijzen maakt dit Gemini kosteneffectief voor het analyseren van lange documenten, grote codebases of meerdere bestanden tegelijk.
RunAPI geeft je één API-sleutel die werkt met Gemini, Claude en GPT — geen Google Cloud-projectinstelling, geen factureringsaccount om te beheren. Als je tegen de limieten van de gratis laag bent aangelopen of hebt gemerkt dat geen enkele gratis API-sleutel in jouw regio werkt, is betaalde toegang van RunAPI wereldwijd beschikbaar tegen 50% van de officiële tarieven.
Betalen per gebruik. U vult uw account op met een saldo en elke API-aanroep trekt de tokenkosten af tegen de helft van het officiële tarief. Geen abonnementen, geen facturen, geen contracten. U kunt de uitgaven per sleutel volgen via het RunAPI-dashboard en meldingen instellen voordat het saldo laag wordt.
Claude Opus, Sonnet en Haiku voor 50% van de officiële Anthropic-tarieven.
GPT-5.4, GPT-5.4-mini en o3: RunAPI- vs. officiële tarieven.
Windsurf-kosten: eigen credits vs. API-facturering.
Bekijk 220+ modellen met prijzen, parameters en codevoorbeelden.
Maak een gratis RunAPI-account aan, haal uw API-sleutel op en begin Gemini 2.5 Pro of Flash aan te roepen met 50% korting op de officiële Google-prijzen — het goedkoopste vlaggenschip van de grote drie.