---
title: "Gemini API — varianten, prijzen en modelskill"
url: "https://runapi.ai/nl/models/gemini.md"
canonical: "https://runapi.ai/nl/models/gemini.md"
locale: "nl"
model: "Gemini"
provider: "Google"
modality: "text"
variant_count: 5
price_from_cents: 2
---

# Gemini API

Google&#39;s multimodal LLM for chat, code generation, reasoning, and long-context tasks.

**Provider:** Google
**Modality:** Text
**Catalog:** 5 variants

Gemini is Google&#39;s multimodal large language model family supporting text, image, audio, and code understanding. Available in Flash and Pro variants, it handles tasks from quick summarization to deep reasoning and complex coding.

## Variants

| Version | Variant | Pricing | Billing | URL |
|---|---|---|---|---|
| gemini-2.5-flash | `2.5-flash` | $0.020 | 1K tokens | https://runapi.ai/nl/models/gemini/2.5-flash.md |
| gemini-2.5-pro | `2.5-pro` | $0.080 | 1K tokens | https://runapi.ai/nl/models/gemini/2.5-pro.md |
| gemini-3-flash-preview | `3-flash-preview` | $0.020 | 1K tokens | https://runapi.ai/nl/models/gemini/3-flash-preview.md |
| gemini-3.1-pro-preview | `3.1-pro-preview` | $0.090 | 1K tokens | https://runapi.ai/nl/models/gemini/3.1-pro-preview.md |
| gemini-3.5-flash | `3.5-flash` | $0.050 | 1K tokens | https://runapi.ai/nl/models/gemini/3.5-flash.md |


## API endpoints

Base URL: `https://runapi.ai`

- `POST /v1/chat/completions`
- `POST /v1/responses`
- `POST /v1/messages`
- `POST /v1beta/models/{model}:generateContent`
- `POST /v1beta/models/{model}:streamGenerateContent`

Use the OpenAI or Anthropic SDK with your RunAPI API key. No extra SDK required.

## Context

Gemini is Google&#39;s flagship multimodal LLM, available in Flash (fast) and Pro (frontier reasoning) variants. Through RunAPI, all Gemini models share the same API shape and billing.

## FAQ

### Met welke variant moet ik beginnen?

Kies de goedkoopste variant die aan je kwaliteitsnorm voldoet. De meeste teams beginnen met de snelle variant en stappen over op pro voor productie.

### Is er een gratis tier?

Nieuwe accounts krijgen de eerste calls gratis op elk model. Daarna betaal je per call.

### Streamen jullie resultaten?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

### Hoe worden mislukkingen gefactureerd?

Mislukte generations worden niet in rekening gebracht.

### Worden outputs gecachet?

Gegenereerde outputs worden opgeslagen en zijn op te vragen via task-ID. Inputs worden niet gecachet.

### Mag ik het commercieel gebruiken?

Ja — commercieel gebruik is inbegrepen voor elke variant, tenzij een modellicentie het expliciet beperkt. Dat staat aangegeven op de variantpagina.

### Hoe zit het met rate limits?

Rate limits per key schalen mee met je usage tier. Zie de prijzenpagina voor de actuele limieten.

### Waar kan ik problemen melden?

Open een issue in de publieke GitHub-repo of mail support.

