---
title: 'Gemini 2.5 Flash-Lite API: Modell-ID, 1M Kontext, OpenAI SDK | RunAPI'
description: gemini-2.5-flash-lite über die OpenAI-kompatible Chat Completions API von RunAPI aufrufen. 1M Tokens Kontext, 65K Output, Thinking standardmäßig aus, Texteingabe.
url: https://runapi.ai/de/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/de/models/gemini/2.5-flash-lite
locale: de
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1K-Token
status: active
---

> HTML version: https://runapi.ai/de/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite  API

Rufe gemini-2.5-flash-lite aus der Gemini-Familie über RunAPI auf. Abgerechnet wird pro Token, ohne Abo; eine Anfrage, die vor Beginn der Antwort fehlschlägt, wird nicht berechnet.

**Google / [Gemini](https://runapi.ai/de/models/gemini.md)**
**Betriebsbereit · text · Kommerzielle Nutzung unterstützt**

## Wofür Gemini 2.5 Flash-Lite gebaut ist

Gemini 2.5 Flash-Lite ist die Flash-Lite-Stufe der Gemini-2.5-Generation von Google, gedacht für Klassifikation und Extraktion in hohem Volumen und andere Aufgaben mit niedriger Latenz. Es ist seit dem 22. Juli 2025 allgemein verfügbar, mit Wissensstand Januar 2025. Das Kontextfenster umfasst 1.048.576 Tokens, die Ausgabe bis zu 65.536 Tokens.

Thinking ist standardmäßig ausgeschaltet; für schwierigere Prompts dokumentiert Google einen optionalen Thinking-Modus. Google unterstützt für das Modell Function Calling und strukturierte Ausgaben.

Googles Modell nimmt Text, Bilder, Video, Audio und PDF an. Bei RunAPI senden Sie Text über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions); RunAPI nimmt für dieses Modell nur Texteingabe an. Für neue Projekte empfiehlt Google Gemini 3.5 Flash-Lite, das RunAPI als gemini-3.5-flash-lite anbietet.

**Modell-ID:** gemini-2.5-flash-lite
**Veröffentlicht:** 22. Juli 2025 (allgemein verfügbar)
**Wissensstand:** Januar 2025
**Kontextfenster:** 1.048.576 Tokens
**Maximale Ausgabe:** 65.536 Tokens
**Thinking:** Optional, standardmäßig aus
**Endpunkt bei RunAPI:** OpenAI Chat Completions, Texteingabe



<!-- catalog-model-detail-slot: model-playground -->

## Gemini 2.5 Flash-Lite ausprobieren

Wähle ein Modell und generiere in Sekunden.


**Modell:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · Eingabe $0.10 / 1 Mio. Tokens | Ausgabe $0.40 / 1 Mio. Tokens

**Prompt:** Beschreibe, was du erstellen möchtest...

**Geschätzt:** Eingabe $0.10 / 1 Mio. Tokens | Ausgabe $0.40 / 1 Mio. Tokens

- [Generieren](https://runapi.ai/de/login)
Zum Generieren mit RunAPI einloggen.
<!-- /catalog-model-detail-slot: model-playground -->

### Variante wechseln

- [gemini-2.5-flash](https://runapi.ai/de/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/de/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/de/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/de/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/de/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/de/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/de/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/de/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/de/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/de/models/gemini/3.8-flash.md)

11 Versionen verfügbar





gemini-2.5-flash-lite ist eines der Gemini-Modelle auf RunAPI. Es nutzt denselben API Key wie jedes andere Modell, und du wechselst, indem du die Modell-ID in deiner Anfrage änderst. Jeder Aufruf ist synchron und wird in USD nach Eingabe-, Ausgabe- und Cache-Token abgerechnet, ohne Abo und ohne Mindestumsatz. Eine Anfrage, die vor Beginn der Antwort fehlschlägt, wird nicht berechnet; sobald die Antwort gestreamt wird, werden die bereits erzeugten Token berechnet, auch wenn der Client die Verbindung trennt.

- Abrechnung pro Token in USD ohne Abo
- Keine Berechnung, wenn eine Anfrage vor Beginn der Antwort fehlschlägt
- Streaming Token für Token
- Modellwechsel durch Ändern einer einzigen Modell-ID
- Ein API Key und eine Rechnung für alle Modelle und Anbieter

## Nutzungsmetriken

- **API-Aufrufe / Tag:** 6
- **Erfolgsrate:** 100.0%
- **Ø Generierungszeit:** 1.8s

Verifiziertes Kundenfeedback ist für dieses Modell noch nicht verfügbar.



## DATENBLATT

| Feld | Wert |
|---|---|
| Anbieter | Google |
| Modell-ID | gemini-2.5-flash-lite |
| Modalität | Text |
| Aufgabentypen | Synchronous |
| API-Endpunkt | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| Abrechnungseinheit | 1K-Token |
| Katalogstatus | Betriebsbereit |



**SO FUNKTIONIERT ES**

## Dieses Modell in 3 Schritten verwenden

1. **API-Schlüssel erstellen** - Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für gemini-2.5-flash-lite.
2. **Anfrage senden** - Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID gemini-2.5-flash-lite und deinen Parametern.
3. **Ergebnisse abrufen** - Lies die fertige gemini-2.5-flash-lite-Antwort direkt vom Endpoint.



<!-- catalog-model-detail-slot: feature-cards -->

## Was dieses Modell bietet

- **Endpoint-Abdeckung** — Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
- **Nutzungsbasierte Abrechnung** — Gemessen nach 1K-Token, ohne Abo-Anforderung.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite PREISE

| Endpunkt | Preis |
|---|---|
| `chat_completion` | Eingabe: $0.10 / 1 Mio. Tokens<br>Ausgabe: $0.40 / 1 Mio. Tokens<br>Cache-Lesen: $0.01 / 1 Mio. Tokens |



**API-REFERENZ**

## Endpunktspezifikation

| Field | Value |
|---|---|
| Endpunkt | `POST /v1/chat/completions` |
| Modell-ID | `gemini-2.5-flash-lite` |
| Aufgabentypen | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Anfrageparameter

Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."
    }
  ]
}
```

### Modell-Skill — gemini-2.5-flash-lite

Installiere den Skill einmal und verwende dann die Varianten-ID von dieser Seite beim Entwickeln.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Nutze das OpenAI / Anthropic / Google Gen AI-SDK mit deinem RunAPI API Key und `model: "gemini-2.5-flash-lite"`.

### gemini-2.5-flash-lite verwenden

1. **Installieren** — Installiere den Model Skill der Gemini-Linie. Er lädt Doku, Request-Formate und Preishinweise in deinen Coding-Workspace.
2. **Konfigurieren** — Richte dein SDK auf https://runapi.ai aus und setze deinen RunAPI API Key. Derselbe Key funktioniert bei allen Modellen und Anbietern.
3. **Aufrufen** — Sende eine Anfrage in einem API-Format, das dieses Modell unterstützt, und setze das Feld model auf die Modell-ID dieser Seite. RunAPI leitet sie an den Anbieter weiter.
4. **Empfangen** — Lies die Antwort aus demselben Aufruf oder streame sie, während sie erzeugt wird. Das Feld usage zeigt die Token, die dir berechnet werden.

### Vergleich von gemini-2.5-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions** — Geschwindigkeit/Kosten optimiert; 1M Kontext; ältere Generation als Baseline
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions** — Bestes Reasoning der 2.5-Generation; 1M Kontext
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions** — gemini-3-flash-preview

## ANWENDUNGSFÄLLE

**Chat**

Nutze LLMs für Chat und Reasoning.

**Code**

Generiere und prüfe Implementierungsarbeit.

**Automatisierung**

Verbinde Modelle mit Backend-Tasks.



## Häufige Fragen zu Gemini 2.5 Flash-Lite

### Soll ich Gemini 2.5 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?

Für neue Projekte empfiehlt Google Gemini 3.5 Flash-Lite oder Gemini 3.8 Flash. Wählen Sie gemini-2.5-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar.

### Kann ich Gemini 2.5 Flash-Lite noch verwenden?

Ja. Google hat kein Abschaltdatum angekündigt, beschränkt den Zugriff auf 2.5-Modelle in der eigenen API inzwischen aber auf Nutzer, die sie bereits verwendet haben. Bei RunAPI steht gemini-2.5-flash-lite jedem Konto zur Verfügung.

### Kann ich Gemini 2.5 Flash-Lite mit dem OpenAI SDK aufrufen?

Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-2.5-flash-lite. Tools nutzen das Standardformat von OpenAI.

### Denkt Gemini 2.5 Flash-Lite vor der Antwort nach?

Standardmäßig nicht. Google liefert es für hohes Volumen und niedrige Latenz mit ausgeschaltetem Thinking aus und dokumentiert einen optionalen Thinking-Modus.

### Wie wähle ich gemini-2.5-flash-lite aus?

Übergib die im Quickstart angezeigte Modell-ID.

### Sind die Preise nutzungsbasiert?

Ja. Preise werden pro Aufruf oder Einheit gemessen.


### VERWANDT

- [gemini-3.5-flash-lite](https://runapi.ai/de/models/gemini/3.5-flash-lite.md) — von Google · Eingabe $0.15 / 1 Mio. Tokens | Ausgabe $1.25 / 1 Mio. Tokens
- [gemini-3.1-flash-lite](https://runapi.ai/de/models/gemini/3.1-flash-lite.md) — von Google · Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $1.50 / 1 Mio. Tokens
- [gemini-2.5-flash](https://runapi.ai/de/models/gemini/2.5-flash.md) — von Google · Eingabe $0.30 / 1 Mio. Tokens | Ausgabe $2.50 / 1 Mio. Tokens
- [gemini-3-flash-preview](https://runapi.ai/de/models/gemini/3-flash-preview.md) — von Google · Eingabe $0.50 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens · Eingabe $0.30 / 1 Mio. Tokens | Ausgabe $1.80 / 1 Mio. Tokens

### Starte heute mit Gemini.

- [Kostenloses Konto erstellen](https://runapi.ai/de/login)
- [Quickstart lesen →](https://runapi.ai/de/docs/api/openai/chat-completions)
## Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

[Kontakt aufnehmen](https://runapi.ai/de/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/de/.md)
### Produkt
- [Modellkatalog](https://runapi.ai/de/models.md)
- [Preise](https://runapi.ai/de/pricing.md)
- [Anbieter](https://runapi.ai/de/models#all-models)
### Entwickler
- [Dokumentation](https://runapi.ai/de/docs/guides)
- [SDKs](https://runapi.ai/de/sdk.md)
- [CLI](https://runapi.ai/de/cli.md)
- [MCP Server](https://runapi.ai/de/mcp.md)
- [x402](https://runapi.ai/de/x402.md)
### Anleitungen
- [Claude Code vs Cursor](https://runapi.ai/de/claude-code-vs-cursor.md)
- [Cursor API-Einrichtung](https://runapi.ai/de/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/de/openrouter-alternative.md)
### Unternehmen
- [Enterprise](https://runapi.ai/de/contact.md)
- [Kontakt](https://runapi.ai/de/contact.md)
### Rechtliches
- [Bedingungen](https://runapi.ai/de/terms.md)
- [Datenschutz](https://runapi.ai/de/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/de",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/de/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/de",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/deicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/de"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/de/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/de/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/de/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "HowTo",
    "name": "gemini-2.5-flash-lite verwenden",
    "description": "gemini-2.5-flash-lite aus der Gemini-Familie über RunAPI aufrufen: Preis pro Token, Modell-ID, unterstützte API-Formate und Setup-Anleitung.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Installieren",
        "text": "Installiere den Model Skill der Gemini-Linie. Er lädt Doku, Request-Formate und Preishinweise in deinen Coding-Workspace.",
        "url": "https://runapi.ai/de/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Konfigurieren",
        "text": "Richte dein SDK auf https://runapi.ai aus und setze deinen RunAPI API Key. Derselbe Key funktioniert bei allen Modellen und Anbietern.",
        "url": "https://runapi.ai/de/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Aufrufen",
        "text": "Sende eine Anfrage in einem API-Format, das dieses Modell unterstützt, und setze das Feld model auf die Modell-ID dieser Seite. RunAPI leitet sie an den Anbieter weiter.",
        "url": "https://runapi.ai/de/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Empfangen",
        "text": "Lies die Antwort aus demselben Aufruf oder streame sie, während sie erzeugt wird. Das Feld usage zeigt die Token, die dir berechnet werden.",
        "url": "https://runapi.ai/de/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Soll ich Gemini 2.5 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Für neue Projekte empfiehlt Google Gemini 3.5 Flash-Lite oder Gemini 3.8 Flash. Wählen Sie gemini-2.5-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar."
        }
      },
      {
        "@type": "Question",
        "name": "Kann ich Gemini 2.5 Flash-Lite noch verwenden?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Ja. Google hat kein Abschaltdatum angekündigt, beschränkt den Zugriff auf 2.5-Modelle in der eigenen API inzwischen aber auf Nutzer, die sie bereits verwendet haben. Bei RunAPI steht gemini-2.5-flash-lite jedem Konto zur Verfügung."
        }
      },
      {
        "@type": "Question",
        "name": "Kann ich Gemini 2.5 Flash-Lite mit dem OpenAI SDK aufrufen?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-2.5-flash-lite. Tools nutzen das Standardformat von OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "Denkt Gemini 2.5 Flash-Lite vor der Antwort nach?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Standardmäßig nicht. Google liefert es für hohes Volumen und niedrige Latenz mit ausgeschaltetem Thinking aus und dokumentiert einen optionalen Thinking-Modus."
        }
      },
      {
        "@type": "Question",
        "name": "Wie wähle ich gemini-2.5-flash-lite aus?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Übergib die im Quickstart angezeigte Modell-ID."
        }
      },
      {
        "@type": "Question",
        "name": "Sind die Preise nutzungsbasiert?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Ja. Preise werden pro Aufruf oder Einheit gemessen."
        }
      }
    ]
  }
]
```
