---
title: 'Gemini 3.1 Flash-Lite API: Modell-ID, 1M Kontext, OpenAI SDK | RunAPI'
description: gemini-3.1-flash-lite über die OpenAI-kompatible Chat Completions API von RunAPI aufrufen. 1M Tokens Kontext, 65K Output, einstellbares Thinking, Texteingabe.
url: https://runapi.ai/de/models/gemini/3.1-flash-lite.md
canonical: https://runapi.ai/de/models/gemini/3.1-flash-lite
locale: de
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/3.1-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
  es: https://runapi.ai/es/models/gemini/3.1-flash-lite
  ja: https://runapi.ai/ja/models/gemini/3.1-flash-lite
  de: https://runapi.ai/de/models/gemini/3.1-flash-lite
  fr: https://runapi.ai/fr/models/gemini/3.1-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite
  ko: https://runapi.ai/ko/models/gemini/3.1-flash-lite
  it: https://runapi.ai/it/models/gemini/3.1-flash-lite
  nl: https://runapi.ai/nl/models/gemini/3.1-flash-lite
  pl: https://runapi.ai/pl/models/gemini/3.1-flash-lite
  tr: https://runapi.ai/tr/models/gemini/3.1-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/3.1-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/3.1-flash-lite
  ar: https://runapi.ai/ar/models/gemini/3.1-flash-lite
  x-default: https://runapi.ai/models/gemini/3.1-flash-lite
model: Gemini
provider: Google
variant_id: gemini-3.1-flash-lite
sdk_model_id: gemini-3.1-flash-lite
modality: text
billing_unit: 1K-Token
status: active
---

> HTML version: https://runapi.ai/de/models/gemini/3.1-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-3.1-flash-lite  API

Rufe gemini-3.1-flash-lite aus der Gemini-Familie über RunAPI auf. Abgerechnet wird pro Token, ohne Abo; eine Anfrage, die vor Beginn der Antwort fehlschlägt, wird nicht berechnet.

**Google / [Gemini](https://runapi.ai/de/models/gemini.md)**
**Betriebsbereit · text · Kommerzielle Nutzung unterstützt**

## Wofür Gemini 3.1 Flash-Lite gebaut ist

Gemini 3.1 Flash-Lite ist das latenzarme, kostengünstige Modell der Gemini-3-Reihe von Google. Google entwickelt es für einfache Aufgaben in hohem Volumen, etwa Übersetzung, Klassifikation und Entitätsextraktion, Dokumenten-Triage sowie das Weiterleiten von Anfragen zwischen Modellen. Das stabile gemini-3.1-flash-lite ist seit dem 7. Mai 2026 allgemein verfügbar. Das Kontextfenster umfasst 1.048.576 Tokens, die Ausgabe bis zu 65.536 Tokens.

Thinking ist einstellbar: Google bietet vier Thinking-Stufen von minimal bis hoch und zählt Thinking-Tokens zur Ausgabe. Google unterstützt für das Modell Function Calling und strukturierte Ausgaben.

Googles Modell nimmt Text, Bilder, Video, Audio und PDF an. Bei RunAPI nimmt gemini-3.1-flash-lite nur Texteingabe an. Senden Sie Anfragen über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions), OpenAI Responses, Anthropic Messages oder Gemini generateContent. Google nennt Gemini 3.5 Flash-Lite als Nachfolger; RunAPI führt es als gemini-3.5-flash-lite.

**Modell-ID:** gemini-3.1-flash-lite
**Veröffentlicht:** 7. Mai 2026 (allgemein verfügbar)
**Kontextfenster:** 1.048.576 Tokens
**Maximale Ausgabe:** 65.536 Tokens
**Thinking:** Einstellbar, von minimal bis hoch
**Frühestes Abschaltdatum (Google):** 7. Mai 2027
**Endpunkt bei RunAPI:** OpenAI Chat Completions, Texteingabe



<!-- catalog-model-detail-slot: model-playground -->

## Gemini 3.1 Flash-Lite ausprobieren

Wähle ein Modell und generiere in Sekunden.


**Modell:**
- **Chat completion** — `chat_completion` · `gemini-3.1-flash-lite` · Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $1.50 / 1 Mio. Tokens

**Prompt:** Beschreibe, was du erstellen möchtest...

**Geschätzt:** Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $1.50 / 1 Mio. Tokens

- [Generieren](https://runapi.ai/de/login)
Zum Generieren mit RunAPI einloggen.
<!-- /catalog-model-detail-slot: model-playground -->

### Variante wechseln

- [gemini-2.5-flash](https://runapi.ai/de/models/gemini/2.5-flash.md)
- [gemini-2.5-flash-lite](https://runapi.ai/de/models/gemini/2.5-flash-lite.md)
- [gemini-2.5-pro](https://runapi.ai/de/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/de/models/gemini/3-flash-preview.md)
- **gemini-3.1-flash-lite** (current)
- [gemini-3.1-pro-preview](https://runapi.ai/de/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/de/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/de/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/de/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/de/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/de/models/gemini/3.8-flash.md)

11 Versionen verfügbar





gemini-3.1-flash-lite ist eines der Gemini-Modelle auf RunAPI. Es nutzt denselben API Key wie jedes andere Modell, und du wechselst, indem du die Modell-ID in deiner Anfrage änderst. Jeder Aufruf ist synchron und wird in USD nach Eingabe-, Ausgabe- und Cache-Token abgerechnet, ohne Abo und ohne Mindestumsatz. Eine Anfrage, die vor Beginn der Antwort fehlschlägt, wird nicht berechnet; sobald die Antwort gestreamt wird, werden die bereits erzeugten Token berechnet, auch wenn der Client die Verbindung trennt.

- Abrechnung pro Token in USD ohne Abo
- Keine Berechnung, wenn eine Anfrage vor Beginn der Antwort fehlschlägt
- Streaming Token für Token
- Modellwechsel durch Ändern einer einzigen Modell-ID
- Ein API Key und eine Rechnung für alle Modelle und Anbieter

## Nutzungsmetriken

- **API-Aufrufe / Tag:** 6
- **Erfolgsrate:** 100.0%
- **Ø Generierungszeit:** 1.9s

Verifiziertes Kundenfeedback ist für dieses Modell noch nicht verfügbar.



## DATENBLATT

| Feld | Wert |
|---|---|
| Anbieter | Google |
| Modell-ID | gemini-3.1-flash-lite |
| Modalität | Text |
| Aufgabentypen | Synchronous |
| API-Endpunkt | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-3.1-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` |
| Abrechnungseinheit | 1K-Token |
| Katalogstatus | Betriebsbereit |



**SO FUNKTIONIERT ES**

## Dieses Modell in 3 Schritten verwenden

1. **API-Schlüssel erstellen** - Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für gemini-3.1-flash-lite.
2. **Anfrage senden** - Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID gemini-3.1-flash-lite und deinen Parametern.
3. **Ergebnisse abrufen** - Lies die fertige gemini-3.1-flash-lite-Antwort direkt vom Endpoint.



<!-- catalog-model-detail-slot: feature-cards -->

## Was dieses Modell bietet

- **Endpoint-Abdeckung** — Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
- **Nutzungsbasierte Abrechnung** — Gemessen nach 1K-Token, ohne Abo-Anforderung.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 3.1 Flash-Lite PREISE

| Endpunkt | Preis |
|---|---|
| `chat_completion` | Eingabe: $0.25 / 1 Mio. Tokens<br>Ausgabe: $1.50 / 1 Mio. Tokens<br>Cache-Lesen: $0.03 / 1 Mio. Tokens |



**API-REFERENZ**

## Endpunktspezifikation

| Field | Value |
|---|---|
| Endpunkt | `POST /v1/chat/completions` |
| Modell-ID | `gemini-3.1-flash-lite` |
| Aufgabentypen | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Anfrageparameter

Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."
    }
  ]
}
```

### Modell-Skill — gemini-3.1-flash-lite

Installiere den Skill einmal und verwende dann die Varianten-ID von dieser Seite beim Entwickeln.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-3.1-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Nutze das OpenAI / Anthropic / Google Gen AI-SDK mit deinem RunAPI API Key und `model: "gemini-3.1-flash-lite"`.

### gemini-3.1-flash-lite verwenden

1. **Installieren** — Installiere den Model Skill der Gemini-Linie. Er lädt Doku, Request-Formate und Preishinweise in deinen Coding-Workspace.
2. **Konfigurieren** — Richte dein SDK auf https://runapi.ai aus und setze deinen RunAPI API Key. Derselbe Key funktioniert bei allen Modellen und Anbietern.
3. **Aufrufen** — Sende eine Anfrage in einem API-Format, das dieses Modell unterstützt, und setze das Feld model auf die Modell-ID dieser Seite. RunAPI leitet sie an den Anbieter weiter.
4. **Empfangen** — Lies die Antwort aus demselben Aufruf oder streame sie, während sie erzeugt wird. Das Feld usage zeigt die Token, die dir berechnet werden.

### Vergleich von gemini-3.1-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions** — Geschwindigkeit/Kosten optimiert; 1M Kontext; ältere Generation als Baseline
- **VS GEMINI-2.5-FLASH-LITE: Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions** — Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions
- **VS GEMINI-2.5-PRO: Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions** — Bestes Reasoning der 2.5-Generation; 1M Kontext

## ANWENDUNGSFÄLLE

**Chat**

Nutze LLMs für Chat und Reasoning.

**Code**

Generiere und prüfe Implementierungsarbeit.

**Automatisierung**

Verbinde Modelle mit Backend-Tasks.



## Häufige Fragen zu Gemini 3.1 Flash-Lite

### Soll ich Gemini 3.1 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?

Google nennt Gemini 3.5 Flash-Lite als Nachfolger von 3.1 Flash-Lite. Starten Sie neue Projekte mit gemini-3.5-flash-lite und wählen Sie gemini-3.1-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar.

### Wie lange bleibt Gemini 3.1 Flash-Lite verfügbar?

Google nennt den 7. Mai 2027 als frühestes Abschaltdatum für gemini-3.1-flash-lite. Das Preview-Modell wurde im Mai 2026 abgeschaltet, verwenden Sie daher die stabile Modell-ID.

### Kann ich Gemini 3.1 Flash-Lite mit dem OpenAI SDK aufrufen?

Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-3.1-flash-lite. Tools nutzen das Standardformat von OpenAI.

### Kann ich bei RunAPI Bilder oder Audio an gemini-3.1-flash-lite senden?

Noch nicht. Googles Modell liest Bilder, Video, Audio und PDF, aber RunAPI nimmt für gemini-3.1-flash-lite nur Texteingabe an; Anfragen mit Medienanteilen werden abgelehnt.

### Wie wähle ich gemini-3.1-flash-lite aus?

Übergib die im Quickstart angezeigte Modell-ID.

### Sind die Preise nutzungsbasiert?

Ja. Preise werden pro Aufruf oder Einheit gemessen.


### VERWANDT

- [gemini-2.5-flash-lite](https://runapi.ai/de/models/gemini/2.5-flash-lite.md) — von Google · Eingabe $0.10 / 1 Mio. Tokens | Ausgabe $0.40 / 1 Mio. Tokens
- [gemini-3.5-flash-lite](https://runapi.ai/de/models/gemini/3.5-flash-lite.md) — von Google · Eingabe $0.15 / 1 Mio. Tokens | Ausgabe $1.25 / 1 Mio. Tokens
- [gemini-2.5-flash](https://runapi.ai/de/models/gemini/2.5-flash.md) — von Google · Eingabe $0.30 / 1 Mio. Tokens | Ausgabe $2.50 / 1 Mio. Tokens
- [gemini-3-flash-preview](https://runapi.ai/de/models/gemini/3-flash-preview.md) — von Google · Eingabe $0.50 / 1 Mio. Tokens | Ausgabe $3.00 / 1 Mio. Tokens · Eingabe $0.30 / 1 Mio. Tokens | Ausgabe $1.80 / 1 Mio. Tokens

### Starte heute mit Gemini.

- [Kostenloses Konto erstellen](https://runapi.ai/de/login)
- [Quickstart lesen →](https://runapi.ai/de/docs/api/openai/chat-completions)
## Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

[Kontakt aufnehmen](https://runapi.ai/de/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/de/.md)
### Produkt
- [Modellkatalog](https://runapi.ai/de/models.md)
- [Preise](https://runapi.ai/de/pricing.md)
- [Anbieter](https://runapi.ai/de/models#all-models)
### Entwickler
- [Dokumentation](https://runapi.ai/de/docs/guides)
- [SDKs](https://runapi.ai/de/sdk.md)
- [CLI](https://runapi.ai/de/cli.md)
- [MCP Server](https://runapi.ai/de/mcp.md)
- [x402](https://runapi.ai/de/x402.md)
### Anleitungen
- [Claude Code vs Cursor](https://runapi.ai/de/claude-code-vs-cursor.md)
- [Cursor API-Einrichtung](https://runapi.ai/de/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/de/openrouter-alternative.md)
### Unternehmen
- [Enterprise](https://runapi.ai/de/contact.md)
- [Kontakt](https://runapi.ai/de/contact.md)
### Rechtliches
- [Bedingungen](https://runapi.ai/de/terms.md)
- [Datenschutz](https://runapi.ai/de/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/de",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/de/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/de",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/deicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-3.1-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/de"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/de/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/de/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-3.1-flash-lite",
        "item": "https://runapi.ai/de/models/gemini/3.1-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "HowTo",
    "name": "gemini-3.1-flash-lite verwenden",
    "description": "gemini-3.1-flash-lite aus der Gemini-Familie über RunAPI aufrufen: Preis pro Token, Modell-ID, unterstützte API-Formate und Setup-Anleitung.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Installieren",
        "text": "Installiere den Model Skill der Gemini-Linie. Er lädt Doku, Request-Formate und Preishinweise in deinen Coding-Workspace.",
        "url": "https://runapi.ai/de/models/gemini/3.1-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Konfigurieren",
        "text": "Richte dein SDK auf https://runapi.ai aus und setze deinen RunAPI API Key. Derselbe Key funktioniert bei allen Modellen und Anbietern.",
        "url": "https://runapi.ai/de/models/gemini/3.1-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Aufrufen",
        "text": "Sende eine Anfrage in einem API-Format, das dieses Modell unterstützt, und setze das Feld model auf die Modell-ID dieser Seite. RunAPI leitet sie an den Anbieter weiter.",
        "url": "https://runapi.ai/de/models/gemini/3.1-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Empfangen",
        "text": "Lies die Antwort aus demselben Aufruf oder streame sie, während sie erzeugt wird. Das Feld usage zeigt die Token, die dir berechnet werden.",
        "url": "https://runapi.ai/de/models/gemini/3.1-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "de",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Soll ich Gemini 3.1 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google nennt Gemini 3.5 Flash-Lite als Nachfolger von 3.1 Flash-Lite. Starten Sie neue Projekte mit gemini-3.5-flash-lite und wählen Sie gemini-3.1-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar."
        }
      },
      {
        "@type": "Question",
        "name": "Wie lange bleibt Gemini 3.1 Flash-Lite verfügbar?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google nennt den 7. Mai 2027 als frühestes Abschaltdatum für gemini-3.1-flash-lite. Das Preview-Modell wurde im Mai 2026 abgeschaltet, verwenden Sie daher die stabile Modell-ID."
        }
      },
      {
        "@type": "Question",
        "name": "Kann ich Gemini 3.1 Flash-Lite mit dem OpenAI SDK aufrufen?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-3.1-flash-lite. Tools nutzen das Standardformat von OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "Kann ich bei RunAPI Bilder oder Audio an gemini-3.1-flash-lite senden?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Noch nicht. Googles Modell liest Bilder, Video, Audio und PDF, aber RunAPI nimmt für gemini-3.1-flash-lite nur Texteingabe an; Anfragen mit Medienanteilen werden abgelehnt."
        }
      },
      {
        "@type": "Question",
        "name": "Wie wähle ich gemini-3.1-flash-lite aus?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Übergib die im Quickstart angezeigte Modell-ID."
        }
      },
      {
        "@type": "Question",
        "name": "Sind die Preise nutzungsbasiert?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Ja. Preise werden pro Aufruf oder Einheit gemessen."
        }
      }
    ]
  }
]
```
