Google

Gemini 3.1 Flash-Lite

Text

Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions

Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $1.50 / 1 Mio. Tokens Gemini 3.1 Flash-Lite Dokumentation lesen →
Modellgesundheit Unzureichende Daten
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor." }]
});
https://runapi.ai 5 endpoints
ÜBERBLICK

Wofür Gemini 3.1 Flash-Lite gebaut ist

Gemini 3.1 Flash-Lite ist das latenzarme, kostengünstige Modell der Gemini-3-Reihe von Google. Google entwickelt es für einfache Aufgaben in hohem Volumen, etwa Übersetzung, Klassifikation und Entitätsextraktion, Dokumenten-Triage sowie das Weiterleiten von Anfragen zwischen Modellen. Das stabile gemini-3.1-flash-lite ist seit dem 7. Mai 2026 allgemein verfügbar. Das Kontextfenster umfasst 1.048.576 Tokens, die Ausgabe bis zu 65.536 Tokens.

Thinking ist einstellbar: Google bietet vier Thinking-Stufen von minimal bis hoch und zählt Thinking-Tokens zur Ausgabe. Google unterstützt für das Modell Function Calling und strukturierte Ausgaben.

Googles Modell nimmt Text, Bilder, Video, Audio und PDF an. Bei RunAPI nimmt gemini-3.1-flash-lite nur Texteingabe an. Senden Sie Anfragen über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions), OpenAI Responses, Anthropic Messages oder Gemini generateContent. Google nennt Gemini 3.5 Flash-Lite als Nachfolger; RunAPI führt es als gemini-3.5-flash-lite.

Modell-ID
gemini-3.1-flash-lite
Veröffentlicht
7. Mai 2026 (allgemein verfügbar)
Kontextfenster
1.048.576 Tokens
Maximale Ausgabe
65.536 Tokens
Thinking
Einstellbar, von minimal bis hoch
Frühestes Abschaltdatum (Google)
7. Mai 2027
Endpunkt bei RunAPI
OpenAI Chat Completions, Texteingabe
Playground

Gemini 3.1 Flash-Lite ausprobieren

Wähle ein Modell und generiere in Sekunden.

Geschätzt: Eingabe $0.25 / 1 Mio. Tokens | Ausgabe $1.50 / 1 Mio. Tokens

Zum Generieren mit RunAPI einloggen.

Anmelden zum Generieren

Melde dich an, um mit deinen verfügbaren Sprachmodellen zu beginnen.

Specifications

DATENBLATT

Anbieter Google
Modell-ID gemini-3.1-flash-lite
Modalität Text
Aufgabentypen Synchronous
API-Endpunkt /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Abrechnungseinheit 1K-Token
Katalogstatus Betriebsbereit
SO FUNKTIONIERT ES

Dieses Modell in 3 Schritten verwenden

  1. API-Schlüssel erstellen

    Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für gemini-3.1-flash-lite.

  2. Anfrage senden

    Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID gemini-3.1-flash-lite und deinen Parametern.

  3. Ergebnisse abrufen

    Lies die fertige gemini-3.1-flash-lite-Antwort direkt vom Endpoint.

Was dieses Modell bietet

Endpoint-Abdeckung

Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.

Nutzungsbasierte Abrechnung

Gemessen nach 1K-Token, ohne Abo-Anforderung.

Gemini 3.1 Flash-Lite PREISE

Endpunkt
Preis
chat_completion
Eingabe: $0.25 / 1 Mio. Tokens Ausgabe: $1.50 / 1 Mio. Tokens
  • Cache-Lesen: $0.03 / 1 Mio. Tokens
API-REFERENZ

Endpunktspezifikation

Endpunkt
POST /v1/chat/completions
Modell-ID
gemini-3.1-flash-lite
Aufgabentypen
chat_completion

Anfrageparameter

Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.

ANWENDUNGSFÄLLE

Chat

Nutze LLMs für Chat und Reasoning.

Code

Generiere und prüfe Implementierungsarbeit.

Automatisierung

Verbinde Modelle mit Backend-Tasks.

Nutzungsmetriken

Entwickler vertrauen uns
6
API-Aufrufe / Tag
100.0%
Erfolgsrate
1.9s
Ø Generierungszeit

Verifiziertes Kundenfeedback ist für dieses Modell noch nicht verfügbar.

FAQ

Häufige Fragen zu Gemini 3.1 Flash-Lite

Soll ich Gemini 3.1 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?

Google nennt Gemini 3.5 Flash-Lite als Nachfolger von 3.1 Flash-Lite. Starten Sie neue Projekte mit gemini-3.5-flash-lite und wählen Sie gemini-3.1-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar.

Wie lange bleibt Gemini 3.1 Flash-Lite verfügbar?

Google nennt den 7. Mai 2027 als frühestes Abschaltdatum für gemini-3.1-flash-lite. Das Preview-Modell wurde im Mai 2026 abgeschaltet, verwenden Sie daher die stabile Modell-ID.

Kann ich Gemini 3.1 Flash-Lite mit dem OpenAI SDK aufrufen?

Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-3.1-flash-lite. Tools nutzen das Standardformat von OpenAI.

Kann ich bei RunAPI Bilder oder Audio an gemini-3.1-flash-lite senden?

Noch nicht. Googles Modell liest Bilder, Video, Audio und PDF, aber RunAPI nimmt für gemini-3.1-flash-lite nur Texteingabe an; Anfragen mit Medienanteilen werden abgelehnt.

Wie wähle ich gemini-3.1-flash-lite aus?

Übergib die im Quickstart angezeigte Modell-ID.

Sind die Preise nutzungsbasiert?

Ja. Preise werden pro Aufruf oder Einheit gemessen.

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen