Google

Gemini 2.5 Flash-Lite

Text

Gemini 2.5 Flash-Lite; 1M Kontext, Thinking standardmäßig aus; OpenAI-kompatible Chat Completions

Eingabe $0.10 / 1 Mio. Tokens | Ausgabe $0.40 / 1 Mio. Tokens Gemini 2.5 Flash-Lite Dokumentation lesen →
Modellgesundheit Unzureichende Daten
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor." }]
});
https://runapi.ai 5 endpoints
ÜBERBLICK

Wofür Gemini 2.5 Flash-Lite gebaut ist

Gemini 2.5 Flash-Lite ist die Flash-Lite-Stufe der Gemini-2.5-Generation von Google, gedacht für Klassifikation und Extraktion in hohem Volumen und andere Aufgaben mit niedriger Latenz. Es ist seit dem 22. Juli 2025 allgemein verfügbar, mit Wissensstand Januar 2025. Das Kontextfenster umfasst 1.048.576 Tokens, die Ausgabe bis zu 65.536 Tokens.

Thinking ist standardmäßig ausgeschaltet; für schwierigere Prompts dokumentiert Google einen optionalen Thinking-Modus. Google unterstützt für das Modell Function Calling und strukturierte Ausgaben.

Googles Modell nimmt Text, Bilder, Video, Audio und PDF an. Bei RunAPI senden Sie Text über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions); RunAPI nimmt für dieses Modell nur Texteingabe an. Für neue Projekte empfiehlt Google Gemini 3.5 Flash-Lite, das RunAPI als gemini-3.5-flash-lite anbietet.

Modell-ID
gemini-2.5-flash-lite
Veröffentlicht
22. Juli 2025 (allgemein verfügbar)
Wissensstand
Januar 2025
Kontextfenster
1.048.576 Tokens
Maximale Ausgabe
65.536 Tokens
Thinking
Optional, standardmäßig aus
Endpunkt bei RunAPI
OpenAI Chat Completions, Texteingabe
Playground

Gemini 2.5 Flash-Lite ausprobieren

Wähle ein Modell und generiere in Sekunden.

Geschätzt: Eingabe $0.10 / 1 Mio. Tokens | Ausgabe $0.40 / 1 Mio. Tokens

Zum Generieren mit RunAPI einloggen.

Anmelden zum Generieren

Melde dich an, um mit deinen verfügbaren Sprachmodellen zu beginnen.

Specifications

DATENBLATT

Anbieter Google
Modell-ID gemini-2.5-flash-lite
Modalität Text
Aufgabentypen Synchronous
API-Endpunkt /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
Abrechnungseinheit 1K-Token
Katalogstatus Betriebsbereit
SO FUNKTIONIERT ES

Dieses Modell in 3 Schritten verwenden

  1. API-Schlüssel erstellen

    Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für gemini-2.5-flash-lite.

  2. Anfrage senden

    Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID gemini-2.5-flash-lite und deinen Parametern.

  3. Ergebnisse abrufen

    Lies die fertige gemini-2.5-flash-lite-Antwort direkt vom Endpoint.

Was dieses Modell bietet

Endpoint-Abdeckung

Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.

Nutzungsbasierte Abrechnung

Gemessen nach 1K-Token, ohne Abo-Anforderung.

Gemini 2.5 Flash-Lite PREISE

Endpunkt
Preis
chat_completion
Eingabe: $0.10 / 1 Mio. Tokens Ausgabe: $0.40 / 1 Mio. Tokens
  • Cache-Lesen: $0.01 / 1 Mio. Tokens
API-REFERENZ

Endpunktspezifikation

Endpunkt
POST /v1/chat/completions
Modell-ID
gemini-2.5-flash-lite
Aufgabentypen
chat_completion

Anfrageparameter

Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.

ANWENDUNGSFÄLLE

Chat

Nutze LLMs für Chat und Reasoning.

Code

Generiere und prüfe Implementierungsarbeit.

Automatisierung

Verbinde Modelle mit Backend-Tasks.

Nutzungsmetriken

Entwickler vertrauen uns
6
API-Aufrufe / Tag
100.0%
Erfolgsrate
1.8s
Ø Generierungszeit

Verifiziertes Kundenfeedback ist für dieses Modell noch nicht verfügbar.

FAQ

Häufige Fragen zu Gemini 2.5 Flash-Lite

Soll ich Gemini 2.5 Flash-Lite oder Gemini 3.5 Flash-Lite verwenden?

Für neue Projekte empfiehlt Google Gemini 3.5 Flash-Lite oder Gemini 3.8 Flash. Wählen Sie gemini-2.5-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar.

Kann ich Gemini 2.5 Flash-Lite noch verwenden?

Ja. Google hat kein Abschaltdatum angekündigt, beschränkt den Zugriff auf 2.5-Modelle in der eigenen API inzwischen aber auf Nutzer, die sie bereits verwendet haben. Bei RunAPI steht gemini-2.5-flash-lite jedem Konto zur Verfügung.

Kann ich Gemini 2.5 Flash-Lite mit dem OpenAI SDK aufrufen?

Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-2.5-flash-lite. Tools nutzen das Standardformat von OpenAI.

Denkt Gemini 2.5 Flash-Lite vor der Antwort nach?

Standardmäßig nicht. Google liefert es für hohes Volumen und niedrige Latenz mit ausgeschaltetem Thinking aus und dokumentiert einen optionalen Thinking-Modus.

Wie wähle ich gemini-2.5-flash-lite aus?

Übergib die im Quickstart angezeigte Modell-ID.

Sind die Preise nutzungsbasiert?

Ja. Preise werden pro Aufruf oder Einheit gemessen.

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen