Endpoint-Abdeckung
Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
Gemini 3.1 Flash-Lite; 1M Kontext, einstellbares Thinking; Textanfragen über OpenAI-kompatible Chat Completions
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "Analysiere diese Codebasis und schlage drei Performance-Verbesserungen mit Vorher-Nachher-Beispielen vor." }]
});
11 Versionen verfügbar
Gemini 3.1 Flash-Lite ist das latenzarme, kostengünstige Modell der Gemini-3-Reihe von Google. Google entwickelt es für einfache Aufgaben in hohem Volumen, etwa Übersetzung, Klassifikation und Entitätsextraktion, Dokumenten-Triage sowie das Weiterleiten von Anfragen zwischen Modellen. Das stabile gemini-3.1-flash-lite ist seit dem 7. Mai 2026 allgemein verfügbar. Das Kontextfenster umfasst 1.048.576 Tokens, die Ausgabe bis zu 65.536 Tokens.
Thinking ist einstellbar: Google bietet vier Thinking-Stufen von minimal bis hoch und zählt Thinking-Tokens zur Ausgabe. Google unterstützt für das Modell Function Calling und strukturierte Ausgaben.
Googles Modell nimmt Text, Bilder, Video, Audio und PDF an. Bei RunAPI nimmt gemini-3.1-flash-lite nur Texteingabe an. Senden Sie Anfragen über den OpenAI-kompatiblen Chat-Completions-Endpunkt (/v1/chat/completions), OpenAI Responses, Anthropic Messages oder Gemini generateContent. Google nennt Gemini 3.5 Flash-Lite als Nachfolger; RunAPI führt es als gemini-3.5-flash-lite.
Wähle ein Modell und generiere in Sekunden.
| Anbieter | |
| Modell-ID | gemini-3.1-flash-lite |
| Modalität | Text |
| Aufgabentypen | Synchronous |
| API-Endpunkt | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| Abrechnungseinheit | 1K-Token |
| Katalogstatus | Betriebsbereit |
Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für gemini-3.1-flash-lite.
Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID gemini-3.1-flash-lite und deinen Parametern.
Lies die fertige gemini-3.1-flash-lite-Antwort direkt vom Endpoint.
Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.
Gemessen nach 1K-Token, ohne Abo-Anforderung.
Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.
Nutze LLMs für Chat und Reasoning.
Generiere und prüfe Implementierungsarbeit.
Verbinde Modelle mit Backend-Tasks.
Verifiziertes Kundenfeedback ist für dieses Modell noch nicht verfügbar.
Google nennt Gemini 3.5 Flash-Lite als Nachfolger von 3.1 Flash-Lite. Starten Sie neue Projekte mit gemini-3.5-flash-lite und wählen Sie gemini-3.1-flash-lite, wenn ein bestehender Workload, ein Prompt-Set oder eine Evaluierung darauf aufbaut. Beide Modelle sind bei RunAPI unter demselben API-Key verfügbar.
Google nennt den 7. Mai 2027 als frühestes Abschaltdatum für gemini-3.1-flash-lite. Das Preview-Modell wurde im Mai 2026 abgeschaltet, verwenden Sie daher die stabile Modell-ID.
Ja. Richten Sie das OpenAI SDK mit Ihrem RunAPI-API-Key auf https://runapi.ai/v1 und senden Sie Chat-Completions-Requests mit model auf gemini-3.1-flash-lite. Tools nutzen das Standardformat von OpenAI.
Noch nicht. Googles Modell liest Bilder, Video, Audio und PDF, aber RunAPI nimmt für gemini-3.1-flash-lite nur Texteingabe an; Anfragen mit Medienanteilen werden abgelehnt.
Übergib die im Quickstart angezeigte Modell-ID.
Ja. Preise werden pro Aufruf oder Einheit gemessen.
Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.
Kontakt aufnehmen