Google

Gemini 3.1 Flash-Lite

Tekst

Gemini 3.1 Flash-Lite; 1M context, instelbare thinking; tekstrequests via OpenAI-compatibele Chat Completions

Invoer $0.25 / 1M tokens | Uitvoer $1.50 / 1M tokens Gemini 3.1 Flash-Lite API-documentatie →
Modelgezondheid Onvoldoende gegevens
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analyseer deze codebase en stel drie prestatieverbeteringen voor met voor/na-voorbeelden."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analyseer deze codebase en stel drie prestatieverbeteringen voor met voor/na-voorbeelden."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analyseer deze codebase en stel drie prestatieverbeteringen voor met voor/na-voorbeelden." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Waarvoor Gemini 3.1 Flash-Lite gebouwd is

Gemini 3.1 Flash-Lite is het model met lage latency en lage kosten uit de Gemini 3-serie van Google. Google bouwt het voor eenvoudige taken in grote volumes, zoals vertaling, classificatie en entiteitsextractie, documenttriage en het doorsturen van requests tussen modellen. Het stabiele gemini-3.1-flash-lite werd op 7 mei 2026 algemeen beschikbaar. Het contextvenster is 1.048.576 tokens en de output gaat tot 65.536 tokens.

Thinking is instelbaar: Google biedt vier thinking-niveaus, van minimal tot high, en rekent thinking-tokens tot de output. Google ondersteunt function calling en structured outputs op het model.

Het model van Google accepteert tekst, afbeeldingen, video, audio en pdf als invoer. Op RunAPI accepteert gemini-3.1-flash-lite alleen tekstinvoer. Stuur requests via het OpenAI-compatibele Chat Completions-endpoint (/v1/chat/completions), OpenAI Responses, Anthropic Messages of Gemini generateContent. Google noemt Gemini 3.5 Flash-Lite als opvolger, en RunAPI biedt dat model aan als gemini-3.5-flash-lite.

Model-ID
gemini-3.1-flash-lite
Uitgebracht
7 mei 2026 (algemeen beschikbaar)
Contextvenster
1.048.576 tokens
Maximale output
65.536 tokens
Thinking
Instelbaar, van minimal tot high
Vroegste uitschakeling (Google)
7 mei 2027
Endpoint op RunAPI
OpenAI Chat Completions, tekstinvoer
Playground

Gemini 3.1 Flash-Lite proberen

Kies een model en genereer binnen enkele seconden.

Schatting: Invoer $0.25 / 1M tokens | Uitvoer $1.50 / 1M tokens

Log in om te genereren met RunAPI.

Meld je aan om te genereren

Meld je aan om te beginnen met genereren met je beschikbare taalmodellen.

Specificaties

Technische details

Provider Google
Model-ID gemini-3.1-flash-lite
Modaliteit Tekst
Taaktypen Synchronous
API-eindpunt /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Factureringseenheid 1K tokens
Catalogusstatus Operationeel
ZO WERKT HET

Gebruik dit model in 3 stappen

  1. Maak je sleutel

    Meld je gratis aan en maak vanuit het dashboard een API-sleutel voor gemini-3.1-flash-lite.

  2. Stuur een verzoek

    Stuur een POST-verzoek naar /v1/chat/completions met de model-ID gemini-3.1-flash-lite en je parameters.

  3. Resultaten ophalen

    Lees het voltooide gemini-3.1-flash-lite-antwoord rechtstreeks van het endpoint.

Wat dit model biedt

Endpointdekking

Stelt 1 openbaar(e) endpoint(s) beschikbaar: chat_completion.

Verbruiksgebaseerde facturering

Gemeten aan de hand van 1K tokens, zonder abonnementsvereiste.

Gemini 3.1 Flash-Lite Prijzen

Endpoint
Prijs
chat_completion
Invoer: $0.25 / 1M tokens Uitvoer: $1.50 / 1M tokens
  • Cache lezen: $0.03 / 1M tokens
API-REFERENTIE

Endpoint-specificatie

Endpoint
POST /v1/chat/completions
Model-ID
gemini-3.1-flash-lite
Taaktypen
chat_completion

Requestparameters

Voor dit endpoint zijn geen requestparameters gepubliceerd.

USE CASES

Klantenservice

Beantwoord klantvragen vanuit een privékennisbank en verlaag zo het aantal tickets.

Documentanalyse

Stel samenvattingen van contracten op en markeer belangrijke clausules voor beoordeling door een jurist.

Codegeneratie

Genereer automatisch unittests, code reviews en refactoringsuggesties in CI.

Gebruiksstatistieken

Vertrouwd door ontwikkelaars
6
API-aanroepen / dag
100.0%
Slagingspercentage
1.9s
Gem. generatietijd

Geverifieerde klantfeedback is nog niet beschikbaar voor dit model.

FAQ

Veelgestelde vragen over Gemini 3.1 Flash-Lite

Gebruik ik Gemini 3.1 Flash-Lite of Gemini 3.5 Flash-Lite?

Google noemt Gemini 3.5 Flash-Lite als opvolger van 3.1 Flash-Lite. Begin nieuwe projecten met gemini-3.5-flash-lite, en kies gemini-3.1-flash-lite wanneer een bestaande workload, promptset of evaluatie erop gebouwd is. Beide modellen staan op RunAPI onder dezelfde API-key.

Hoe lang blijft Gemini 3.1 Flash-Lite beschikbaar?

Google noemt 7 mei 2027 als vroegste uitschakeldatum voor gemini-3.1-flash-lite. Het preview-model is in mei 2026 uitgeschakeld, gebruik dus de stabiele model-ID.

Kan ik Gemini 3.1 Flash-Lite aanroepen met de OpenAI-SDK?

Ja. Laat de OpenAI-SDK naar https://runapi.ai/v1 wijzen met je RunAPI-API-key en stuur Chat Completions-requests met model ingesteld op gemini-3.1-flash-lite. Tools gebruiken het standaard OpenAI-toolsformaat.

Kan ik afbeeldingen of audio sturen naar gemini-3.1-flash-lite op RunAPI?

Nog niet. Het model van Google leest afbeeldingen, video, audio en pdf's, maar RunAPI accepteert voor gemini-3.1-flash-lite alleen tekstinvoer, en requests met mediaonderdelen worden geweigerd.

Hoe selecteer ik gemini-3.1-flash-lite?

Geef de model-ID door die in de quickstart wordt getoond.

Wat is de rate limit voor deze variant?

Rate limits per key schalen mee met je usage tier. Bekijk de prijzenpagina voor de actuele limieten.

Kan ik later van variant wisselen?

Ja — variant is een flag. Wissel door de modelparameter aan te passen.

Ondersteunt het streaming?

Waar streaming beschikbaar is, streamt RunAPI end-to-end.

Waar meld ik kwaliteitsproblemen?

Open een issue in de publieke GitHub-repo of mail support.

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op