Google

Gemini 3.1 Flash-Lite

Testo

Gemini 3.1 Flash-Lite; contesto 1M, thinking regolabile; richieste di testo con Chat Completions compatibile OpenAI

Input $0.25 / 1M di token | Output $1.50 / 1M di token Gemini 3.1 Flash-Lite Riferimento API →
Stato del modello Dati insufficienti
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analizza questa codebase e suggerisci tre miglioramenti delle prestazioni con esempi prima/dopo."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analizza questa codebase e suggerisci tre miglioramenti delle prestazioni con esempi prima/dopo."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analizza questa codebase e suggerisci tre miglioramenti delle prestazioni con esempi prima/dopo." }]
});
https://runapi.ai 5 endpoints
OVERVIEW

A cosa serve Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite è il modello a bassa latenza e basso costo della serie Gemini 3 di Google. Google lo progetta per compiti semplici ad alto volume, come traduzione, classificazione ed estrazione di entità, smistamento di documenti e instradamento delle richieste tra modelli. La versione stabile gemini-3.1-flash-lite è disponibile per tutti dal 7 maggio 2026. La finestra di contesto è di 1.048.576 token e l'output arriva a 65.536 token.

Il thinking è regolabile: Google offre quattro livelli di thinking, da minimo ad alto, e conta i token di thinking come output. Google supporta function calling e output strutturati su questo modello.

Il modello di Google accetta input di testo, immagini, video, audio e PDF. Su RunAPI, gemini-3.1-flash-lite accetta solo input testuale. Invia le richieste tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages o Gemini generateContent. Google indica Gemini 3.5 Flash-Lite come sostituto, e RunAPI lo offre come gemini-3.5-flash-lite.

ID del modello
gemini-3.1-flash-lite
Rilascio
7 maggio 2026 (disponibilità generale)
Finestra di contesto
1.048.576 token
Output massimo
65.536 token
Thinking
Regolabile, da minimo ad alto
Data di spegnimento più vicina (Google)
7 maggio 2027
Endpoint su RunAPI
OpenAI Chat Completions, input testo
Playground

Prova Gemini 3.1 Flash-Lite

Scegli un modello e genera in pochi secondi.

Stimato: Input $0.25 / 1M di token | Output $1.50 / 1M di token

Accedi per generare con RunAPI.

Accedi per generare

Accedi per iniziare a generare con i modelli linguistici disponibili.

Specifiche

Dettagli tecnici

Provider Google
ID modello gemini-3.1-flash-lite
Modalità Testo
Tipi di attività Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Unità di fatturazione 1K token
Stato del catalogo Operativo
COME FUNZIONA

Usa questo modello in 3 passaggi

  1. Crea la tua chiave

    Registrati gratuitamente e crea una chiave API per gemini-3.1-flash-lite dalla dashboard.

  2. Invia una richiesta

    Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello gemini-3.1-flash-lite e i tuoi parametri.

  3. Ottieni i risultati

    Leggi direttamente dall’endpoint la risposta completata di gemini-3.1-flash-lite.

Cosa offre questo modello

Copertura endpoint

Espone 1 endpoint pubblici: chat_completion.

Fatturazione a consumo

Misurata in base a 1K token, senza requisito di abbonamento.

Gemini 3.1 Flash-Lite Prezzi

Endpoint
Prezzo
chat_completion
Input: $0.25 / 1M di token Output: $1.50 / 1M di token
  • Lettura cache: $0.03 / 1M di token
RIFERIMENTO API

Specifiche dell'endpoint

Endpoint
POST /v1/chat/completions
ID modello
gemini-3.1-flash-lite
Tipi di attività
chat_completion

Parametri della richiesta

Nessun parametro della richiesta è pubblicato per questo endpoint.

CASI D'USO

Customer support

Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.

Analisi documentale

Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.

Generazione di codice

Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.

Metriche di utilizzo

Scelto dagli sviluppatori
6
Chiamate API / Giorno
100.0%
Tasso di successo
1.9s
Generazione media

Il feedback verificato dei clienti non è ancora disponibile per questo modello.

FAQ

Domande frequenti su Gemini 3.1 Flash-Lite

Meglio Gemini 3.1 Flash-Lite o Gemini 3.5 Flash-Lite?

Google indica Gemini 3.5 Flash-Lite come sostituto di 3.1 Flash-Lite. Avvia i nuovi progetti con gemini-3.5-flash-lite e scegli gemini-3.1-flash-lite quando un carico, un set di prompt o una valutazione esistenti sono stati costruiti su di esso. Entrambi i modelli sono su RunAPI con la stessa chiave API.

Per quanto tempo sarà disponibile Gemini 3.1 Flash-Lite?

Google indica il 7 maggio 2027 come data di spegnimento più vicina per gemini-3.1-flash-lite. Il modello preview è stato spento a maggio 2026, quindi usa l'ID del modello stabile.

Posso chiamare Gemini 3.1 Flash-Lite con l'SDK OpenAI?

Sì. Punta l'SDK OpenAI su https://runapi.ai/v1 con la tua chiave API RunAPI e invia richieste Chat Completions con model impostato su gemini-3.1-flash-lite. I tool usano il formato standard di OpenAI.

Posso inviare immagini o audio a gemini-3.1-flash-lite su RunAPI?

Non ancora. Il modello di Google legge immagini, video, audio e PDF, ma RunAPI accetta solo input testuale per gemini-3.1-flash-lite, e le richieste con parti multimediali vengono rifiutate.

Come seleziono gemini-3.1-flash-lite?

Passa l'ID del modello mostrato nel quickstart.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci