---
title: 'API Gemini 3.1 Flash-Lite: ID, contesto 1M e SDK OpenAI | RunAPI'
description: Chiama gemini-3.1-flash-lite con l'API Chat Completions compatibile OpenAI di RunAPI. Contesto da 1M token, output da 65K, thinking regolabile, solo testo.
url: https://runapi.ai/it/models/gemini/3.1-flash-lite.md
canonical: https://runapi.ai/it/models/gemini/3.1-flash-lite
locale: it
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/3.1-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
  es: https://runapi.ai/es/models/gemini/3.1-flash-lite
  ja: https://runapi.ai/ja/models/gemini/3.1-flash-lite
  de: https://runapi.ai/de/models/gemini/3.1-flash-lite
  fr: https://runapi.ai/fr/models/gemini/3.1-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite
  ko: https://runapi.ai/ko/models/gemini/3.1-flash-lite
  it: https://runapi.ai/it/models/gemini/3.1-flash-lite
  nl: https://runapi.ai/nl/models/gemini/3.1-flash-lite
  pl: https://runapi.ai/pl/models/gemini/3.1-flash-lite
  tr: https://runapi.ai/tr/models/gemini/3.1-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/3.1-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/3.1-flash-lite
  ar: https://runapi.ai/ar/models/gemini/3.1-flash-lite
  x-default: https://runapi.ai/models/gemini/3.1-flash-lite
model: Gemini
provider: Google
variant_id: gemini-3.1-flash-lite
sdk_model_id: gemini-3.1-flash-lite
modality: text
billing_unit: 1K token
status: active
---

> HTML version: https://runapi.ai/it/models/gemini/3.1-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-3.1-flash-lite API

Richiama gemini-3.1-flash-lite della famiglia Gemini tramite RunAPI. La fatturazione è per token, senza abbonamento, e una richiesta che fallisce prima dell'inizio della risposta non viene addebitata.

**Google / [Gemini](https://runapi.ai/it/models/gemini.md)**
**Operativo · text · Uso commerciale consentito**

## A cosa serve Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite è il modello a bassa latenza e basso costo della serie Gemini 3 di Google. Google lo progetta per compiti semplici ad alto volume, come traduzione, classificazione ed estrazione di entità, smistamento di documenti e instradamento delle richieste tra modelli. La versione stabile gemini-3.1-flash-lite è disponibile per tutti dal 7 maggio 2026. La finestra di contesto è di 1.048.576 token e l'output arriva a 65.536 token.

Il thinking è regolabile: Google offre quattro livelli di thinking, da minimo ad alto, e conta i token di thinking come output. Google supporta function calling e output strutturati su questo modello.

Il modello di Google accetta input di testo, immagini, video, audio e PDF. Su RunAPI, gemini-3.1-flash-lite accetta solo input testuale. Invia le richieste tramite l'endpoint Chat Completions compatibile OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages o Gemini generateContent. Google indica Gemini 3.5 Flash-Lite come sostituto, e RunAPI lo offre come gemini-3.5-flash-lite.

**ID del modello:** gemini-3.1-flash-lite
**Rilascio:** 7 maggio 2026 (disponibilità generale)
**Finestra di contesto:** 1.048.576 token
**Output massimo:** 65.536 token
**Thinking:** Regolabile, da minimo ad alto
**Data di spegnimento più vicina (Google):** 7 maggio 2027
**Endpoint su RunAPI:** OpenAI Chat Completions, input testo



<!-- catalog-model-detail-slot: model-playground -->

## Prova Gemini 3.1 Flash-Lite

Scegli un modello e genera in pochi secondi.


**Modello:**
- **Chat completion** — `chat_completion` · `gemini-3.1-flash-lite` · Input $0.25 / 1M di token | Output $1.50 / 1M di token

**Prompt:** Descrivi cosa vuoi creare...

**Stimato:** Input $0.25 / 1M di token | Output $1.50 / 1M di token

- [Genera](https://runapi.ai/it/login)
Accedi per generare con RunAPI.
<!-- /catalog-model-detail-slot: model-playground -->

### Cambia variante

- [gemini-2.5-flash](https://runapi.ai/it/models/gemini/2.5-flash.md)
- [gemini-2.5-flash-lite](https://runapi.ai/it/models/gemini/2.5-flash-lite.md)
- [gemini-2.5-pro](https://runapi.ai/it/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/it/models/gemini/3-flash-preview.md)
- **gemini-3.1-flash-lite** (current)
- [gemini-3.1-pro-preview](https://runapi.ai/it/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/it/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/it/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/it/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/it/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/it/models/gemini/3.8-flash.md)

11 versioni disponibili





gemini-3.1-flash-lite è uno dei modelli Gemini su RunAPI. Usa la stessa API key di tutti gli altri modelli e ci passi cambiando l'ID modello nella richiesta. Ogni chiamata è sincrona e viene fatturata in USD in base ai token di input, output e cache, senza abbonamento né spesa minima. Una richiesta che fallisce prima dell'inizio della risposta non viene addebitata; una volta avviato lo streaming, i token già generati vengono addebitati, anche se il client si disconnette.

- Fatturazione per token in USD, senza abbonamento
- Nessun addebito se la richiesta fallisce prima della risposta
- Streaming token per token
- Cambia modello modificando un solo ID modello
- Una sola API key e una sola fattura per tutti i modelli e fornitori

## Metriche di utilizzo

- **Chiamate API / Giorno:** 6
- **Tasso di successo:** 100.0%
- **Generazione media:** 1.9s

Il feedback verificato dei clienti non è ancora disponibile per questo modello.



## Dettagli tecnici

| Campo | Valore |
|---|---|
| Provider | Google |
| ID modello | gemini-3.1-flash-lite |
| Modalità | Testo |
| Tipi di attività | Synchronous |
| Endpoint API | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-3.1-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` |
| Unità di fatturazione | 1K token |
| Stato del catalogo | Operativo |



**COME FUNZIONA**

## Usa questo modello in 3 passaggi

1. **Crea la tua chiave** - Registrati gratuitamente e crea una chiave API per gemini-3.1-flash-lite dalla dashboard.
2. **Invia una richiesta** - Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello gemini-3.1-flash-lite e i tuoi parametri.
3. **Ottieni i risultati** - Leggi direttamente dall’endpoint la risposta completata di gemini-3.1-flash-lite.



<!-- catalog-model-detail-slot: feature-cards -->

## Cosa offre questo modello

- **Copertura endpoint** — Espone 1 endpoint pubblici: chat_completion.
- **Fatturazione a consumo** — Misurata in base a 1K token, senza requisito di abbonamento.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 3.1 Flash-Lite Prezzi

| Endpoint | Prezzo |
|---|---|
| `chat_completion` | Input: $0.25 / 1M di token<br>Output: $1.50 / 1M di token<br>Lettura cache: $0.03 / 1M di token |



**RIFERIMENTO API**

## Specifiche dell'endpoint

| Field | Value |
|---|---|
| Endpoint | `POST /v1/chat/completions` |
| ID modello | `gemini-3.1-flash-lite` |
| Tipi di attività | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Parametri della richiesta

Nessun parametro della richiesta è pubblicato per questo endpoint.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analizza questa codebase e suggerisci tre miglioramenti delle prestazioni con esempi prima/dopo."
    }
  ]
}
```

### Quickstart — gemini-3.1-flash-lite

Stessa struttura · variante fissata nel model

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-3.1-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Usa l'SDK OpenAI / Anthropic / Google Gen AI con la tua API key RunAPI e `model: "gemini-3.1-flash-lite"`.

### Usa gemini-3.1-flash-lite in quattro passaggi

1. **Installa** — Installa il model skill della linea Gemini. Carica documentazione, formati di richiesta e note sui prezzi nel tuo spazio di lavoro di sviluppo.
2. **Configura** — Punta l'SDK a https://runapi.ai e imposta la tua API key RunAPI. La stessa chiave vale per tutti i modelli e fornitori.
3. **Richiama** — Invia una richiesta in un formato API supportato da questo modello, con il campo model impostato sull'ID modello di questa pagina. RunAPI la inoltra al fornitore.
4. **Ricevi** — Leggi la risposta dalla stessa chiamata, oppure ricevila in streaming man mano che viene generata. Il campo usage mostra i token che ti vengono addebitati.

### Cosa cambia in gemini-3.1-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 3.1 Flash-Lite; contesto 1M, thinking regolabile; richieste di testo con Chat Completions compatibile OpenAI** — Ottimizzato per velocità/costi; contesto da 1M; riferimento della generazione precedente
- **VS GEMINI-2.5-FLASH-LITE: Gemini 3.1 Flash-Lite; contesto 1M, thinking regolabile; richieste di testo con Chat Completions compatibile OpenAI** — Gemini 2.5 Flash-Lite; contesto 1M, thinking disattivato per impostazione predefinita; Chat Completions compatibile OpenAI
- **VS GEMINI-2.5-PRO: Gemini 3.1 Flash-Lite; contesto 1M, thinking regolabile; richieste di testo con Chat Completions compatibile OpenAI** — Miglior ragionamento della generazione 2.5; contesto da 1M

## CASI D'USO

**Customer support**

Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.

**Analisi documentale**

Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.

**Generazione di codice**

Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.



## Domande frequenti su Gemini 3.1 Flash-Lite

### Meglio Gemini 3.1 Flash-Lite o Gemini 3.5 Flash-Lite?

Google indica Gemini 3.5 Flash-Lite come sostituto di 3.1 Flash-Lite. Avvia i nuovi progetti con gemini-3.5-flash-lite e scegli gemini-3.1-flash-lite quando un carico, un set di prompt o una valutazione esistenti sono stati costruiti su di esso. Entrambi i modelli sono su RunAPI con la stessa chiave API.

### Per quanto tempo sarà disponibile Gemini 3.1 Flash-Lite?

Google indica il 7 maggio 2027 come data di spegnimento più vicina per gemini-3.1-flash-lite. Il modello preview è stato spento a maggio 2026, quindi usa l'ID del modello stabile.

### Posso chiamare Gemini 3.1 Flash-Lite con l'SDK OpenAI?

Sì. Punta l'SDK OpenAI su https://runapi.ai/v1 con la tua chiave API RunAPI e invia richieste Chat Completions con model impostato su gemini-3.1-flash-lite. I tool usano il formato standard di OpenAI.

### Posso inviare immagini o audio a gemini-3.1-flash-lite su RunAPI?

Non ancora. Il modello di Google legge immagini, video, audio e PDF, ma RunAPI accetta solo input testuale per gemini-3.1-flash-lite, e le richieste con parti multimediali vengono rifiutate.

### Come seleziono gemini-3.1-flash-lite?

Passa l'ID del modello mostrato nel quickstart.

### Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

### Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

### Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

### Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.


### RELATED

- [gemini-2.5-flash-lite](https://runapi.ai/it/models/gemini/2.5-flash-lite.md) — di Google · Input $0.10 / 1M di token | Output $0.40 / 1M di token
- [gemini-3.5-flash-lite](https://runapi.ai/it/models/gemini/3.5-flash-lite.md) — di Google · Input $0.15 / 1M di token | Output $1.25 / 1M di token
- [gemini-2.5-flash](https://runapi.ai/it/models/gemini/2.5-flash.md) — di Google · Input $0.30 / 1M di token | Output $2.50 / 1M di token
- [gemini-3-flash-preview](https://runapi.ai/it/models/gemini/3-flash-preview.md) — di Google · Input $0.50 / 1M di token | Output $3.00 / 1M di token · Input $0.30 / 1M di token | Output $1.80 / 1M di token

### Inizia a costruire con Gemini.

- [Crea un account gratuito](https://runapi.ai/it/login)
- [Leggi la guida rapida →](https://runapi.ai/it/docs/api/openai/chat-completions)
## Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

[Contattaci](https://runapi.ai/it/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/it/.md)
### Prodotto
- [Catalogo dei modelli](https://runapi.ai/it/models.md)
- [Prezzi](https://runapi.ai/it/pricing.md)
- [Fornitori](https://runapi.ai/it/models#all-models)
### Sviluppatori
- [Documentazione](https://runapi.ai/it/docs/guides)
- [SDK](https://runapi.ai/it/sdk.md)
- [CLI](https://runapi.ai/it/cli.md)
- [MCP Server](https://runapi.ai/it/mcp.md)
- [x402](https://runapi.ai/it/x402.md)
### Guide
- [Claude Code vs Cursor](https://runapi.ai/it/claude-code-vs-cursor.md)
- [Configurazione Cursor API](https://runapi.ai/it/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/it/openrouter-alternative.md)
### Azienda
- [Enterprise](https://runapi.ai/it/contact.md)
- [Contatti](https://runapi.ai/it/contact.md)
### Legale
- [Termini](https://runapi.ai/it/terms.md)
- [Privacy](https://runapi.ai/it/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/it",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/it/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/it",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/iticon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-3.1-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/it"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/it/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/it/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-3.1-flash-lite",
        "item": "https://runapi.ai/it/models/gemini/3.1-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "HowTo",
    "name": "Usa gemini-3.1-flash-lite in quattro passaggi",
    "description": "Richiama gemini-3.1-flash-lite della famiglia Gemini tramite RunAPI: prezzi per token, ID modello, formati API supportati e guida alla configurazione.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Installa",
        "text": "Installa il model skill della linea Gemini. Carica documentazione, formati di richiesta e note sui prezzi nel tuo spazio di lavoro di sviluppo.",
        "url": "https://runapi.ai/it/models/gemini/3.1-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Configura",
        "text": "Punta l'SDK a https://runapi.ai e imposta la tua API key RunAPI. La stessa chiave vale per tutti i modelli e fornitori.",
        "url": "https://runapi.ai/it/models/gemini/3.1-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Richiama",
        "text": "Invia una richiesta in un formato API supportato da questo modello, con il campo model impostato sull'ID modello di questa pagina. RunAPI la inoltra al fornitore.",
        "url": "https://runapi.ai/it/models/gemini/3.1-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Ricevi",
        "text": "Leggi la risposta dalla stessa chiamata, oppure ricevila in streaming man mano che viene generata. Il campo usage mostra i token che ti vengono addebitati.",
        "url": "https://runapi.ai/it/models/gemini/3.1-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "it",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Meglio Gemini 3.1 Flash-Lite o Gemini 3.5 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google indica Gemini 3.5 Flash-Lite come sostituto di 3.1 Flash-Lite. Avvia i nuovi progetti con gemini-3.5-flash-lite e scegli gemini-3.1-flash-lite quando un carico, un set di prompt o una valutazione esistenti sono stati costruiti su di esso. Entrambi i modelli sono su RunAPI con la stessa chiave API."
        }
      },
      {
        "@type": "Question",
        "name": "Per quanto tempo sarà disponibile Gemini 3.1 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google indica il 7 maggio 2027 come data di spegnimento più vicina per gemini-3.1-flash-lite. Il modello preview è stato spento a maggio 2026, quindi usa l'ID del modello stabile."
        }
      },
      {
        "@type": "Question",
        "name": "Posso chiamare Gemini 3.1 Flash-Lite con l'SDK OpenAI?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sì. Punta l'SDK OpenAI su https://runapi.ai/v1 con la tua chiave API RunAPI e invia richieste Chat Completions con model impostato su gemini-3.1-flash-lite. I tool usano il formato standard di OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "Posso inviare immagini o audio a gemini-3.1-flash-lite su RunAPI?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Non ancora. Il modello di Google legge immagini, video, audio e PDF, ma RunAPI accetta solo input testuale per gemini-3.1-flash-lite, e le richieste con parti multimediali vengono rifiutate."
        }
      },
      {
        "@type": "Question",
        "name": "Come seleziono gemini-3.1-flash-lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Passa l'ID del modello mostrato nel quickstart."
        }
      },
      {
        "@type": "Question",
        "name": "Qual è il rate limit di questa variante?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali."
        }
      },
      {
        "@type": "Question",
        "name": "Posso cambiare variante in seguito?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sì — la variante è un flag. Puoi cambiarla modificando il parametro model."
        }
      },
      {
        "@type": "Question",
        "name": "Fa streaming?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end."
        }
      },
      {
        "@type": "Question",
        "name": "Dove posso segnalare problemi di qualità?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza."
        }
      }
    ]
  }
]
```
