# Prezzi API Gemini nel 2026

Google addebita $1.25–$10 per milione di token per Gemini 2.5 Pro e molto meno per Flash. Il livello gratuito ti dà circa 20 richieste al minuto prima di raggiungere il limite. RunAPI replica ogni modello Gemini a metà della tariffa ufficiale — incolla la tua chiave direttamente in qualsiasi client compatibile con OpenAI.

*Updated June 18, 2026 · RunAPI Editorial*

## Quanto costa attualmente l'API Gemini?

Google pubblica prezzi per token per due livelli principali: Flash per attività veloci ed economiche e Pro per la massima capacità. Esiste anche un livello gratuito con limiti giornalieri di richieste — utile per i test, ma gli agenti AI e gli strumenti di coding possono consumarlo rapidamente. Tutti i prezzi sotto sono per milione di token, l'unità di fatturazione usata da Google.

- **Opzione più economica**: Gemini 2.5 Flash a $0,08/M in input e $0,30/M in output tramite RunAPI. La tariffa ufficiale è $0,15/$0,60.
- **Capacità massima**: Gemini 2.5 Pro a $0,63/M in input e $5,00/M in output tramite RunAPI. La tariffa ufficiale è $1,25/$10.
- **Livello gratuito**: Il livello gratuito di Google ti dà circa 20 richieste al minuto e 500 richieste al giorno su Flash — abbastanza per creare prototipi, ma puoi esaurirlo in poche ore con un agente AI.
- **Principale più economico**: Gemini 2.5 Pro è più economico di Claude Sonnet e GPT-5.4 sul prezzo di input, rendendolo il principale più economico dei tre grandi.

## Quanto costa ogni modello Gemini per milione di token?

La tabella seguente mostra i prezzi ufficiali di Google a confronto con i prezzi di RunAPI. RunAPI applica uno sconto fisso del 50% su tutti i modelli Gemini. Nessun impegno di volume, nessun abbonamento.

| Modello | Input ufficiale /M | Output ufficiale /M | Input RunAPI /M | Output RunAPI /M | Finestra di contesto |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |

## Come funziona il livello gratuito di Gemini di Google?

Google offre un livello gratuito così puoi creare prototipi prima di pagare. Il livello gratuito limita le richieste a circa 20 al minuto e 500 al giorno su Gemini 2.5 Flash. Quando raggiungi il limite, ricevi un errore — non ti viene addebitato nulla automaticamente. Il livello gratuito è disponibile solo in alcuni paesi; se l'endpoint gratuito non è disponibile nella tua regione, l'API a pagamento o RunAPI è il passo successivo.

### Limite giornaliero di richieste

Fino a 500 richieste al giorno su Gemini 2.5 Flash tramite il livello gratuito. Sufficiente per prototipi e progetti secondari a basso volume, ma gli agenti AI e gli strumenti di coding possono esaurirlo in poche ore.

### Limiti di frequenza

Il livello gratuito limita le richieste a circa 20 al minuto. Qualsiasi picco di traffico — come l'esecuzione di un agente AI — raggiungerà rapidamente questo limite e inizierà a restituire errori.

### Termini di utilizzo dei dati

Gli input del livello gratuito potrebbero essere usati per migliorare i prodotti Google. Il traffico del livello a pagamento e RunAPI non viene usato per il training, il che è importante per i dati sensibili.

### Quando aggiornare

Passa al livello a pagamento o a RunAPI una volta che hai bisogno di throughput costante, limiti di frequenza più alti o gestione dei dati più solida. RunAPI addebita il 50% della tariffa ufficiale a pagamento senza limite giornaliero.


## Gemini è più economico di Claude e GPT?

Gli sviluppatori spesso confrontano Gemini con Claude Sonnet e GPT-5.4. Ecco come i modelli principali si confrontano su base per milione di token tramite RunAPI.

| Provider | Modello principale | Input /M | Output /M | Tariffa RunAPI |
|---|---|---|---|---|
| Google | Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |

## Quanto costa effettivamente l'API Gemini per workload reali?

I costi per token sembrano astratti finché non li colleghi a compiti reali. Di seguito ci sono cinque workload comuni per sviluppatori con costi mensili stimati a due livelli di utilizzo tramite RunAPI.

| Workload | Modello | Uso leggero (~50 attività/giorno) | Uso intenso (~200 attività/giorno) | Risparmio mensile vs ufficiale |
|---|---|---|---|---|
| Analisi documenti con contesto lungo | Gemini 2.5 Pro | $18/mese | $72/mese | $18–$72 |
| Classificazione ad alto volume | Gemini 2.5 Flash | $3/mese | $12/mese | $3–$12 |
| Chatbot docs con RAG | Gemini 2.5 Flash | $5/mese | $20/mese | $5–$20 |
| Pipeline di generazione contenuti | Gemini 2.5 Pro | $15/mese | $60/mese | $15–$60 |
| Orchestratore multi-agente | Gemini 2.5 Pro | $60/mese | $240/mese | $60–$240 |

## Come usare l'API Gemini tramite RunAPI

1. **Crea un account RunAPI** — Registrati su runapi.ai. Nessuna carta di credito richiesta per il livello gratuito.
2. **Copia la tua chiave API** — Vai su Dashboard → Chiavi API. Crea una chiave e salvala — la userai come chiave API OpenAI.
3. **Punta il tuo SDK su RunAPI** — Imposta l'URL base su https://runapi.ai/v1 e usa la tua chiave API RunAPI. Qualsiasi client compatibile con OpenAI funziona — Python, Node.js, Go, Ruby o curl.
4. **Inizia a fare richieste** — Usa gemini-2.5-pro, gemini-2.5-flash o qualsiasi ID modello Gemini nel parametro model. RunAPI gestisce il routing e la fatturazione al 50% del prezzo ufficiale.

## FAQ sui prezzi dell'API Gemini

### Quanto costa l'API Gemini?

Il prezzo ufficiale di Google per Gemini 2.5 Pro è $1,25/M in input e $10/M in output. Gemini 2.5 Flash è $0,15/M in input e $0,60/M in output. Tramite RunAPI ogni modello Gemini è alla metà di quella tariffa, senza abbonamento né impegno di volume. Paghi solo per i token usati da ogni richiesta.

### Gemini è più economico di Claude e GPT?

Sul prezzo di input, sì. Gemini 2.5 Pro a $1,25/M in input è più economico di GPT-5.4 ($2,50) e Claude Sonnet ($6) alla tariffa ufficiale, rendendolo il principale più economico dei tre grandi. RunAPI dimezza tutti e tre, quindi il divario rimane.

### Quali sono i rate limit del piano gratuito e cosa succede quando li raggiungo?

Il piano gratuito ti limita a circa 20 richieste al minuto e 500 richieste al giorno su Gemini 2.5 Flash. Quando raggiungi il limite, le richieste restituiscono un errore: non ti viene addebitato nulla automaticamente. Gli input del piano gratuito possono essere usati per migliorare i prodotti Google, quindi evita dati sensibili. Quando ti serve una capacità costante, passa al piano a pagamento.

### Perché RunAPI è il 50% più economico dell'API ufficiale?

RunAPI negozia prezzi a volume con i fornitori di modelli e trasferisce i risparmi agli sviluppatori. Non c'è alcuna differenza di qualità — stessi modelli, stessa API compatibile con OpenAI, stesso output. Cambi solo l'URL base e la chiave, e il codice client esistente continua a funzionare senza modifiche.

### Posso usare Gemini con OpenAI SDK?

Sì. RunAPI è compatibile con OpenAI. Punta qualsiasi client OpenAI su runapi.ai/v1 e usa gli ID modello Gemini come gemini-2.5-pro. Il codice esistente con OpenAI SDK funziona senza modifiche oltre all'URL base e alla chiave.

### Perché Gemini è adatto per attività con contesto lungo?

Gemini 2.5 Pro e Flash offrono entrambi una finestra di contesto da 1M di token, più grande della maggior parte dei modelli Claude e GPT. Combinato con prezzi di input bassi, questo rende Gemini conveniente per analizzare documenti lunghi, codebase grandi o molti file contemporaneamente.

### Continuo a esaurire i limiti del livello gratuito. Quali sono le mie opzioni?

RunAPI ti dà una sola chiave API che funziona con Gemini, Claude e GPT — nessuna configurazione di progetto Google Cloud, nessun account di fatturazione da gestire. Se hai raggiunto i limiti del livello gratuito o hai scoperto che neanche una chiave API gratuita funziona nella tua regione, l'accesso a pagamento di RunAPI è disponibile globalmente al 50% delle tariffe ufficiali.

### Come funziona la fatturazione?

Pagamento a consumo. Finanzi il tuo account con un saldo e ogni chiamata API deduce il costo dei token alla metà della tariffa ufficiale. Nessun abbonamento, nessuna fattura, nessun contratto. Puoi monitorare la spesa per chiave dalla dashboard RunAPI e impostare avvisi prima che il saldo si esaurisca.

