Limite giornaliero di richieste
Fino a 500 richieste al giorno su Gemini 2.5 Flash tramite il livello gratuito. Sufficiente per prototipi e progetti secondari a basso volume, ma gli agenti AI e gli strumenti di coding possono esaurirlo in poche ore.
Google addebita $1.25–$10 per milione di token per Gemini 2.5 Pro e molto meno per Flash. Il livello gratuito ti dà circa 20 richieste al minuto prima di raggiungere il limite. RunAPI replica ogni modello Gemini a metà della tariffa ufficiale — incolla la tua chiave direttamente in qualsiasi client compatibile con OpenAI.
Google pubblica prezzi per token per due livelli principali: Flash per attività veloci ed economiche e Pro per la massima capacità. Esiste anche un livello gratuito con limiti giornalieri di richieste — utile per i test, ma gli agenti AI e gli strumenti di coding possono consumarlo rapidamente. Tutti i prezzi sotto sono per milione di token, l'unità di fatturazione usata da Google.
Gemini 2.5 Flash a $0,08/M in input e $0,30/M in output tramite RunAPI. La tariffa ufficiale è $0,15/$0,60.
Gemini 2.5 Pro a $0,63/M in input e $5,00/M in output tramite RunAPI. La tariffa ufficiale è $1,25/$10.
Il livello gratuito di Google ti dà circa 20 richieste al minuto e 500 richieste al giorno su Flash — abbastanza per creare prototipi, ma puoi esaurirlo in poche ore con un agente AI.
Gemini 2.5 Pro è più economico di Claude Sonnet e GPT-5.4 sul prezzo di input, rendendolo il principale più economico dei tre grandi.
La tabella seguente mostra i prezzi ufficiali di Google a confronto con i prezzi di RunAPI. RunAPI applica uno sconto fisso del 50% su tutti i modelli Gemini. Nessun impegno di volume, nessun abbonamento.
| Modello | Input ufficiale /M | Output ufficiale /M | Input RunAPI /M | Output RunAPI /M | Finestra di contesto |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |
Google offre un livello gratuito così puoi creare prototipi prima di pagare. Il livello gratuito limita le richieste a circa 20 al minuto e 500 al giorno su Gemini 2.5 Flash. Quando raggiungi il limite, ricevi un errore — non ti viene addebitato nulla automaticamente. Il livello gratuito è disponibile solo in alcuni paesi; se l'endpoint gratuito non è disponibile nella tua regione, l'API a pagamento o RunAPI è il passo successivo.
Fino a 500 richieste al giorno su Gemini 2.5 Flash tramite il livello gratuito. Sufficiente per prototipi e progetti secondari a basso volume, ma gli agenti AI e gli strumenti di coding possono esaurirlo in poche ore.
Il livello gratuito limita le richieste a circa 20 al minuto. Qualsiasi picco di traffico — come l'esecuzione di un agente AI — raggiungerà rapidamente questo limite e inizierà a restituire errori.
Gli input del livello gratuito potrebbero essere usati per migliorare i prodotti Google. Il traffico del livello a pagamento e RunAPI non viene usato per il training, il che è importante per i dati sensibili.
Passa al livello a pagamento o a RunAPI una volta che hai bisogno di throughput costante, limiti di frequenza più alti o gestione dei dati più solida. RunAPI addebita il 50% della tariffa ufficiale a pagamento senza limite giornaliero.
Gli sviluppatori spesso confrontano Gemini con Claude Sonnet e GPT-5.4. Ecco come i modelli principali si confrontano su base per milione di token tramite RunAPI.
| Provider | Modello principale | Input /M | Output /M | Tariffa RunAPI |
|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 | |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |
RunAPI applica uno sconto del 50% su tutti i provider elencati sopra. Gemini 2.5 Pro è il principale più economico sul prezzo di input. Prezzi verificati a giugno 2026.
I costi per token sembrano astratti finché non li colleghi a compiti reali. Di seguito ci sono cinque workload comuni per sviluppatori con costi mensili stimati a due livelli di utilizzo tramite RunAPI.
| Workload | Modello | Uso leggero (~50 attività/giorno) | Uso intenso (~200 attività/giorno) | Risparmio mensile vs ufficiale |
|---|---|---|---|---|
| Analisi documenti con contesto lungo | Gemini 2.5 Pro | $18/mese | $72/mese | $18–$72 |
| Classificazione ad alto volume | Gemini 2.5 Flash | $3/mese | $12/mese | $3–$12 |
| Chatbot docs con RAG | Gemini 2.5 Flash | $5/mese | $20/mese | $5–$20 |
| Pipeline di generazione contenuti | Gemini 2.5 Pro | $15/mese | $60/mese | $15–$60 |
| Orchestratore multi-agente | Gemini 2.5 Pro | $60/mese | $240/mese | $60–$240 |
Registrati su runapi.ai. Nessuna carta di credito richiesta per il livello gratuito.
Vai su Dashboard → Chiavi API. Crea una chiave e salvala — la userai come chiave API OpenAI.
Imposta l'URL base su https://runapi.ai/v1 e usa la tua chiave API RunAPI. Qualsiasi client compatibile con OpenAI funziona — Python, Node.js, Go, Ruby o curl.
Usa gemini-2.5-pro, gemini-2.5-flash o qualsiasi ID modello Gemini nel parametro model. RunAPI gestisce il routing e la fatturazione al 50% del prezzo ufficiale.
Il prezzo ufficiale di Google per Gemini 2.5 Pro è $1,25/M in input e $10/M in output. Gemini 2.5 Flash è $0,15/M in input e $0,60/M in output. Tramite RunAPI ogni modello Gemini è alla metà di quella tariffa, senza abbonamento né impegno di volume. Paghi solo per i token usati da ogni richiesta.
Sul prezzo di input, sì. Gemini 2.5 Pro a $1,25/M in input è più economico di GPT-5.4 ($2,50) e Claude Sonnet ($6) alla tariffa ufficiale, rendendolo il principale più economico dei tre grandi. RunAPI dimezza tutti e tre, quindi il divario rimane.
Il piano gratuito ti limita a circa 20 richieste al minuto e 500 richieste al giorno su Gemini 2.5 Flash. Quando raggiungi il limite, le richieste restituiscono un errore: non ti viene addebitato nulla automaticamente. Gli input del piano gratuito possono essere usati per migliorare i prodotti Google, quindi evita dati sensibili. Quando ti serve una capacità costante, passa al piano a pagamento.
RunAPI negozia prezzi a volume con i fornitori di modelli e trasferisce i risparmi agli sviluppatori. Non c'è alcuna differenza di qualità — stessi modelli, stessa API compatibile con OpenAI, stesso output. Cambi solo l'URL base e la chiave, e il codice client esistente continua a funzionare senza modifiche.
Sì. RunAPI è compatibile con OpenAI. Punta qualsiasi client OpenAI su runapi.ai/v1 e usa gli ID modello Gemini come gemini-2.5-pro. Il codice esistente con OpenAI SDK funziona senza modifiche oltre all'URL base e alla chiave.
Gemini 2.5 Pro e Flash offrono entrambi una finestra di contesto da 1M di token, più grande della maggior parte dei modelli Claude e GPT. Combinato con prezzi di input bassi, questo rende Gemini conveniente per analizzare documenti lunghi, codebase grandi o molti file contemporaneamente.
RunAPI ti dà una sola chiave API che funziona con Gemini, Claude e GPT — nessuna configurazione di progetto Google Cloud, nessun account di fatturazione da gestire. Se hai raggiunto i limiti del livello gratuito o hai scoperto che neanche una chiave API gratuita funziona nella tua regione, l'accesso a pagamento di RunAPI è disponibile globalmente al 50% delle tariffe ufficiali.
Pagamento a consumo. Finanzi il tuo account con un saldo e ogni chiamata API deduce il costo dei token alla metà della tariffa ufficiale. Nessun abbonamento, nessuna fattura, nessun contratto. Puoi monitorare la spesa per chiave dalla dashboard RunAPI e impostare avvisi prima che il saldo si esaurisca.
Claude Opus, Sonnet e Haiku al 50% delle tariffe ufficiali Anthropic.
Prezzi di GPT-5.4, GPT-5.4-mini e o3: RunAPI vs tariffe ufficiali.
Costi Windsurf: crediti propri vs fatturazione API.
Esplora 220+ modelli con prezzi, parametri e esempi di codice.
Crea un account RunAPI gratuito, ottieni la tua chiave API e inizia a chiamare Gemini 2.5 Pro o Flash al 50% rispetto ai prezzi ufficiali di Google — il principale più economico dei tre grandi.