Lettura dalla cache
Sconto del 90% sui token di input. Una lettura dalla cache di Sonnet 4.6 costa $0.30/M invece di $3.00/M tramite RunAPI.
Anthropic addebita $3–$15 per milione di token a seconda del modello. RunAPI ti offre ogni modello Claude a metà della tariffa ufficiale — stessa API, stesso output, 50% di sconto sulla tua fattura.
Anthropic fattura in tre fasce di modelli: Haiku per attività leggere, Sonnet per carichi di lavoro quotidiani e Opus per la massima capacità. Tutti i prezzi sotto sono per milione di token. Un milione di token corrisponde a circa 750.000 parole — l'uso del contesto si accumula più velocemente di quanto la maggior parte delle persone si aspetti.
Haiku 4.5 a $1/M di input e $5/M di output tramite RunAPI. Tariffa ufficiale $2/$10.
Sonnet 4.6 a $3/M di input e $15/M di output tramite RunAPI. Tariffa ufficiale $6/$30.
Opus 4.7 a $5/M di input e $25/M di output tramite RunAPI. Tariffa ufficiale $10/$50.
Le letture dalla cache costano il 90% in meno dei token di input standard — $0.10/M per Haiku tramite RunAPI. Se invii lo stesso prompt di sistema a ogni richiesta, la cache può ridurre drasticamente la tua fattura.
La tabella seguente mostra i prezzi ufficiali Anthropic accanto ai prezzi RunAPI. RunAPI applica uno sconto fisso del 50% su tutti i modelli Claude. Nessun impegno di volume, nessun abbonamento.
| Modello | Input ufficiale /M | Output ufficiale /M | Input RunAPI /M | Output RunAPI /M | Finestra di contesto |
|---|---|---|---|---|---|
| Opus 4.8 | $15.00 | $75.00 | $7.50 | $37.50 | 200K |
| Opus 4.7 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Opus 4.6 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Sonnet 4.6 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Sonnet 4.5 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Haiku 4.5 | $2.00 | $10.00 | $1.00 | $5.00 | 200K |
Il caching dei prompt di Anthropic memorizza i prefissi ripetuti e applica tariffe ridotte quando la versione in cache viene riutilizzata. Questo è rilevante per gli agenti di programmazione come Claude Code, che inviano lo stesso system prompt e il contesto dei file a ogni richiesta.
Sconto del 90% sui token di input. Una lettura dalla cache di Sonnet 4.6 costa $0.30/M invece di $3.00/M tramite RunAPI.
Sovrapprezzo del 25% sull'input — $3.75/M per Sonnet 4.6 tramite RunAPI. Il prefisso in cache rimane disponibile per 5 minuti.
Il doppio della tariffa di input — $6.00/M per Sonnet 4.6 tramite RunAPI. Utile per sessioni di programmazione prolungate in cui il riutilizzo del contesto è frequente.
Anthropic offre uno sconto del 50% su tutti i modelli per le richieste batch che tollerano un'evasione fino a 24 ore. RunAPI trasferisce questo sconto agli utenti.
I costi dei token sembrano astratti finché non li colleghi ad attività reali. Di seguito ci sono cinque carichi di lavoro comuni per sviluppatori con costi mensili stimati a due livelli di utilizzo. Nota che i token di input — il tuo prompt di sistema, la cronologia della conversazione, i file che alleghi — spesso costano più dei token di output per flussi di lavoro con molto contesto.
| Carico di lavoro | Modello | Uso leggero (~50 attività/giorno) | Uso intensivo (~200 attività/giorno) | Risparmio mensile vs ufficiale |
|---|---|---|---|---|
| Sessione di vibe coding (Claude Code) | Sonnet 4.6 | $45/mese | $180/mese | $45–$180 |
| Agente di revisione PR | Opus 4.7 | $75/mese | $300/mese | $75–$300 |
| Chatbot docs basato su RAG | Haiku 4.5 | $12/mese | $48/mese | $12–$48 |
| Pipeline di generazione contenuti | Sonnet 4.6 | $30/mese | $120/mese | $30–$120 |
| Orchestratore multi-agente | Opus 4.7 | $150/mese | $600/mese | $150–$600 |
Gli sviluppatori che raggiungono i limiti di Claude spesso guardano a GPT-5 e Gemini 2.5 Pro come alternative. Ecco come si confrontano i modelli di punta sui costi effettivi per milione di token.
| Provider | Modello di punta | Input /M | Output /M | Tariffa RunAPI |
|---|---|---|---|---|
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI applica uno sconto del 50% su tutti i provider elencati. Prezzi verificati a giugno 2026.
Claude Max costa $100/month per un uso intenso di Claude Code (o $200 per il piano 5x). L'API addebita per token senza impegno mensile. Una cosa che l'abbonamento non ti dice: il piano Pro ha sia un limite giornaliero SIA un tetto settimanale, quindi se lo usi intensamente ogni giorno, puoi esaurirlo a metà settimana e aspettare 3 giorni per un reset. L'API non ha un tetto del genere. Per gli sviluppatori che usano meno di 10 milioni di token di output al mese su Sonnet 4.6, la strada RunAPI costa meno dell'abbonamento Max.
Uso illimitato di Sonnet e Opus limitato in Claude Code. Costo mensile fisso. Nessun accesso API per strumenti di terze parti.
Paga per token senza impegno mensile. Sonnet 4.6 a $3/M di input e $15/M di output. $100 compra circa 6,7 milioni di token di output — sufficiente per la maggior parte degli sviluppatori individuali.
Utenti intensivi giornalieri che superano costantemente 10 milioni di token di output al mese. Il punto di pareggio su Sonnet 4.6 tramite RunAPI è circa 6,7 milioni di token di output.
Team, pipeline CI, configurazioni multi-modello e qualsiasi strumento che richieda accesso API (OpenClaw, n8n, Cursor). Nessun limite, nessuna lista d'attesa, nessun vincolo di abbonamento. Puoi anche instradare le attività più semplici verso Haiku 4.5 — è circa 20x più economico per token rispetto a Sonnet per le attività che non richiedono piena capacità.
Registrati su runapi.ai. Nessuna carta di credito richiesta per il piano gratuito.
Vai su Dashboard → API Keys. Crea una chiave e salvala — la userai come API key OpenAI.
Imposta l'URL base su https://runapi.ai/v1 e usa la tua API key RunAPI. Funziona qualsiasi client compatibile con OpenAI — Python, Node.js, Go, Ruby o curl.
Usa claude-sonnet-4-6, claude-opus-4-7 o qualsiasi ID modello Claude nel parametro model. RunAPI gestisce il routing e la fatturazione al 50% della tariffa ufficiale.
Questo accade perché le finestre di contesto ampie — il tuo prompt di sistema, la cronologia della conversazione, i file allegati — dominano il costo dei token. Una domanda con un contesto grande può consumare il 20% della tua finestra di 5 ore. L'API ti permette di controllare esattamente quale contesto invii a ogni richiesta, così smetti di pagare per contesto che non ti serve.
Usare strumenti di terze parti come OpenClaw, n8n o Cursor con un abbonamento personale a Claude può far bannare il tuo account. I termini di Anthropic non consentono ai piani in abbonamento di alimentare app esterne. L'API è l'unico percorso supportato — e RunAPI lo rende pay-as-you-go senza impegno mensile.
Sì. Imposta ANTHROPIC_BASE_URL su https://runapi.ai e la tua chiave RunAPI come chiave API. Claude Code funziona senza alcuna altra modifica. Paghi per token al 50% della tariffa ufficiale — nessun abbonamento richiesto.
RunAPI si adegua entro 24 ore. Lo sconto del 50% viene mantenuto rispetto alle tariffe pubblicate da Anthropic.
Sì. I nuovi account ricevono crediti gratuiti per testare qualsiasi modello. Dopodiché, la fatturazione è rigorosamente a consumo senza minimi.
Sì. Le letture dalla cache, le scritture di 5 minuti e le scritture di 1 ora sono tutte supportate al 50% dei prezzi della cache di Anthropic. Se invii lo stesso prompt di sistema grande a ogni richiesta, le letture dalla cache riducono quel costo di input del 90% — da $3.00/M a $0.30/M su Sonnet 4.6.
Sì. RunAPI è compatibile con OpenAI. Punta qualsiasi client OpenAI a runapi.ai/v1 e usa gli ID modello di Claude. Se stai già chiamando Claude da OpenRouter o da un gateway simile, passare a RunAPI funziona allo stesso modo — cambi un URL e una chiave API.
Pay-as-you-go. Finanzi il tuo account con un saldo e ogni chiamata API detrae il costo dei token. Niente abbonamenti, niente fatture, niente contratti. Puoi anche impostare un limite di spesa rigido nella tua dashboard RunAPI così non ricevi mai una fattura a sorpresa — a differenza della fatturazione diretta di Anthropic, che ha colto gli utenti alla sprovvista.
Prezzi di GPT-5.4, GPT-5.4-mini e o3: RunAPI vs tariffe ufficiali.
Prezzi Gemini 2.5 Pro e Flash — il modello flagship più economico.
Confronto costi Claude Code: fatturazione API vs abbonamento Max.
Confronta i prezzi di 220+ modelli tra testo, immagini, video e audio.
Crea un account RunAPI gratuito, ottieni la tua API key e inizia a chiamare Claude Opus, Sonnet o Haiku con il 50% di sconto rispetto ai prezzi ufficiali Anthropic.