Prezzi API LLM

Prezzi API Claude nel 2026

Anthropic addebita $3–$15 per milione di token a seconda del modello. RunAPI ti offre ogni modello Claude a metà della tariffa ufficiale — stessa API, stesso output, 50% di sconto sulla tua fattura.

Aggiornato il June 18, 2026 RunAPI Editorial
In sintesi

Quanto costa l'API Claude adesso?

Anthropic fattura in tre fasce di modelli: Haiku per attività leggere, Sonnet per carichi di lavoro quotidiani e Opus per la massima capacità. Tutti i prezzi sotto sono per milione di token. Un milione di token corrisponde a circa 750.000 parole — l'uso del contesto si accumula più velocemente di quanto la maggior parte delle persone si aspetti.

Opzione più economica

Haiku 4.5 a $1/M di input e $5/M di output tramite RunAPI. Tariffa ufficiale $2/$10.

Il più popolare

Sonnet 4.6 a $3/M di input e $15/M di output tramite RunAPI. Tariffa ufficiale $6/$30.

Massima capacità

Opus 4.7 a $5/M di input e $25/M di output tramite RunAPI. Tariffa ufficiale $10/$50.

Sconto cache

Le letture dalla cache costano il 90% in meno dei token di input standard — $0.10/M per Haiku tramite RunAPI. Se invii lo stesso prompt di sistema a ogni richiesta, la cache può ridurre drasticamente la tua fattura.

Analisi modello per modello

Quanto costa ogni modello Claude per milione di token?

La tabella seguente mostra i prezzi ufficiali Anthropic accanto ai prezzi RunAPI. RunAPI applica uno sconto fisso del 50% su tutti i modelli Claude. Nessun impegno di volume, nessun abbonamento.

Modello Input ufficiale /M Output ufficiale /M Input RunAPI /M Output RunAPI /M Finestra di contesto
Opus 4.8 $15.00 $75.00 $7.50 $37.50 200K
Opus 4.7 $10.00 $50.00 $5.00 $25.00 200K
Opus 4.6 $10.00 $50.00 $5.00 $25.00 200K
Sonnet 4.6 $6.00 $30.00 $3.00 $15.00 200K
Sonnet 4.5 $6.00 $30.00 $3.00 $15.00 200K
Haiku 4.5 $2.00 $10.00 $1.00 $5.00 200K
Caching dei prompt

Come gli sconti sulla cache riducono la tua fattura dell'API Claude?

Il caching dei prompt di Anthropic memorizza i prefissi ripetuti e applica tariffe ridotte quando la versione in cache viene riutilizzata. Questo è rilevante per gli agenti di programmazione come Claude Code, che inviano lo stesso system prompt e il contesto dei file a ogni richiesta.

Lettura dalla cache

Sconto del 90% sui token di input. Una lettura dalla cache di Sonnet 4.6 costa $0.30/M invece di $3.00/M tramite RunAPI.

Scrittura in cache (TTL 5 min)

Sovrapprezzo del 25% sull'input — $3.75/M per Sonnet 4.6 tramite RunAPI. Il prefisso in cache rimane disponibile per 5 minuti.

Scrittura in cache (TTL 1 ora)

Il doppio della tariffa di input — $6.00/M per Sonnet 4.6 tramite RunAPI. Utile per sessioni di programmazione prolungate in cui il riutilizzo del contesto è frequente.

Elaborazione batch

Anthropic offre uno sconto del 50% su tutti i modelli per le richieste batch che tollerano un'evasione fino a 24 ore. RunAPI trasferisce questo sconto agli utenti.

Costi nel mondo reale

Quanto costa davvero l'API Claude per carichi di lavoro reali?

I costi dei token sembrano astratti finché non li colleghi ad attività reali. Di seguito ci sono cinque carichi di lavoro comuni per sviluppatori con costi mensili stimati a due livelli di utilizzo. Nota che i token di input — il tuo prompt di sistema, la cronologia della conversazione, i file che alleghi — spesso costano più dei token di output per flussi di lavoro con molto contesto.

Carico di lavoro Modello Uso leggero (~50 attività/giorno) Uso intensivo (~200 attività/giorno) Risparmio mensile vs ufficiale
Sessione di vibe coding (Claude Code) Sonnet 4.6 $45/mese $180/mese $45–$180
Agente di revisione PR Opus 4.7 $75/mese $300/mese $75–$300
Chatbot docs basato su RAG Haiku 4.5 $12/mese $48/mese $12–$48
Pipeline di generazione contenuti Sonnet 4.6 $30/mese $120/mese $30–$120
Orchestratore multi-agente Opus 4.7 $150/mese $600/mese $150–$600
Confronto tra provider

L'API Claude costa meno di OpenAI e Gemini?

Gli sviluppatori che raggiungono i limiti di Claude spesso guardano a GPT-5 e Gemini 2.5 Pro come alternative. Ecco come si confrontano i modelli di punta sui costi effettivi per milione di token.

Provider Modello di punta Input /M Output /M Tariffa RunAPI
Anthropic Claude Opus 4.7 $10.00 $50.00 $5.00 / $25.00
OpenAI GPT-5.4 $2.50 $15.00 $1.25 / $7.50
Google Gemini 2.5 Pro $1.25 $10.00 $0.63 / $5.00

RunAPI applica uno sconto del 50% su tutti i provider elencati. Prezzi verificati a giugno 2026.

Abbonamento vs API

L'API Claude costa meno di un abbonamento Claude Max?

Claude Max costa $100/month per un uso intenso di Claude Code (o $200 per il piano 5x). L'API addebita per token senza impegno mensile. Una cosa che l'abbonamento non ti dice: il piano Pro ha sia un limite giornaliero SIA un tetto settimanale, quindi se lo usi intensamente ogni giorno, puoi esaurirlo a metà settimana e aspettare 3 giorni per un reset. L'API non ha un tetto del genere. Per gli sviluppatori che usano meno di 10 milioni di token di output al mese su Sonnet 4.6, la strada RunAPI costa meno dell'abbonamento Max.

Claude Max ($100/mese)

Uso illimitato di Sonnet e Opus limitato in Claude Code. Costo mensile fisso. Nessun accesso API per strumenti di terze parti.

API Claude tramite RunAPI

Paga per token senza impegno mensile. Sonnet 4.6 a $3/M di input e $15/M di output. $100 compra circa 6,7 milioni di token di output — sufficiente per la maggior parte degli sviluppatori individuali.

Quando conviene Max

Utenti intensivi giornalieri che superano costantemente 10 milioni di token di output al mese. Il punto di pareggio su Sonnet 4.6 tramite RunAPI è circa 6,7 milioni di token di output.

Quando conviene l'API

Team, pipeline CI, configurazioni multi-modello e qualsiasi strumento che richieda accesso API (OpenClaw, n8n, Cursor). Nessun limite, nessuna lista d'attesa, nessun vincolo di abbonamento. Puoi anche instradare le attività più semplici verso Haiku 4.5 — è circa 20x più economico per token rispetto a Sonnet per le attività che non richiedono piena capacità.

Per iniziare

Come accedere all'API Claude tramite RunAPI

1

Crea un account RunAPI

Registrati su runapi.ai. Nessuna carta di credito richiesta per il piano gratuito.

2

Copia la tua API key

Vai su Dashboard → API Keys. Crea una chiave e salvala — la userai come API key OpenAI.

3

Punta il tuo SDK su RunAPI

Imposta l'URL base su https://runapi.ai/v1 e usa la tua API key RunAPI. Funziona qualsiasi client compatibile con OpenAI — Python, Node.js, Go, Ruby o curl.

4

Inizia a fare richieste

Usa claude-sonnet-4-6, claude-opus-4-7 o qualsiasi ID modello Claude nel parametro model. RunAPI gestisce il routing e la fatturazione al 50% della tariffa ufficiale.

Domande frequenti

Domande frequenti sui prezzi dell'API Claude

Ho fatto 1 domanda e ho usato il 20% del mio utilizzo di 5 ore. Cosa sta succedendo?

Questo accade perché le finestre di contesto ampie — il tuo prompt di sistema, la cronologia della conversazione, i file allegati — dominano il costo dei token. Una domanda con un contesto grande può consumare il 20% della tua finestra di 5 ore. L'API ti permette di controllare esattamente quale contesto invii a ogni richiesta, così smetti di pagare per contesto che non ti serve.

RunAPI modifica l'output di Claude?

Usare strumenti di terze parti come OpenClaw, n8n o Cursor con un abbonamento personale a Claude può far bannare il tuo account. I termini di Anthropic non consentono ai piani in abbonamento di alimentare app esterne. L'API è l'unico percorso supportato — e RunAPI lo rende pay-as-you-go senza impegno mensile.

Posso usare RunAPI con Claude Code?

Sì. Imposta ANTHROPIC_BASE_URL su https://runapi.ai e la tua chiave RunAPI come chiave API. Claude Code funziona senza alcuna altra modifica. Paghi per token al 50% della tariffa ufficiale — nessun abbonamento richiesto.

Cosa succede se Anthropic modifica i propri prezzi?

RunAPI si adegua entro 24 ore. Lo sconto del 50% viene mantenuto rispetto alle tariffe pubblicate da Anthropic.

È disponibile un piano gratuito?

Sì. I nuovi account ricevono crediti gratuiti per testare qualsiasi modello. Dopodiché, la fatturazione è rigorosamente a consumo senza minimi.

RunAPI supporta il caching dei prompt?

Sì. Le letture dalla cache, le scritture di 5 minuti e le scritture di 1 ora sono tutte supportate al 50% dei prezzi della cache di Anthropic. Se invii lo stesso prompt di sistema grande a ogni richiesta, le letture dalla cache riducono quel costo di input del 90% — da $3.00/M a $0.30/M su Sonnet 4.6.

Posso usare l'SDK OpenAI per chiamare Claude tramite RunAPI?

Sì. RunAPI è compatibile con OpenAI. Punta qualsiasi client OpenAI a runapi.ai/v1 e usa gli ID modello di Claude. Se stai già chiamando Claude da OpenRouter o da un gateway simile, passare a RunAPI funziona allo stesso modo — cambi un URL e una chiave API.

Come funziona la fatturazione?

Pay-as-you-go. Finanzi il tuo account con un saldo e ogni chiamata API detrae il costo dei token. Niente abbonamenti, niente fatture, niente contratti. Puoi anche impostare un limite di spesa rigido nella tua dashboard RunAPI così non ricevi mai una fattura a sorpresa — a differenza della fatturazione diretta di Anthropic, che ha colto gli utenti alla sprovvista.

CORRELATI

Esplora altro

Inizia a usare Claude a metà prezzo.

Crea un account RunAPI gratuito, ottieni la tua API key e inizia a chiamare Claude Opus, Sonnet o Haiku con il 50% di sconto rispetto ai prezzi ufficiali Anthropic.