LLM API

API LLM — Compatibile con OpenAI

Accedi a Claude, GPT, Gemini, DeepSeek e Grok tramite un unico endpoint compatibile con OpenAI. /v1/chat/completions, /v1/messages, /v1/responses.

67 modelli sostituzione drop-in di base_url pagamento per token

67
Modelli LLM
15-25%
Sotto il prezzo ufficiale
2 righe
Per migrare

Playground

live
Modello
Messaggio
Refactor this handler to stream partial results and return a typed error on timeout.
Token massimi
integer | null
Temperatura
number | null
Stream
false
Endpoint
/v1/chat/completions
Costo stimato
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Esempi

Confronto Multi-Modello

Prompt Spiega il calcolo quantistico in una frase

Claude/claude-fable-5

Chiama Claude/claude-fable-5 tramite /v1/messages.
Mantieni la stessa chiave RunAPI e la stessa struttura della richiesta mentre confronti gli output.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Chiama Claude/claude-fable-5-1 tramite /v1/messages.
Mantieni la stessa chiave RunAPI e la stessa struttura della richiesta mentre confronti gli output.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Chiama Claude/claude-haiku-4-5-20251001 tramite /v1/messages.
Mantieni la stessa chiave RunAPI e la stessa struttura della richiesta mentre confronti gli output.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 forme endpoint, una chiave

Chat completion

La forma OpenAI che ogni SDK già supporta. Sostituisci base_url e mantieni il codice di richiesta esistente.

Message

La forma Messages API per prompt di sistema, uso degli strumenti e blocchi di contenuto strutturato.

Response

La forma stateful per loop di agenti multi-turno con gestione della conversazione lato server.

Embedding

Embedding vettoriali per il recupero, fatturati per token sulla stessa chiave RunAPI.

LLM con una sola chiave

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Visualizza tutti i 67 modelli LLM
Avvio rapido

Chiama qualsiasi modello con la forma OpenAI

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
Come funziona

Quattro passaggi per la tua prima generazione

  1. Ottieni la tua chiave API

    Crea una chiave per il tuo account RunAPI.

  2. Usa il formato OpenAI

    Invia richieste tramite l'endpoint compatibile con OpenAI documentato.

  3. Instradiamo in modo intelligente

    RunAPI seleziona un percorso supportato per la tua richiesta.

  4. Trasmetti le risposte

    Ricevi l'output in streaming quando l'endpoint selezionato supporta SSE.

Perché gli sviluppatori scelgono RunAPI

Una chiave, tutti i modelli

Basta gestire mille API key. Un'unica integrazione ti dà accesso a 230+ modelli da tutti i provider.

Risparmio del 15-25%

I nostri accordi di volume con i provider garantiscono prezzi più bassi rispetto all'accesso diretto. Nessun ricarico aggiuntivo.

Failover automatico

Se un provider va offline, instradiamo verso la migliore alternativa. La tua app rimane operativa.

Compatibile con OpenAI

Sostituzione drop-in per OpenAI SDK. Cambia una riga di codice per accedere a qualsiasi modello.

Fatturazione in tempo reale

Paga solo ciò che usi. Prezzi per richiesta senza minimi. Monitora i costi per modello e per progetto.

Privacy dei dati

La nostra informativa sulla privacy spiega come vengono trattati e conservati i dati delle richieste e i contenuti generati.

Cosa ci costruiscono i team

Agenti di Coding

Instrada la pianificazione verso Opus e le modifiche a un modello economico, con una sola chiave e una sola fattura.

Pipeline RAG

Embedding e generazione sullo stesso endpoint, così recupero e risposta condividono un budget.

Generazione di Contenuti

Distribuisci bozze su più modelli e tieni la migliore, senza firmare cinque contratti con i provider.

Confronto Multi-Modello

Fai A/B dello stesso prompt su Claude, GPT e Gemini cambiando una sola stringa.

RunAPI vs alternative

Funzionalità RunAPI OpenRouter API diretta
Modelli LLM 66 300+ 1 provider
Altre modalità Video, Immagini, Musica, Audio No Per provider
Prezzi 15-25% sotto il prezzo ufficiale Tariffa di mercato Tariffa ufficiale
Messages API nativa No
Crediti unificati No
Server MCP + CLI No No

Domande sull'API LLM

Come migro da un client compatibile con OpenAI?

Punta il client all'URL base RunAPI documentato e usa la tua chiave RunAPI. Mantieni la forma della richiesta supportata dall'endpoint selezionato.

Lo streaming è supportato?

Lo streaming è disponibile quando il modello e l'endpoint selezionati espongono una risposta in streaming.

Le chiamate agli strumenti funzionano?

Il tool calling è disponibile sui modelli e le forme endpoint che dichiarano il supporto agli strumenti nel loro contratto di runtime.

Come vengono fatturati i token?

Le tariffe di input e output sono elencate nel catalogo modelli. L'utilizzo viene fatturato in base ai conteggi di token riportati per la richiesta.

Quale endpoint dovrei usare?

Scegli la forma endpoint che corrisponde al tuo client esistente e alle funzionalità richieste dalla tua richiesta.

Cosa succede se una route non è disponibile?

L'API restituisce lo stato della richiesta tramite il contratto di risposta documentato, così la tua applicazione può riprovare o scegliere un altro modello supportato.

Sostituisci due righe, mantieni il tuo codice

67 modelli dietro la forma OpenAI che già utilizzi. Inizia gratis, senza carta di credito.