Guida introduttiva
Chiama i modelli linguistici RunAPI tramite un protocollo sincrono o in streaming supportato.
RunAPI espone i modelli linguistici attraverso forme di protocollo pubbliche familiari.
Punta un client compatibile esistente su https://runapi.ai, utilizza un
identificatore di modello RunAPI e autenticati con una Chiave API standard.
Scegli un protocollo
- Le Chat Completions compatibili con OpenAI usano
POST /v1/chat/completions. - Le Responses compatibili con OpenAI usano
POST /v1/responses. - I Messages compatibili con Anthropic usano
POST /v1/messages. - La generazione di contenuti compatibile con Gemini usa
/v1beta/models/{model}:generateContento:streamGenerateContent.
Scegli il protocollo che meglio si adatta al client e al flusso applicativo esistente. Il catalogo dei modelli indica quali protocolli pubblici sono supportati da ciascun modello.
Invia una richiesta
Questa richiesta Chat Completions restituisce una risposta sincrona:
curl "https://runapi.ai/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
}'
Mantieni la richiesta e la risposta nella forma del protocollo selezionato. Utilizza il Riferimento API dell’operazione per campi esatti, chiamate agli strumenti, output strutturato e vincoli specifici del modello.
Output in streaming
Imposta l’opzione di streaming del protocollo e consuma in modo incrementale i server-sent
events restituiti. Per Chat Completions, aggiungi "stream": true; per le chiamate
compatibili con Gemini, utilizza l’operazione :streamGenerateContent.
Chiudi lo stream quando il client riceve l’evento terminale del protocollo.
Ispeziona la fedeltà di consegna
Ogni risposta LLM accettata include X-RunAPI-Fidelity. Un valore
full significa che la richiesta è stata consegnata senza omissioni. Un valore
lossy significa che RunAPI ha omesso controlli opzionali per completare la richiesta;
X-RunAPI-Omitted-Fields contiene i loro nomi di campo separati da virgola.
Le richieste il cui ciclo di vita richiesto, continuazione, strumento o semantica degli elementi tipizzati non possono essere preservate vengono rifiutate prima che venga creato un Task.
Entrambe le intestazioni sono esposte tramite CORS, quindi i client browser possono esaminarle. Registrale insieme all’identificatore della richiesta quando il comportamento esatto di consegna è rilevante per l’applicazione.
Gestisci errori e utilizzo
Tratta 401 come un errore di autenticazione, le risposte 4xx come problemi di richiesta o
di policy, e ritenta solo in caso di errori transienti del server o della rete.
Leggi l’utilizzo dei token dalla risposta finale o dall’evento di stream terminale nel
formato di protocollo selezionato, e conserva gli identificatori di richiesta nei log
dell’applicazione per il supporto.