Vai al contenuto
Guide
Guide

Guida introduttiva

Chiama i modelli linguistici RunAPI tramite un protocollo sincrono o in streaming supportato.

RunAPI espone i modelli linguistici attraverso forme di protocollo pubbliche familiari. Punta un client compatibile esistente su https://runapi.ai, utilizza un identificatore di modello RunAPI e autenticati con una Chiave API standard.

Scegli un protocollo

  • Le Chat Completions compatibili con OpenAI usano POST /v1/chat/completions.
  • Le Responses compatibili con OpenAI usano POST /v1/responses.
  • I Messages compatibili con Anthropic usano POST /v1/messages.
  • La generazione di contenuti compatibile con Gemini usa /v1beta/models/{model}:generateContent o :streamGenerateContent.

Scegli il protocollo che meglio si adatta al client e al flusso applicativo esistente. Il catalogo dei modelli indica quali protocolli pubblici sono supportati da ciascun modello.

Invia una richiesta

Questa richiesta Chat Completions restituisce una risposta sincrona:

SHELL
curl "https://runapi.ai/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.4",
    "messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
  }'

Mantieni la richiesta e la risposta nella forma del protocollo selezionato. Utilizza il Riferimento API dell’operazione per campi esatti, chiamate agli strumenti, output strutturato e vincoli specifici del modello.

Output in streaming

Imposta l’opzione di streaming del protocollo e consuma in modo incrementale i server-sent events restituiti. Per Chat Completions, aggiungi "stream": true; per le chiamate compatibili con Gemini, utilizza l’operazione :streamGenerateContent. Chiudi lo stream quando il client riceve l’evento terminale del protocollo.

Ispeziona la fedeltà di consegna

Ogni risposta LLM accettata include X-RunAPI-Fidelity. Un valore full significa che la richiesta è stata consegnata senza omissioni. Un valore lossy significa che RunAPI ha omesso controlli opzionali per completare la richiesta; X-RunAPI-Omitted-Fields contiene i loro nomi di campo separati da virgola. Le richieste il cui ciclo di vita richiesto, continuazione, strumento o semantica degli elementi tipizzati non possono essere preservate vengono rifiutate prima che venga creato un Task.

Entrambe le intestazioni sono esposte tramite CORS, quindi i client browser possono esaminarle. Registrale insieme all’identificatore della richiesta quando il comportamento esatto di consegna è rilevante per l’applicazione.

Gestisci errori e utilizzo

Tratta 401 come un errore di autenticazione, le risposte 4xx come problemi di richiesta o di policy, e ritenta solo in caso di errori transienti del server o della rete. Leggi l’utilizzo dei token dalla risposta finale o dall’evento di stream terminale nel formato di protocollo selezionato, e conserva gli identificatori di richiesta nei log dell’applicazione per il supporto.