Schnellstart
RunAPI-Sprachmodelle über ein unterstütztes synchrones oder Streaming-Protokoll aufrufen.
RunAPI stellt Sprachmodelle über vertraute öffentliche Protokollformen bereit.
Richten Sie einen vorhandenen kompatiblen Client auf https://runapi.ai, verwenden Sie einen RunAPI-
Modellbezeichner und authentifizieren Sie sich mit einem Standard-API-Schlüssel.
Ein Protokoll auswählen
- OpenAI-kompatible Chat Completions verwenden
POST /v1/chat/completions. - OpenAI-kompatible Responses verwenden
POST /v1/responses. - Anthropic-kompatible Messages verwenden
POST /v1/messages. - Gemini-kompatible Inhaltsgenerierung verwendet
/v1beta/models/{model}:generateContentoder:streamGenerateContent.
Wählen Sie das Protokoll, das am besten zu Ihrem vorhandenen Client und Anwendungsablauf passt. Der Modell-Catalog gibt an, welche öffentlichen Protokolle jedes Modell unterstützt.
Eine Anfrage senden
Diese Chat Completions-Anfrage gibt eine synchrone Antwort zurück:
curl "https://runapi.ai/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4",
"messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
}'
Halten Sie Anfrage und Antwort in der gewählten Protokollform. Verwenden Sie die API-Referenz der Operation für genaue Felder, Tool-Aufruf, strukturierte Ausgabe und modellspezifische Einschränkungen.
Stream-Ausgabe
Setzen Sie die Streaming-Option des Protokolls und verarbeiten Sie die zurückgegebenen Server-Sent
Events inkrementell. Fügen Sie für Chat Completions "stream": true hinzu; für
Gemini-kompatible Aufrufe verwenden Sie die :streamGenerateContent-Operation.
Schließen Sie den Stream, wenn Ihr Client das Terminal-Ereignis des Protokolls empfängt.
Zustellungsgenauigkeit prüfen
Jede akzeptierte LLM-Antwort enthält X-RunAPI-Fidelity. Ein Wert von full bedeutet, dass die Anfrage ohne Auslassung zugestellt wurde. Ein Wert von lossy bedeutet, dass RunAPI optionale Steuerelemente ausgelassen hat, um die Anfrage abzuschließen; X-RunAPI-Omitted-Fields enthält deren durch Komma getrennte Feldnamen. Anfragen, bei denen die erforderliche Lebenszyklus-, Fortsetzungs-, Tool- oder typisierte-Elemente-Semantik nicht erhalten werden kann, werden abgelehnt, bevor ein Task erstellt wird.
Beide Header werden über CORS verfügbar gemacht, sodass Browser-Clients sie einsehen können. Protokollieren Sie sie zusammen mit der Anfrage-ID, wenn das genaue Zustellungsverhalten für die Anwendung relevant ist.
Fehler und Nutzung verarbeiten
Behandeln Sie 401 als Authentifizierungsfehler, 4xx-Antworten als Anfrage- oder
Richtlinienprobleme, und wiederholen Sie nur vorübergehende Server- oder Netzwerkfehler.
Lesen Sie die Token-Nutzung aus der abschließenden Antwort oder dem terminalen Stream-Ereignis im
gewählten Protokollformat und halten Sie Anfrage-IDs in Anwendungsprotokollen für den Support fest.