Zum Inhalt springen
Anleitungen
Anleitungen

Schnellstart

RunAPI-Sprachmodelle über ein unterstütztes synchrones oder Streaming-Protokoll aufrufen.

RunAPI stellt Sprachmodelle über vertraute öffentliche Protokollformen bereit. Richten Sie einen vorhandenen kompatiblen Client auf https://runapi.ai, verwenden Sie einen RunAPI- Modellbezeichner und authentifizieren Sie sich mit einem Standard-API-Schlüssel.

Ein Protokoll auswählen

  • OpenAI-kompatible Chat Completions verwenden POST /v1/chat/completions.
  • OpenAI-kompatible Responses verwenden POST /v1/responses.
  • Anthropic-kompatible Messages verwenden POST /v1/messages.
  • Gemini-kompatible Inhaltsgenerierung verwendet /v1beta/models/{model}:generateContent oder :streamGenerateContent.

Wählen Sie das Protokoll, das am besten zu Ihrem vorhandenen Client und Anwendungsablauf passt. Der Modell-Catalog gibt an, welche öffentlichen Protokolle jedes Modell unterstützt.

Eine Anfrage senden

Diese Chat Completions-Anfrage gibt eine synchrone Antwort zurück:

SHELL
curl "https://runapi.ai/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.4",
    "messages": [{"role": "user", "content": "Summarize why idempotency matters."}]
  }'

Halten Sie Anfrage und Antwort in der gewählten Protokollform. Verwenden Sie die API-Referenz der Operation für genaue Felder, Tool-Aufruf, strukturierte Ausgabe und modellspezifische Einschränkungen.

Stream-Ausgabe

Setzen Sie die Streaming-Option des Protokolls und verarbeiten Sie die zurückgegebenen Server-Sent Events inkrementell. Fügen Sie für Chat Completions "stream": true hinzu; für Gemini-kompatible Aufrufe verwenden Sie die :streamGenerateContent-Operation. Schließen Sie den Stream, wenn Ihr Client das Terminal-Ereignis des Protokolls empfängt.

Zustellungsgenauigkeit prüfen

Jede akzeptierte LLM-Antwort enthält X-RunAPI-Fidelity. Ein Wert von full bedeutet, dass die Anfrage ohne Auslassung zugestellt wurde. Ein Wert von lossy bedeutet, dass RunAPI optionale Steuerelemente ausgelassen hat, um die Anfrage abzuschließen; X-RunAPI-Omitted-Fields enthält deren durch Komma getrennte Feldnamen. Anfragen, bei denen die erforderliche Lebenszyklus-, Fortsetzungs-, Tool- oder typisierte-Elemente-Semantik nicht erhalten werden kann, werden abgelehnt, bevor ein Task erstellt wird.

Beide Header werden über CORS verfügbar gemacht, sodass Browser-Clients sie einsehen können. Protokollieren Sie sie zusammen mit der Anfrage-ID, wenn das genaue Zustellungsverhalten für die Anwendung relevant ist.

Fehler und Nutzung verarbeiten

Behandeln Sie 401 als Authentifizierungsfehler, 4xx-Antworten als Anfrage- oder Richtlinienprobleme, und wiederholen Sie nur vorübergehende Server- oder Netzwerkfehler. Lesen Sie die Token-Nutzung aus der abschließenden Antwort oder dem terminalen Stream-Ereignis im gewählten Protokollformat und halten Sie Anfrage-IDs in Anwendungsprotokollen für den Support fest.