LLM API

LLM API – OpenAI-kompatibel

Greife auf Claude, GPT, Gemini, DeepSeek und Grok über einen einzigen OpenAI-kompatiblen Endpoint zu. /v1/chat/completions, /v1/messages, /v1/responses.

67 Modelle Einfacher base_url-Tausch Zahlung pro Token

67
LLM-Modelle
15-25%
Unter dem offiziellen Preis
2 Zeilen
Zur Migration

Playground

live
Modell
Nachricht
Refactor this handler to stream partial results and return a typed error on timeout.
Maximale Token
integer | null
Temperatur
number | null
Stream
false
Endpoint
/v1/chat/completions
Geschätzte Kosten
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
Beispiele

Multi-Modell-Vergleich

Prompt Erkläre Quantencomputing in einem Satz

Claude/claude-fable-5

Rufe Claude/claude-fable-5 über /v1/messages auf.
Behalte denselben RunAPI-Schlüssel und dieselbe Anforderungsstruktur beim Vergleich der Ausgaben.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

Rufe Claude/claude-fable-5-1 über /v1/messages auf.
Behalte denselben RunAPI-Schlüssel und dieselbe Anforderungsstruktur beim Vergleich der Ausgaben.

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

Rufe Claude/claude-haiku-4-5-20251001 über /v1/messages auf.
Behalte denselben RunAPI-Schlüssel und dieselbe Anforderungsstruktur beim Vergleich der Ausgaben.

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 Endpoint-Formate, ein Schlüssel

Chat completion

Das OpenAI-Format, das jedes SDK bereits spricht. Tausche base_url aus und behalte deinen bestehenden Anforderungscode.

Message

Das Messages-API-Format für System-Prompts, Tool-Nutzung und strukturierte Inhaltsblöcke.

Response

Das zustandsbehaftete Format für mehrstufige Agenten-Schleifen mit serverseitiger Gesprächsverwaltung.

Embedding

Vektor-Embeddings für den Abruf, abgerechnet pro Token auf demselben RunAPI-Schlüssel.

LLMs mit einem Schlüssel

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

Alle 67 LLM-Modelle anzeigen
Schnellstart

Jedes Modell mit dem OpenAI-Format aufrufen

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
So funktioniert es

Vier Schritte zur ersten Generierung

  1. API-Key erhalten

    Erstelle einen Key für dein RunAPI-Konto.

  2. OpenAI-Format verwenden

    Sende Anfragen über den dokumentierten OpenAI-kompatiblen Endpoint.

  3. Wir routen intelligent

    RunAPI wählt eine unterstützte Route für deine Anfrage.

  4. Antworten streamen

    Erhalte gestreamte Ausgabe, wenn der gewählte Endpoint SSE unterstützt.

Warum Entwickler RunAPI wählen

Ein Key, alle Modelle

Schluss mit dem Jonglieren von API-Keys. Eine Integration gibt Ihnen Zugang zu 230+ Modellen bei allen Anbietern.

15–25 % Kostenersparnis

Unsere Mengenvereinbarungen mit Anbietern bedeuten günstigere Preise als der direkte Weg. Kein Aufschlag obendrauf.

Automatisches Failover

Wenn ein Anbieter ausfällt, leiten wir zur nächstbesten Option weiter. Deine App bleibt erreichbar.

OpenAI-kompatibel

Drop-in-Ersatz für das OpenAI SDK. Ändere eine Codezeile, um auf jedes Modell zuzugreifen.

Echtzeit-Abrechnung

Zahle nur, was du nutzt. Preisgestaltung pro Anfrage ohne Mindestmengen. Kosten pro Modell und Projekt verfolgen.

Datenschutz

Unsere Datenschutzerklärung erläutert, wie Anfragedaten und generierte Inhalte verarbeitet und gespeichert werden.

Was Teams damit bauen

Coding Agents

Planung an Opus und Bearbeitungen an ein günstiges Modell – mit einem Schlüssel und einer Rechnung.

RAG Pipelines

Embeddings und Generierung am selben Endpoint, sodass Abruf und Antwort ein gemeinsames Budget teilen.

Content-Erstellung

Entwürfe über Modelle verteilen und den besten behalten – ohne fünf Anbieterverträge zu unterzeichnen.

Multi-Modell-Vergleich

A/B-Test desselben Prompts mit Claude, GPT und Gemini durch Änderung einer einzigen Zeichenkette.

RunAPI vs. Alternativen

Funktion RunAPI OpenRouter Direkte API
LLM-Modelle 66 300+ 1 Anbieter
Andere Modalitäten Video, Bild, Musik, Audio Nein Pro Anbieter
Preise 15–25 % unter dem offiziellen Preis Marktpreis Offizieller Tarif
Native Messages API Ja Nein Ja
Einheitliche Credits Ja Ja Nein
MCP-Server + CLI Ja Nein Nein

Fragen zur LLM API

Wie migriere ich von einem OpenAI-kompatiblen Client?

Verweise den Client auf die dokumentierte RunAPI-Basis-URL und verwende deinen RunAPI-Schlüssel. Behalte das vom gewählten Endpoint unterstützte Anforderungsformat bei.

Wird Streaming unterstützt?

Streaming ist verfügbar, wenn das gewählte Modell und der Endpoint eine Streaming-Antwort bereitstellen.

Funktionieren Tool-Aufrufe?

Tool-Aufrufe sind auf Modellen und Endpoint-Formaten verfügbar, die Tool-Unterstützung in ihrem Laufzeitvertrag deklarieren.

Wie werden Token abgerechnet?

Eingabe- und Ausgaberaten sind im Modellkatalog aufgeführt. Die Abrechnung basiert auf den für die Anfrage gemeldeten Token-Zählungen.

Welchen Endpoint soll ich verwenden?

Wähle das Endpoint-Format, das zu deinem bestehenden Client und den von deiner Anfrage benötigten Funktionen passt.

Was passiert, wenn eine Route nicht verfügbar ist?

Die API gibt den Anfragestatus über ihren dokumentierten Antwortvertrag zurück, sodass deine Anwendung einen erneuten Versuch starten oder ein anderes unterstütztes Modell wählen kann.

Zwei Zeilen tauschen, Code behalten

67 Modelle hinter dem OpenAI-Format, das du bereits einsetzt. Kostenlos starten, keine Kreditkarte erforderlich.