LLM API Pricing

OpenAI API Pricing in 2026

GPT-5.4 kostet $2.50 Eingabe und $15 Ausgabe pro Million Token; GPT-5.5 kostet $5 und $30. RunAPI bietet Ihnen dieselben Modelle zum halben Preis — dieselbe API, dieselbe Ausgabe, dasselbe Verhalten, niedrigerer Betrag auf Ihrer Rechnung.

Aktualisiert am June 18, 2026 RunAPI Editorial
Auf einen Blick

Was kostet die OpenAI API aktuell?

OpenAI rechnet pro Million Token ab, mit separaten Preisen für Eingabe (Ihr Prompt) und Ausgabe (die Antwort des Modells). Ausgabe-Token kosten mehr — das Modell muss jedes einzelne generieren. Außerdem gibt es einen günstigeren Tarif für zwischengespeicherte Eingaben, wenn Sie dasselbe Prompt-Präfix erneut senden. Alle folgenden Angaben gelten pro Million Token.

Beliebteste Option

GPT-5.4 zu $1,25/M Input und $7,50/M Output über RunAPI. Offizieller Preis ist $2,50/$15.

Günstigste Option

GPT-5.4-mini — die günstigere Option für Arbeit mit hohem Volumen, bei der Sie nicht das volle Flaggschiffmodell benötigen. Über RunAPI mit 50% Rabatt abgerechnet.

Maximale Leistung

GPT-5.5 zu $2,50/M Input und $15/M Output über RunAPI. Offizieller Preis ist $5/$30.

Cache-Rabatt

Gecachte Input-Tokens kosten einen Bruchteil des Standard-Inputs — zu 50 % auf RunAPI weitergegeben.

Modell für Modell

Wie viel kostet jedes GPT-Modell pro Million Tokens?

Die Tabelle zeigt die offiziellen OpenAI-Preise neben den RunAPI-Preisen. Ausgabe-Token kosten deutlich mehr als Eingabe-Token — das ist beabsichtigt, da das Generieren jedes Tokens mehr Rechenleistung erfordert als das Lesen. RunAPI wendet einen pauschalen Rabatt von 50% auf alle GPT-Modelle an. Keine Volumenverpflichtungen, keine Abonnements.

Modell Offizieller Input /M Offizieller Output /M RunAPI Input /M RunAPI Output /M Kontextfenster
GPT-5.5 $5.00 $30.00 $2.50 $15.00 400K
GPT-5.4 $2.50 $15.00 $1.25 $7.50 400K
GPT-5.4-mini $0.25 $2.00 $0.13 $1.00 400K
GPT-5.3-codex $2.50 $15.00 $1.25 $7.50 400K
Cache und Batch

Wie senken Cache- und Batch-Rabatte Ihre GPT-Rechnung?

OpenAI berechnet weniger für zwischengespeicherte Eingabe-Token und halbiert die Kosten für Batch-Anfragen bei Aufträgen, die bis zu 24 Stunden warten können. Beides ist wichtig, wenn Sie einen Coding-Agent ausführen oder große Batches verarbeiten — wiederholter Kontext und Massenarbeit summieren sich schnell.

Gecachter Input

Wiederholte Prompt-Präfixe werden zu einem reduzierten Input-Preis abgerechnet. RunAPI gibt den Rabatt zu 50 % von OpenAIs gecachter Rate weiter.

Batch-API (50 % Rabatt)

Über die Batch API eingereichte Anfragen werden zur Hälfte des Standardpreises mit bis zu 24 Stunden Wartezeit verarbeitet. RunAPI gibt dies zusätzlich zu seinem eigenen Rabatt weiter.

Reasoning-Aufwand

GPT-5-Modelle ermöglichen das Einstellen des Reasoning-Aufwands. Geringerer Aufwand erzeugt weniger Reasoning-Tokens und senkt direkt die Output-Kosten bei der nutzungsabhängigen Abrechnung.

Output-Token-Kontrolle

Begrenzen Sie die maximalen Output-Tokens pro Anfrage, um Kosten zu kontrollieren und unkontrollierte Generierungen bei langen agentischen Aufgaben zu vermeiden.

Kosten in der Praxis

Was kostet die GPT-API wirklich bei realen Workloads?

Token-Preise wirken abstrakt, bis Sie sie auf echte Arbeit abbilden. Ein Kundensupport-Chatbot, der 50 Gespräche pro Tag verarbeitet, hat ein anderes Kostenprofil als ein Coding-Agent, der den ganzen Tag läuft, oder eine Content-Pipeline, die Hunderte von Dokumenten verarbeitet. Unten finden Sie typische Entwickler-Workloads — einschließlich Automatisierungs-Workflows — mit geschätzten monatlichen Kosten auf zwei Nutzungsniveaus, abgerechnet zu RunAPI-Tarifen.

Workload Modell Leichte Nutzung (~50 Aufgaben/Tag) Starke Nutzung (~200 Aufgaben/Tag) Monatliche Ersparnis vs. offiziell
Coding-Agent (Codex) GPT-5.3-codex $20/Monat $80/Monat $20–$80
Kunden-Support-Chatbot GPT-5.4-mini $6/Monat $24/Monat $6–$24
RAG-Wissensassistent GPT-5.4 $18/Monat $72/Monat $18–$72
Content-Generierungspipeline GPT-5.4 $25/Monat $100/Monat $25–$100
Multi-Agenten-Orchestrator GPT-5.5 $90/Monat $360/Monat $90–$360
Anbietervergleich

Ist die OpenAI API günstiger als Claude und Gemini?

Sich an einen einzigen Anbieter zu binden, ist ein echtes Risiko, wenn eine Preissenkung über Nacht einen Wettbewerber 30% günstiger machen kann. Hier sehen Sie, wie die Flaggschiffmodelle pro Million Token abschneiden — OpenAI, Anthropic und Google direkt nebeneinander — damit Sie entscheiden können, ohne sich durch drei Abrechnungsseiten zu arbeiten. RunAPI gibt Ihnen einen API-Schlüssel, der zu allen drei weiterleitet.

Anbieter Flagship-Modell Input /M Output /M RunAPI-Rate
OpenAI GPT-5.4 $2.50 $15.00 $1.25 / $7.50
Anthropic Claude Opus 4.7 $10.00 $50.00 $5.00 / $25.00
Google Gemini 2.5 Pro $1.25 $10.00 $0.63 / $5.00

RunAPI gewährt 50 % Rabatt auf alle oben aufgeführten Anbieter. Preise verifiziert im Juni 2026.

Erste Schritte

So greifen Sie über RunAPI auf die GPT-API zu

1

RunAPI-Konto erstellen

Registrieren Sie sich auf runapi.ai. Für den kostenlosen Tarif ist keine Kreditkarte erforderlich.

2

Ihren API-Schlüssel kopieren

Gehen Sie zu Dashboard → API Keys. Erstellen Sie einen Schlüssel und speichern Sie ihn — Sie verwenden ihn als Ihren OpenAI API-Schlüssel.

3

Ihr SDK auf RunAPI ausrichten

Setzen Sie die Basis-URL auf https://runapi.ai/v1 und verwenden Sie Ihren RunAPI-Schlüssel. Jeder OpenAI-kompatible Client funktioniert.

4

Anfragen stellen

Verwenden Sie gpt-5.4, gpt-5.5 oder eine beliebige GPT-Modell-ID im model-Parameter. RunAPI übernimmt Routing und Abrechnung zu 50 % des offiziellen Preises.

Häufig gestellte Fragen

OpenAI API Pricing FAQ

Was kostet die OpenAI GPT-5 API?

GPT-5.4 kostet offiziell $2,50 pro Million Input-Tokens und $15 pro Million Output-Tokens. GPT-5.5 kostet $5 und $30. Über RunAPI wird jedes GPT-Modell zur Hälfte dieser Preise abgerechnet — GPT-5.4 kostet $1,25 Input und $7,50 Output pro Million Tokens.

Warum ist RunAPI 50 % günstiger als OpenAI?

RunAPI verhandelt Mengenpreise mit Modellanbietern und gibt die Einsparungen an Entwickler weiter. Anfragen erreichen dieselben OpenAI-Modelle mit identischem Output, Sicherheitsfiltern und Verhalten, sodass der einzige Unterschied der niedrigere Preis auf Ihrer Rechnung ist. Es gibt keinen Qualitätsunterschied und keine separate Abrechnungsstufe — der Rabatt gilt automatisch für jedes GPT-Modell.

Gibt es ein kostenloses Kontingent für die OpenAI API?

Ja. Neue RunAPI-Konten erhalten kostenlose Guthaben, um jedes GPT-Modell zu testen — keine Kreditkarte erforderlich. Danach erfolgt die Abrechnung nutzungsbasiert ohne monatliches Minimum und ohne Abonnement. Laden Sie ein Guthaben auf, und jeder API-Aufruf zieht seine Token-Kosten ab. Sie können jeden Betrag aufladen und die Nutzung pro Modell im Dashboard verfolgen.

Ich baue einen n8n-Bot — wie funktioniert die API-Abrechnung für Automatisierungs-Workflows?

Ja, und es funktioniert gut für Automatisierungstools wie n8n, Make oder Zapier. Jeder Workflow-Schritt, der ein GPT-Modell aufruft, wird nach verwendeten Token abgerechnet — es gibt keine separate Gebühr pro Aufruf und keine Tarifstufe für Ratenlimits. Für Workflows, die nach Zeitplan laufen oder Batches verarbeiten, gilt der Rabatt der Batch API (50% Rabatt) und er lässt sich mit dem Basisrabatt von RunAPI kombinieren, sodass wiederkehrende Automatisierungsaufträge deutlich weniger kosten.

Wie werden Bild- und Audioeingaben bepreist — es sind nicht nur Token?

Bildeingaben werden pro Kachel abgerechnet — OpenAI teilt das Bild in 512×512-Kacheln auf und berechnet pro Kachel. Audio wird pro Sekunde Eingabe abgerechnet. Keines von beidem verwendet die Einheit pro Million Token. RunAPI gibt die Bild- und Audiopreise mit demselben Rabatt von 50% weiter, sodass eine GPT-4o-Vision-Anfrage oder Whisper-Transkription die Hälfte des offiziellen Tarifs kostet.

Kann ich das OpenAI SDK mit RunAPI verwenden?

Ja. RunAPI ist OpenAI-kompatibel. Richten Sie jeden OpenAI-Client auf https://runapi.ai/v1, verwenden Sie Ihren RunAPI-Schlüssel und geben Sie eine GPT-Modell-ID an. Bestehender Code, der bereits das OpenAI SDK verwendet, funktioniert ohne Änderungen über Basis-URL und Schlüssel hinaus, sodass die Migration eines etablierten Projekts etwa eine Minute dauert.

Unterstützt RunAPI GPT-5.3-codex für Coding?

Ja. GPT-5.3-codex ist über RunAPI zu 50 % des offiziellen Preises verfügbar, nämlich $1,25 Input und $7,50 Output pro Million Tokens. Es funktioniert mit Codex und anderen OpenAI-kompatiblen Coding-Tools durch Überschreiben von Basis-URL und Schlüssel in deren Einstellungen. Gecachte Input- und Batch-Rabatte werden ebenfalls weitergegeben und senken die effektiven Kosten repetitiver Coding-Sessions weiter.

Gibt es einen kostenlosen Tarif?

Ja. Neue RunAPI-Konten erhalten kostenlose Credits, um jedes GPT-Modell zu testen, bevor sie sich festlegen. Danach wird ausschließlich nutzungsabhängig ohne Mindestausgaben, kein Abonnement und keine monatliche Verpflichtung abgerechnet — Sie laden ein Guthaben auf und jeder Aufruf zieht seine Token-Kosten ab. Sie können beliebige Beträge aufladen und die Nutzung pro Modell im Dashboard beobachten.

VERWANDTE THEMEN

Mehr entdecken

GPT-5 zum halben Preis ausführen.

Erstellen Sie ein kostenloses RunAPI-Konto, erhalten Sie Ihren API-Schlüssel und rufen Sie jedes OpenAI GPT-Modell zu 50 % der offiziellen Preise auf.