# OpenAI API Pricing in 2026

GPT-5.4 kostet $2.50 Eingabe und $15 Ausgabe pro Million Token; GPT-5.5 kostet $5 und $30. RunAPI bietet Ihnen dieselben Modelle zum halben Preis — dieselbe API, dieselbe Ausgabe, dasselbe Verhalten, niedrigerer Betrag auf Ihrer Rechnung.

*Updated June 18, 2026 · RunAPI Editorial*

## Was kostet die OpenAI API aktuell?

OpenAI rechnet pro Million Token ab, mit separaten Preisen für Eingabe (Ihr Prompt) und Ausgabe (die Antwort des Modells). Ausgabe-Token kosten mehr — das Modell muss jedes einzelne generieren. Außerdem gibt es einen günstigeren Tarif für zwischengespeicherte Eingaben, wenn Sie dasselbe Prompt-Präfix erneut senden. Alle folgenden Angaben gelten pro Million Token.

- **Beliebteste Option**: GPT-5.4 zu $1,25/M Input und $7,50/M Output über RunAPI. Offizieller Preis ist $2,50/$15.
- **Günstigste Option**: GPT-5.4-mini — die günstigere Option für Arbeit mit hohem Volumen, bei der Sie nicht das volle Flaggschiffmodell benötigen. Über RunAPI mit 50% Rabatt abgerechnet.
- **Maximale Leistung**: GPT-5.5 zu $2,50/M Input und $15/M Output über RunAPI. Offizieller Preis ist $5/$30.
- **Cache-Rabatt**: Gecachte Input-Tokens kosten einen Bruchteil des Standard-Inputs — zu 50 % auf RunAPI weitergegeben.

## Wie viel kostet jedes GPT-Modell pro Million Tokens?

Die Tabelle zeigt die offiziellen OpenAI-Preise neben den RunAPI-Preisen. Ausgabe-Token kosten deutlich mehr als Eingabe-Token — das ist beabsichtigt, da das Generieren jedes Tokens mehr Rechenleistung erfordert als das Lesen. RunAPI wendet einen pauschalen Rabatt von 50% auf alle GPT-Modelle an. Keine Volumenverpflichtungen, keine Abonnements.

| Modell | Offizieller Input /M | Offizieller Output /M | RunAPI Input /M | RunAPI Output /M | Kontextfenster |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |

## Wie senken Cache- und Batch-Rabatte Ihre GPT-Rechnung?

OpenAI berechnet weniger für zwischengespeicherte Eingabe-Token und halbiert die Kosten für Batch-Anfragen bei Aufträgen, die bis zu 24 Stunden warten können. Beides ist wichtig, wenn Sie einen Coding-Agent ausführen oder große Batches verarbeiten — wiederholter Kontext und Massenarbeit summieren sich schnell.

### Gecachter Input

Wiederholte Prompt-Präfixe werden zu einem reduzierten Input-Preis abgerechnet. RunAPI gibt den Rabatt zu 50 % von OpenAIs gecachter Rate weiter.

### Batch-API (50 % Rabatt)

Über die Batch API eingereichte Anfragen werden zur Hälfte des Standardpreises mit bis zu 24 Stunden Wartezeit verarbeitet. RunAPI gibt dies zusätzlich zu seinem eigenen Rabatt weiter.

### Reasoning-Aufwand

GPT-5-Modelle ermöglichen das Einstellen des Reasoning-Aufwands. Geringerer Aufwand erzeugt weniger Reasoning-Tokens und senkt direkt die Output-Kosten bei der nutzungsabhängigen Abrechnung.

### Output-Token-Kontrolle

Begrenzen Sie die maximalen Output-Tokens pro Anfrage, um Kosten zu kontrollieren und unkontrollierte Generierungen bei langen agentischen Aufgaben zu vermeiden.


## Was kostet die GPT-API wirklich bei realen Workloads?

Token-Preise wirken abstrakt, bis Sie sie auf echte Arbeit abbilden. Ein Kundensupport-Chatbot, der 50 Gespräche pro Tag verarbeitet, hat ein anderes Kostenprofil als ein Coding-Agent, der den ganzen Tag läuft, oder eine Content-Pipeline, die Hunderte von Dokumenten verarbeitet. Unten finden Sie typische Entwickler-Workloads — einschließlich Automatisierungs-Workflows — mit geschätzten monatlichen Kosten auf zwei Nutzungsniveaus, abgerechnet zu RunAPI-Tarifen.

| Workload | Modell | Leichte Nutzung (~50 Aufgaben/Tag) | Starke Nutzung (~200 Aufgaben/Tag) | Monatliche Ersparnis vs. offiziell |
|---|---|---|---|---|
| Coding-Agent (Codex) | GPT-5.3-codex | $20/Monat | $80/Monat | $20–$80 |
| Kunden-Support-Chatbot | GPT-5.4-mini | $6/Monat | $24/Monat | $6–$24 |
| RAG-Wissensassistent | GPT-5.4 | $18/Monat | $72/Monat | $18–$72 |
| Content-Generierungspipeline | GPT-5.4 | $25/Monat | $100/Monat | $25–$100 |
| Multi-Agenten-Orchestrator | GPT-5.5 | $90/Monat | $360/Monat | $90–$360 |

## Ist die OpenAI API günstiger als Claude und Gemini?

Sich an einen einzigen Anbieter zu binden, ist ein echtes Risiko, wenn eine Preissenkung über Nacht einen Wettbewerber 30% günstiger machen kann. Hier sehen Sie, wie die Flaggschiffmodelle pro Million Token abschneiden — OpenAI, Anthropic und Google direkt nebeneinander — damit Sie entscheiden können, ohne sich durch drei Abrechnungsseiten zu arbeiten. RunAPI gibt Ihnen einen API-Schlüssel, der zu allen drei weiterleitet.

| Anbieter | Flagship-Modell | Input /M | Output /M | RunAPI-Rate |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Google | Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |

## Wie Sie die OpenAI API über RunAPI nutzen

1. **RunAPI-Konto erstellen** — Registrieren Sie sich auf runapi.ai. Für den kostenlosen Tarif ist keine Kreditkarte erforderlich.
2. **Ihren API-Schlüssel kopieren** — Gehen Sie zu Dashboard → API Keys. Erstellen Sie einen Schlüssel und speichern Sie ihn — Sie verwenden ihn als Ihren OpenAI API-Schlüssel.
3. **Ihr SDK auf RunAPI ausrichten** — Setzen Sie die Basis-URL auf https://runapi.ai/v1 und verwenden Sie Ihren RunAPI-Schlüssel. Jeder OpenAI-kompatible Client funktioniert.
4. **Anfragen stellen** — Verwenden Sie gpt-5.4, gpt-5.5 oder eine beliebige GPT-Modell-ID im model-Parameter. RunAPI übernimmt Routing und Abrechnung zu 50 % des offiziellen Preises.

## OpenAI API Pricing FAQ

### Was kostet die OpenAI GPT-5 API?

GPT-5.4 kostet offiziell $2,50 pro Million Input-Tokens und $15 pro Million Output-Tokens. GPT-5.5 kostet $5 und $30. Über RunAPI wird jedes GPT-Modell zur Hälfte dieser Preise abgerechnet — GPT-5.4 kostet $1,25 Input und $7,50 Output pro Million Tokens.

### Warum ist RunAPI 50 % günstiger als OpenAI?

RunAPI verhandelt Mengenpreise mit Modellanbietern und gibt die Einsparungen an Entwickler weiter. Anfragen erreichen dieselben OpenAI-Modelle mit identischem Output, Sicherheitsfiltern und Verhalten, sodass der einzige Unterschied der niedrigere Preis auf Ihrer Rechnung ist. Es gibt keinen Qualitätsunterschied und keine separate Abrechnungsstufe — der Rabatt gilt automatisch für jedes GPT-Modell.

### Gibt es ein kostenloses Kontingent für die OpenAI API?

Ja. Neue RunAPI-Konten erhalten kostenlose Guthaben, um jedes GPT-Modell zu testen — keine Kreditkarte erforderlich. Danach erfolgt die Abrechnung nutzungsbasiert ohne monatliches Minimum und ohne Abonnement. Laden Sie ein Guthaben auf, und jeder API-Aufruf zieht seine Token-Kosten ab. Sie können jeden Betrag aufladen und die Nutzung pro Modell im Dashboard verfolgen.

### Ich baue einen n8n-Bot — wie funktioniert die API-Abrechnung für Automatisierungs-Workflows?

Ja, und es funktioniert gut für Automatisierungstools wie n8n, Make oder Zapier. Jeder Workflow-Schritt, der ein GPT-Modell aufruft, wird nach verwendeten Token abgerechnet — es gibt keine separate Gebühr pro Aufruf und keine Tarifstufe für Ratenlimits. Für Workflows, die nach Zeitplan laufen oder Batches verarbeiten, gilt der Rabatt der Batch API (50% Rabatt) und er lässt sich mit dem Basisrabatt von RunAPI kombinieren, sodass wiederkehrende Automatisierungsaufträge deutlich weniger kosten.

### Wie werden Bild- und Audioeingaben bepreist — es sind nicht nur Token?

Bildeingaben werden pro Kachel abgerechnet — OpenAI teilt das Bild in 512×512-Kacheln auf und berechnet pro Kachel. Audio wird pro Sekunde Eingabe abgerechnet. Keines von beidem verwendet die Einheit pro Million Token. RunAPI gibt die Bild- und Audiopreise mit demselben Rabatt von 50% weiter, sodass eine GPT-4o-Vision-Anfrage oder Whisper-Transkription die Hälfte des offiziellen Tarifs kostet.

### Kann ich das OpenAI SDK mit RunAPI verwenden?

Ja. RunAPI ist OpenAI-kompatibel. Richten Sie jeden OpenAI-Client auf https://runapi.ai/v1, verwenden Sie Ihren RunAPI-Schlüssel und geben Sie eine GPT-Modell-ID an. Bestehender Code, der bereits das OpenAI SDK verwendet, funktioniert ohne Änderungen über Basis-URL und Schlüssel hinaus, sodass die Migration eines etablierten Projekts etwa eine Minute dauert.

### Unterstützt RunAPI GPT-5.3-codex für Coding?

Ja. GPT-5.3-codex ist über RunAPI zu 50 % des offiziellen Preises verfügbar, nämlich $1,25 Input und $7,50 Output pro Million Tokens. Es funktioniert mit Codex und anderen OpenAI-kompatiblen Coding-Tools durch Überschreiben von Basis-URL und Schlüssel in deren Einstellungen. Gecachte Input- und Batch-Rabatte werden ebenfalls weitergegeben und senken die effektiven Kosten repetitiver Coding-Sessions weiter.

### Gibt es einen kostenlosen Tarif?

Ja. Neue RunAPI-Konten erhalten kostenlose Credits, um jedes GPT-Modell zu testen, bevor sie sich festlegen. Danach wird ausschließlich nutzungsabhängig ohne Mindestausgaben, kein Abonnement und keine monatliche Verpflichtung abgerechnet — Sie laden ein Guthaben auf und jeder Aufruf zieht seine Token-Kosten ab. Sie können beliebige Beträge aufladen und die Nutzung pro Modell im Dashboard beobachten.

