Gecachter Input
Wiederholte Prompt-Präfixe werden zu einem reduzierten Input-Preis abgerechnet. RunAPI gibt den Rabatt zu 50 % von OpenAIs gecachter Rate weiter.
GPT-5.4 kostet $2.50 Eingabe und $15 Ausgabe pro Million Token; GPT-5.5 kostet $5 und $30. RunAPI bietet Ihnen dieselben Modelle zum halben Preis — dieselbe API, dieselbe Ausgabe, dasselbe Verhalten, niedrigerer Betrag auf Ihrer Rechnung.
OpenAI rechnet pro Million Token ab, mit separaten Preisen für Eingabe (Ihr Prompt) und Ausgabe (die Antwort des Modells). Ausgabe-Token kosten mehr — das Modell muss jedes einzelne generieren. Außerdem gibt es einen günstigeren Tarif für zwischengespeicherte Eingaben, wenn Sie dasselbe Prompt-Präfix erneut senden. Alle folgenden Angaben gelten pro Million Token.
GPT-5.4 zu $1,25/M Input und $7,50/M Output über RunAPI. Offizieller Preis ist $2,50/$15.
GPT-5.4-mini — die günstigere Option für Arbeit mit hohem Volumen, bei der Sie nicht das volle Flaggschiffmodell benötigen. Über RunAPI mit 50% Rabatt abgerechnet.
GPT-5.5 zu $2,50/M Input und $15/M Output über RunAPI. Offizieller Preis ist $5/$30.
Gecachte Input-Tokens kosten einen Bruchteil des Standard-Inputs — zu 50 % auf RunAPI weitergegeben.
Die Tabelle zeigt die offiziellen OpenAI-Preise neben den RunAPI-Preisen. Ausgabe-Token kosten deutlich mehr als Eingabe-Token — das ist beabsichtigt, da das Generieren jedes Tokens mehr Rechenleistung erfordert als das Lesen. RunAPI wendet einen pauschalen Rabatt von 50% auf alle GPT-Modelle an. Keine Volumenverpflichtungen, keine Abonnements.
| Modell | Offizieller Input /M | Offizieller Output /M | RunAPI Input /M | RunAPI Output /M | Kontextfenster |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI berechnet weniger für zwischengespeicherte Eingabe-Token und halbiert die Kosten für Batch-Anfragen bei Aufträgen, die bis zu 24 Stunden warten können. Beides ist wichtig, wenn Sie einen Coding-Agent ausführen oder große Batches verarbeiten — wiederholter Kontext und Massenarbeit summieren sich schnell.
Wiederholte Prompt-Präfixe werden zu einem reduzierten Input-Preis abgerechnet. RunAPI gibt den Rabatt zu 50 % von OpenAIs gecachter Rate weiter.
Über die Batch API eingereichte Anfragen werden zur Hälfte des Standardpreises mit bis zu 24 Stunden Wartezeit verarbeitet. RunAPI gibt dies zusätzlich zu seinem eigenen Rabatt weiter.
GPT-5-Modelle ermöglichen das Einstellen des Reasoning-Aufwands. Geringerer Aufwand erzeugt weniger Reasoning-Tokens und senkt direkt die Output-Kosten bei der nutzungsabhängigen Abrechnung.
Begrenzen Sie die maximalen Output-Tokens pro Anfrage, um Kosten zu kontrollieren und unkontrollierte Generierungen bei langen agentischen Aufgaben zu vermeiden.
Token-Preise wirken abstrakt, bis Sie sie auf echte Arbeit abbilden. Ein Kundensupport-Chatbot, der 50 Gespräche pro Tag verarbeitet, hat ein anderes Kostenprofil als ein Coding-Agent, der den ganzen Tag läuft, oder eine Content-Pipeline, die Hunderte von Dokumenten verarbeitet. Unten finden Sie typische Entwickler-Workloads — einschließlich Automatisierungs-Workflows — mit geschätzten monatlichen Kosten auf zwei Nutzungsniveaus, abgerechnet zu RunAPI-Tarifen.
| Workload | Modell | Leichte Nutzung (~50 Aufgaben/Tag) | Starke Nutzung (~200 Aufgaben/Tag) | Monatliche Ersparnis vs. offiziell |
|---|---|---|---|---|
| Coding-Agent (Codex) | GPT-5.3-codex | $20/Monat | $80/Monat | $20–$80 |
| Kunden-Support-Chatbot | GPT-5.4-mini | $6/Monat | $24/Monat | $6–$24 |
| RAG-Wissensassistent | GPT-5.4 | $18/Monat | $72/Monat | $18–$72 |
| Content-Generierungspipeline | GPT-5.4 | $25/Monat | $100/Monat | $25–$100 |
| Multi-Agenten-Orchestrator | GPT-5.5 | $90/Monat | $360/Monat | $90–$360 |
Sich an einen einzigen Anbieter zu binden, ist ein echtes Risiko, wenn eine Preissenkung über Nacht einen Wettbewerber 30% günstiger machen kann. Hier sehen Sie, wie die Flaggschiffmodelle pro Million Token abschneiden — OpenAI, Anthropic und Google direkt nebeneinander — damit Sie entscheiden können, ohne sich durch drei Abrechnungsseiten zu arbeiten. RunAPI gibt Ihnen einen API-Schlüssel, der zu allen drei weiterleitet.
| Anbieter | Flagship-Modell | Input /M | Output /M | RunAPI-Rate |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI gewährt 50 % Rabatt auf alle oben aufgeführten Anbieter. Preise verifiziert im Juni 2026.
Registrieren Sie sich auf runapi.ai. Für den kostenlosen Tarif ist keine Kreditkarte erforderlich.
Gehen Sie zu Dashboard → API Keys. Erstellen Sie einen Schlüssel und speichern Sie ihn — Sie verwenden ihn als Ihren OpenAI API-Schlüssel.
Setzen Sie die Basis-URL auf https://runapi.ai/v1 und verwenden Sie Ihren RunAPI-Schlüssel. Jeder OpenAI-kompatible Client funktioniert.
Verwenden Sie gpt-5.4, gpt-5.5 oder eine beliebige GPT-Modell-ID im model-Parameter. RunAPI übernimmt Routing und Abrechnung zu 50 % des offiziellen Preises.
GPT-5.4 kostet offiziell $2,50 pro Million Input-Tokens und $15 pro Million Output-Tokens. GPT-5.5 kostet $5 und $30. Über RunAPI wird jedes GPT-Modell zur Hälfte dieser Preise abgerechnet — GPT-5.4 kostet $1,25 Input und $7,50 Output pro Million Tokens.
RunAPI verhandelt Mengenpreise mit Modellanbietern und gibt die Einsparungen an Entwickler weiter. Anfragen erreichen dieselben OpenAI-Modelle mit identischem Output, Sicherheitsfiltern und Verhalten, sodass der einzige Unterschied der niedrigere Preis auf Ihrer Rechnung ist. Es gibt keinen Qualitätsunterschied und keine separate Abrechnungsstufe — der Rabatt gilt automatisch für jedes GPT-Modell.
Ja. Neue RunAPI-Konten erhalten kostenlose Guthaben, um jedes GPT-Modell zu testen — keine Kreditkarte erforderlich. Danach erfolgt die Abrechnung nutzungsbasiert ohne monatliches Minimum und ohne Abonnement. Laden Sie ein Guthaben auf, und jeder API-Aufruf zieht seine Token-Kosten ab. Sie können jeden Betrag aufladen und die Nutzung pro Modell im Dashboard verfolgen.
Ja, und es funktioniert gut für Automatisierungstools wie n8n, Make oder Zapier. Jeder Workflow-Schritt, der ein GPT-Modell aufruft, wird nach verwendeten Token abgerechnet — es gibt keine separate Gebühr pro Aufruf und keine Tarifstufe für Ratenlimits. Für Workflows, die nach Zeitplan laufen oder Batches verarbeiten, gilt der Rabatt der Batch API (50% Rabatt) und er lässt sich mit dem Basisrabatt von RunAPI kombinieren, sodass wiederkehrende Automatisierungsaufträge deutlich weniger kosten.
Bildeingaben werden pro Kachel abgerechnet — OpenAI teilt das Bild in 512×512-Kacheln auf und berechnet pro Kachel. Audio wird pro Sekunde Eingabe abgerechnet. Keines von beidem verwendet die Einheit pro Million Token. RunAPI gibt die Bild- und Audiopreise mit demselben Rabatt von 50% weiter, sodass eine GPT-4o-Vision-Anfrage oder Whisper-Transkription die Hälfte des offiziellen Tarifs kostet.
Ja. RunAPI ist OpenAI-kompatibel. Richten Sie jeden OpenAI-Client auf https://runapi.ai/v1, verwenden Sie Ihren RunAPI-Schlüssel und geben Sie eine GPT-Modell-ID an. Bestehender Code, der bereits das OpenAI SDK verwendet, funktioniert ohne Änderungen über Basis-URL und Schlüssel hinaus, sodass die Migration eines etablierten Projekts etwa eine Minute dauert.
Ja. GPT-5.3-codex ist über RunAPI zu 50 % des offiziellen Preises verfügbar, nämlich $1,25 Input und $7,50 Output pro Million Tokens. Es funktioniert mit Codex und anderen OpenAI-kompatiblen Coding-Tools durch Überschreiben von Basis-URL und Schlüssel in deren Einstellungen. Gecachte Input- und Batch-Rabatte werden ebenfalls weitergegeben und senken die effektiven Kosten repetitiver Coding-Sessions weiter.
Ja. Neue RunAPI-Konten erhalten kostenlose Credits, um jedes GPT-Modell zu testen, bevor sie sich festlegen. Danach wird ausschließlich nutzungsabhängig ohne Mindestausgaben, kein Abonnement und keine monatliche Verpflichtung abgerechnet — Sie laden ein Guthaben auf und jeder Aufruf zieht seine Token-Kosten ab. Sie können beliebige Beträge aufladen und die Nutzung pro Modell im Dashboard beobachten.
Erstellen Sie ein kostenloses RunAPI-Konto, erhalten Sie Ihren API-Schlüssel und rufen Sie jedes OpenAI GPT-Modell zu 50 % der offiziellen Preise auf.