Cache-Read
90 % Rabatt auf Input-Tokens. Ein Sonnet 4.6 Cache-Read kostet über RunAPI $0,30/M statt $3,00/M.
Anthropic berechnet je nach Modell $3–$15 pro Million Token. RunAPI bietet Ihnen jedes Claude-Modell zum halben offiziellen Preis — gleiche API, gleiche Ausgabe, 50% weniger auf Ihrer Rechnung.
Anthropic rechnet in drei Modellstufen ab: Haiku für leichte Aufgaben, Sonnet für alltägliche Workloads und Opus für maximale Leistungsfähigkeit. Alle folgenden Preise gelten pro Million Token. Eine Million Token entspricht ungefähr 750.000 Wörtern — Kontextnutzung summiert sich schneller, als die meisten erwarten.
Haiku 4.5 zu $1/M Input und $5/M Output über RunAPI. Offizieller Preis ist $2/$10.
Sonnet 4.6 zu $3/M Input und $15/M Output über RunAPI. Offizieller Preis ist $6/$30.
Opus 4.7 zu $5/M Input und $25/M Output über RunAPI. Offizieller Preis ist $10/$50.
Cache-Lesevorgänge kosten 90% weniger als Standard-Eingabe-Token — $0.10/M für Haiku über RunAPI. Wenn Sie bei jeder Anfrage denselben System-Prompt senden, kann Caching Ihre Rechnung drastisch senken.
Die folgende Tabelle zeigt die offiziellen Anthropic-Preise neben den RunAPI-Preisen. RunAPI gewährt einen pauschalen 50 %-Rabatt auf alle Claude-Modelle. Keine Mengenverpflichtungen, keine Abonnements.
| Modell | Offizieller Input /M | Offizieller Output /M | RunAPI Input /M | RunAPI Output /M | Kontextfenster |
|---|---|---|---|---|---|
| Opus 4.8 | $15.00 | $75.00 | $7.50 | $37.50 | 200K |
| Opus 4.7 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Opus 4.6 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Sonnet 4.6 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Sonnet 4.5 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Haiku 4.5 | $2.00 | $10.00 | $1.00 | $5.00 | 200K |
Anthropics Prompt-Caching speichert wiederholte Präfixe und berechnet weniger, wenn die gecachte Version wiederverwendet wird. Das ist besonders relevant für Coding-Agenten wie Claude Code, die bei jeder Anfrage denselben System-Prompt und Dateikontext senden.
90 % Rabatt auf Input-Tokens. Ein Sonnet 4.6 Cache-Read kostet über RunAPI $0,30/M statt $3,00/M.
25 % Aufschlag auf den Input — $3,75/M für Sonnet 4.6 über RunAPI. Das gecachte Präfix bleibt 5 Minuten verfügbar.
2x der Input-Rate — $6,00/M für Sonnet 4.6 über RunAPI. Nützlich für lange Coding-Sessions, in denen Kontext häufig wiederverwendet wird.
Anthropic bietet einen 50 %-Rabatt auf alle Modelle für Batch-Anfragen mit bis zu 24 Stunden Wartezeit. RunAPI gibt diesen Rabatt weiter.
Token-Kosten wirken abstrakt, bis Sie sie konkreten Aufgaben zuordnen. Unten finden Sie fünf typische Entwickler-Workloads mit geschätzten monatlichen Kosten bei zwei Nutzungsniveaus. Beachten Sie, dass Eingabe-Token — Ihr System-Prompt, der Gesprächsverlauf, Dateien, die Sie anhängen — bei kontextlastigen Workflows oft mehr kosten als Ausgabe-Token.
| Workload | Modell | Leichte Nutzung (~50 Aufgaben/Tag) | Starke Nutzung (~200 Aufgaben/Tag) | Monatliche Ersparnis vs. offiziell |
|---|---|---|---|---|
| Vibe-Coding-Session (Claude Code) | Sonnet 4.6 | $45/Monat | $180/Monat | $45–$180 |
| PR Code-Review-Agent | Opus 4.7 | $75/Monat | $300/Monat | $75–$300 |
| RAG-gestützter Docs-Chatbot | Haiku 4.5 | $12/Monat | $48/Monat | $12–$48 |
| Content-Generierungspipeline | Sonnet 4.6 | $30/Monat | $120/Monat | $30–$120 |
| Multi-Agenten-Orchestrator | Opus 4.7 | $150/Monat | $600/Monat | $150–$600 |
Entwickler, die an ihre Claude-Limits stoßen, betrachten GPT-5 und Gemini 2.5 Pro oft als Alternativen. Hier sehen Sie, wie die Flaggschiffmodelle bei den tatsächlichen Kosten pro Million Token abschneiden.
| Anbieter | Flagship-Modell | Input /M | Output /M | RunAPI-Rate |
|---|---|---|---|---|
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI gewährt 50 % Rabatt auf alle oben aufgeführten Anbieter. Preise verifiziert im Juni 2026.
Claude Max kostet $100/Monat für intensive Claude Code-Nutzung (oder $200 für den 5x-Plan). Die API rechnet pro Token ab, ohne monatliche Verpflichtung. Eine Sache, die das Abonnement Ihnen nicht sagt: Der Pro-Plan hat sowohl ein tägliches Limit ALS AUCH eine wöchentliche Obergrenze. Wenn Sie ihn also jeden Tag intensiv nutzen, können Sie Mitte der Woche aufgebraucht sein und 3 Tage auf eine Zurücksetzung warten. Die API hat keine solche Obergrenze. Für Entwickler, die unter 10 Millionen Ausgabe-Token pro Monat mit Sonnet 4.6 bleiben, kostet der RunAPI-Weg weniger als das Max-Abonnement.
Unbegrenzte Nutzung von Sonnet und begrenztes Opus in Claude Code. Feste monatliche Kosten. Kein API-Zugriff für Drittanbieter-Tools.
Zahlung pro Token ohne monatliche Verpflichtung. Sonnet 4.6 zu $3/M Input und $15/M Output. $100 kauft etwa 6,7 Millionen Output-Tokens — genug für die meisten einzelnen Entwickler.
Starke tägliche Nutzer, die konsistent mehr als 10 Millionen Output-Tokens pro Monat verbrauchen. Der Break-even-Punkt bei Sonnet 4.6 über RunAPI liegt bei etwa 6,7 Millionen Output-Tokens.
Teams, CI-Pipelines, Multi-Modell-Setups und jedes Tool, das API-Zugriff erfordert (OpenClaw, n8n, Cursor). Keine Obergrenze, keine Warteliste, keine Abonnementbindung. Sie können einfachere Aufgaben außerdem an Haiku 4.5 weiterleiten — es ist pro Token etwa 20x günstiger als Sonnet für Aufgaben, die nicht die volle Leistungsfähigkeit benötigen.
Registrieren Sie sich auf runapi.ai. Für den kostenlosen Tarif ist keine Kreditkarte erforderlich.
Gehen Sie zu Dashboard → API Keys. Erstellen Sie einen Schlüssel und speichern Sie ihn — Sie verwenden ihn als Ihren OpenAI API-Schlüssel.
Setzen Sie die Basis-URL auf https://api.runapi.ai/v1 und verwenden Sie Ihren RunAPI API-Schlüssel. Jeder OpenAI-kompatible Client funktioniert — Python, Node.js, Go, Ruby oder curl.
Verwenden Sie claude-sonnet-4-6, claude-opus-4-7 oder eine beliebige Claude-Modell-ID im model-Parameter. RunAPI übernimmt Routing und Abrechnung zu 50 % des offiziellen Preises.
Das passiert, weil große Kontextfenster — Ihr System-Prompt, der Gesprächsverlauf, angehängte Dateien — die Token-Kosten dominieren. Eine Frage mit großem Kontext kann 20% Ihres 5-Stunden-Fensters verbrauchen. Mit der API steuern Sie genau, welchen Kontext Sie bei jeder Anfrage senden, sodass Sie nicht mehr für Kontext bezahlen, den Sie nicht benötigen.
Die Nutzung von Drittanbieter-Tools wie OpenClaw, n8n oder Cursor mit einem persönlichen Claude-Abonnement kann dazu führen, dass Ihr Konto gesperrt wird. Die Bedingungen von Anthropic erlauben nicht, dass Abonnementpläne externe Apps antreiben. Die API ist der einzige unterstützte Weg — und RunAPI macht daraus Pay-as-you-go ohne monatliche Verpflichtung.
Ja. Setzen Sie ANTHROPIC_BASE_URL auf https://api.runapi.ai und Ihren RunAPI-Schlüssel als API-Schlüssel. Claude Code funktioniert ohne weitere Änderung. Sie zahlen pro Token 50% des offiziellen Preises — kein Abonnement erforderlich.
RunAPI passt innerhalb von 24 Stunden an. Der 50 %-Rabatt wird relativ zu den veröffentlichten Preisen von Anthropic beibehalten.
Ja. Neue Konten erhalten kostenlose Credits, um jedes Modell zu testen. Danach wird ausschließlich nutzungsabhängig ohne Mindestbetrag abgerechnet.
Ja. Cache-Lesevorgänge, 5-Minuten-Schreibvorgänge und 1-Stunden-Schreibvorgänge werden alle zu 50% der Cache-Preise von Anthropic unterstützt. Wenn Sie bei jeder Anfrage denselben großen System-Prompt senden, senken Cache-Lesevorgänge diese Eingabekosten um 90% — von $3.00/M auf $0.30/M bei Sonnet 4.6.
Ja. RunAPI ist OpenAI-kompatibel. Richten Sie jeden OpenAI-Client auf api.runapi.ai/v1 aus und verwenden Sie Claude-Modell-IDs. Wenn Sie Claude bereits über OpenRouter oder ein ähnliches Gateway aufrufen, funktioniert der Wechsel zu RunAPI genauso — Sie ändern eine URL und einen API-Schlüssel.
Pay-as-you-go. Sie laden Ihr Konto mit einem Guthaben auf, und jeder API-Aufruf zieht die Token-Kosten ab. Keine Abonnements, keine Rechnungen, keine Verträge. Sie können außerdem in Ihrem RunAPI-Dashboard ein festes Ausgabenlimit setzen, damit Sie nie eine überraschende Rechnung erhalten — anders als bei direkter Anthropic-Abrechnung, die Nutzer schon unerwartet getroffen hat.
GPT-5.4, GPT-5.4-mini und o3 – RunAPI- vs. offizielle Preise.
Gemini 2.5 Pro und Flash – das günstigste Flaggschiff-Modell.
Kostenvergleich: Claude Code mit API-Abrechnung vs. Max-Abo.
Preisvergleich für 130+ Modelle in Text, Bild, Video und Audio.
Erstellen Sie ein kostenloses RunAPI-Konto, erhalten Sie Ihren API-Schlüssel und rufen Sie Claude Opus, Sonnet oder Haiku zu 50 % des offiziellen Anthropic-Preises auf.