Entrée mise en cache
Les préfixes de prompt répétés sont facturés à un tarif d'entrée réduit. RunAPI répercute la remise à 50 % du tarif mis en cache d'OpenAI.
GPT-5.4 costs $2.50 input and $15 output per million tokens; GPT-5.5 costs $5 and $30. RunAPI gives you the same models at half those rates — same API, same output, same behavior, lower number on your invoice.
OpenAI bills per million tokens, with separate rates for input (your prompt) and output (the model's response). Output tokens cost more — the model has to generate each one. There is also a cheaper cached-input rate when you resend the same prompt prefix. All figures below are per million tokens.
GPT-5.4 à $1,25/M en entrée et $7,50/M en sortie via RunAPI. Tarif officiel : $2,50/$15.
GPT-5.4-mini — the cheaper option for high-volume work where you don't need the full flagship. Billed at 50% off through RunAPI.
GPT-5.5 à $2,50/M en entrée et $15/M en sortie via RunAPI. Tarif officiel : $5/$30.
Les tokens d'entrée mis en cache coûtent une fraction de l'entrée standard — répercutés à 50 % sur RunAPI.
The table shows official OpenAI pricing alongside RunAPI pricing. Output tokens cost significantly more than input tokens — that is by design, since generating each token requires more compute than reading it. RunAPI applies a flat 50% discount across all GPT models. No volume commits, no subscriptions.
| Modèle | Entrée officielle /M | Sortie officielle /M | Entrée RunAPI /M | Sortie RunAPI /M | Fenêtre de contexte |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI bills less for cached input tokens and cuts batch request costs in half for jobs that can wait up to 24 hours. Both matter if you're running a coding agent or processing large batches — repeated context and bulk work add up fast.
Les préfixes de prompt répétés sont facturés à un tarif d'entrée réduit. RunAPI répercute la remise à 50 % du tarif mis en cache d'OpenAI.
Les requêtes soumises à l'API Batch sont exécutées à la moitié du tarif standard avec un délai pouvant aller jusqu'à 24 heures. RunAPI répercute cette remise en plus de la sienne.
Les modèles GPT-5 permettent de définir l'effort de raisonnement. Un effort réduit émet moins de tokens de raisonnement, ce qui réduit directement le coût de sortie sur une facturation au compteur.
Limitez le nombre maximum de tokens de sortie par requête pour maîtriser les coûts et éviter les générations incontrôlées sur de longues tâches agentiques.
Token rates look abstract until you map them to real work. A customer-support chatbot handling 50 conversations a day is a different cost profile than a coding agent running all day or a content pipeline processing hundreds of documents. Below are common developer workloads — including automation workflows — with estimated monthly costs at two usage levels, billed at RunAPI rates.
| Charge de travail | Modèle | Utilisation légère (~50 tâches/jour) | Utilisation intensive (~200 tâches/jour) | Économie mensuelle vs officiel |
|---|---|---|---|---|
| Agent de codage (Codex) | GPT-5.3-codex | $20/mois | $80/mois | $20–$80 |
| Chatbot de support client | GPT-5.4-mini | $6/mois | $24/mois | $6–$24 |
| Assistant de connaissances RAG | GPT-5.4 | $18/mois | $72/mois | $18–$72 |
| Pipeline de génération de contenu | GPT-5.4 | $25/mois | $100/mois | $25–$100 |
| Orchestrateur multi-agents | GPT-5.5 | $90/mois | $360/mois | $90–$360 |
Locking into a single provider is a real risk when one price cut overnight can make a competitor 30% cheaper. Here is how the flagship models compare per million tokens — OpenAI, Anthropic, and Google side by side — so you can make the call without digging through three billing pages. RunAPI gives you one API key that routes to all three.
| Fournisseur | Modèle phare | Entrée /M | Sortie /M | Tarif RunAPI |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI applique une remise de 50 % sur tous les fournisseurs listés ci-dessus. Prix vérifiés en juin 2026.
Inscrivez-vous sur runapi.ai. Aucune carte de crédit requise pour le niveau gratuit.
Accédez à Tableau de bord → Clés API. Créez une clé et sauvegardez-la — vous l'utiliserez comme votre clé API OpenAI.
Définissez l'URL de base sur https://api.runapi.ai/v1 et utilisez votre clé RunAPI. Tout client compatible OpenAI fonctionne.
Utilisez gpt-5.4, gpt-5.5 ou n'importe quel identifiant de modèle GPT dans le paramètre model. RunAPI gère le routage et la facturation à 50 % du tarif officiel.
GPT-5.4 coûte officiellement $2,50 par million de tokens en entrée et $15 par million en sortie. GPT-5.5 coûte $5 et $30. Via RunAPI, chaque modèle GPT est facturé à la moitié de ces tarifs — GPT-5.4 revient à $1,25 en entrée et $7,50 en sortie par million de tokens.
RunAPI négocie des tarifs de volume avec les fournisseurs de modèles et répercute les économies sur les développeurs. Les requêtes atteignent les mêmes modèles OpenAI avec des résultats, des filtres de sécurité et un comportement identiques, de sorte que la seule différence est le tarif inférieur sur votre facture. Il n'y a aucun compromis de qualité et aucun niveau de facturation distinct — la remise s'applique automatiquement à chaque modèle GPT.
Yes. New RunAPI accounts get free credits to test any GPT model — no credit card needed. After that, billing is pay-as-you-go with no monthly minimum and no subscription. Fund a balance and each API call deducts its token cost. You can top up any amount and track usage per model in the dashboard.
Yes, and it works well for automation tools like n8n, Make, or Zapier. Each workflow step that calls a GPT model is billed by tokens used — there is no separate per-call fee or rate limit tier. For workflows that run on a schedule or process batches, the Batch API discount (50% off) applies and stacks with RunAPI's base discount, so recurring automation jobs cost significantly less.
Image inputs are billed by tile — OpenAI divides the image into 512×512 tiles and charges per tile. Audio is billed per second of input. Neither uses the per-million-token unit. RunAPI passes through image and audio pricing at the same 50% discount, so a GPT-4o vision request or Whisper transcription costs half the official rate.
Oui. RunAPI est compatible OpenAI. Pointez n'importe quel client OpenAI vers https://api.runapi.ai/v1, utilisez votre clé RunAPI et passez un identifiant de modèle GPT. Le code existant utilisant déjà le SDK OpenAI fonctionne sans aucune modification au-delà de l'URL de base et de la clé, donc la migration d'un projet établi prend environ une minute.
Oui. GPT-5.3-codex est disponible via RunAPI à 50 % du tarif officiel, soit $1,25 en entrée et $7,50 en sortie par million de tokens. Il fonctionne avec Codex et d'autres outils de codage compatibles OpenAI en remplaçant l'URL de base et la clé dans leurs paramètres. Les remises sur l'entrée mise en cache et par lots sont également répercutées, ce qui réduit davantage le coût effectif des sessions de codage répétitives.
Oui. Les nouveaux comptes RunAPI reçoivent des crédits gratuits pour tester n'importe quel modèle GPT avant de s'engager. Ensuite, la facturation est strictement à l'usage sans dépense minimale, sans abonnement et sans engagement mensuel — vous alimentez un solde et chaque appel déduit son coût en tokens. Vous pouvez recharger n'importe quel montant et surveiller l'utilisation par modèle dans le tableau de bord.
Claude Opus, Sonnet et Haiku à 50% des tarifs officiels Anthropic.
Comparatif des tarifs ChatGPT et GPT-5 pour les développeurs.
Coût réel de Codex CLI par session avec la facturation RunAPI.
Comparez plus de 130 modèles en texte, image, vidéo et audio.
Créez un compte RunAPI gratuit, obtenez votre clé API et appelez n'importe quel modèle GPT d'OpenAI à 50 % de la tarification officielle.