Entrada em cache
Prefixos de prompt repetidos são cobrados a uma taxa de entrada reduzida. A RunAPI repassa o desconto com 50% da taxa em cache da OpenAI.
GPT-5.4 costs $2.50 input and $15 output per million tokens; GPT-5.5 costs $5 and $30. RunAPI gives you the same models at half those rates — same API, same output, same behavior, lower number on your invoice.
OpenAI bills per million tokens, with separate rates for input (your prompt) and output (the model's response). Output tokens cost more — the model has to generate each one. There is also a cheaper cached-input rate when you resend the same prompt prefix. All figures below are per million tokens.
GPT-5.4 a $1,25/M de entrada e $7,50/M de saída pela RunAPI. Taxa oficial é $2,50/$15.
GPT-5.4-mini — the cheaper option for high-volume work where you don't need the full flagship. Billed at 50% off through RunAPI.
GPT-5.5 a $2,50/M de entrada e $15/M de saída pela RunAPI. Taxa oficial é $5/$30.
Tokens de entrada em cache custam uma fração da entrada padrão — repassados com 50% de desconto na RunAPI.
The table shows official OpenAI pricing alongside RunAPI pricing. Output tokens cost significantly more than input tokens — that is by design, since generating each token requires more compute than reading it. RunAPI applies a flat 50% discount across all GPT models. No volume commits, no subscriptions.
| Modelo | Entrada oficial /M | Saída oficial /M | Entrada RunAPI /M | Saída RunAPI /M | Janela de contexto |
|---|---|---|---|---|---|
| GPT-5.5 | $5,00 | $30,00 | $2,50 | $15,00 | 400K |
| GPT-5.4 | $2,50 | $15,00 | $1,25 | $7,50 | 400K |
| GPT-5.4-mini | $0,25 | $2,00 | $0,13 | $1,00 | 400K |
| GPT-5.3-codex | $2,50 | $15,00 | $1,25 | $7,50 | 400K |
OpenAI bills less for cached input tokens and cuts batch request costs in half for jobs that can wait up to 24 hours. Both matter if you're running a coding agent or processing large batches — repeated context and bulk work add up fast.
Prefixos de prompt repetidos são cobrados a uma taxa de entrada reduzida. A RunAPI repassa o desconto com 50% da taxa em cache da OpenAI.
Solicitações enviadas à API em lote são executadas com metade da taxa padrão com até 24 horas de processamento. A RunAPI repassa isso além do seu próprio desconto.
Os modelos GPT-5 permitem definir o esforço de raciocínio. Menor esforço emite menos tokens de raciocínio, reduzindo diretamente o custo de saída na cobrança por uso.
Limite o máximo de tokens de saída por solicitação para controlar custos e evitar gerações excessivas em tarefas agentivas longas.
Token rates look abstract until you map them to real work. A customer-support chatbot handling 50 conversations a day is a different cost profile than a coding agent running all day or a content pipeline processing hundreds of documents. Below are common developer workloads — including automation workflows — with estimated monthly costs at two usage levels, billed at RunAPI rates.
| Carga de trabalho | Modelo | Uso leve (~50 tarefas/dia) | Uso intensivo (~200 tarefas/dia) | Economia mensal vs oficial |
|---|---|---|---|---|
| Agente de codagem (Codex) | GPT-5.3-codex | $20/mês | $80/mês | $20–$80 |
| Chatbot de suporte ao cliente | GPT-5.4-mini | $6/mês | $24/mês | $6–$24 |
| Assistente de conhecimento RAG | GPT-5.4 | $18/mês | $72/mês | $18–$72 |
| Pipeline de geração de conteúdo | GPT-5.4 | $25/mês | $100/mês | $25–$100 |
| Orquestrador multi-agentes | GPT-5.5 | $90/mês | $360/mês | $90–$360 |
Locking into a single provider is a real risk when one price cut overnight can make a competitor 30% cheaper. Here is how the flagship models compare per million tokens — OpenAI, Anthropic, and Google side by side — so you can make the call without digging through three billing pages. RunAPI gives you one API key that routes to all three.
| Provedor | Modelo principal | Entrada /M | Saída /M | Taxa RunAPI |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2,50 | $15,00 | $1,25 / $7,50 |
| Anthropic | Claude Opus 4.7 | $10,00 | $50,00 | $5,00 / $25,00 |
| Gemini 2.5 Pro | $1,25 | $10,00 | $0,63 / $5,00 |
A RunAPI aplica 50% de desconto em todos os provedores listados acima. Preços verificados em junho de 2026.
Cadastre-se em runapi.ai. Nenhum cartão de crédito é necessário para o nível gratuito.
Vá para Painel → Chaves de API. Crie uma chave e salve-a — você a usará como sua chave de API OpenAI.
Defina a URL base como https://api.runapi.ai/v1 e use sua chave RunAPI. Qualquer cliente compatível com OpenAI funciona.
Use gpt-5.4, gpt-5.5 ou qualquer ID de modelo GPT no parâmetro de modelo. A RunAPI gerencia o roteamento e a cobrança com 50% da taxa oficial.
O GPT-5.4 custa $2,50 por milhão de tokens de entrada e $15 por milhão de tokens de saída oficialmente. O GPT-5.5 custa $5 e $30. Através da RunAPI, cada modelo GPT é cobrado pela metade dessas taxas — o GPT-5.4 custa $1,25 de entrada e $7,50 de saída por milhão de tokens.
A RunAPI negocia preços de volume com os provedores de modelos e repassa as economias para os desenvolvedores. As solicitações chegam aos mesmos modelos OpenAI com saída, filtros de segurança e comportamento idênticos, então a única diferença é a taxa mais baixa na sua fatura. Não há troca de qualidade e nenhuma camada de cobrança separada — o desconto se aplica automaticamente a todos os modelos GPT.
Yes. New RunAPI accounts get free credits to test any GPT model — no credit card needed. After that, billing is pay-as-you-go with no monthly minimum and no subscription. Fund a balance and each API call deducts its token cost. You can top up any amount and track usage per model in the dashboard.
Yes, and it works well for automation tools like n8n, Make, or Zapier. Each workflow step that calls a GPT model is billed by tokens used — there is no separate per-call fee or rate limit tier. For workflows that run on a schedule or process batches, the Batch API discount (50% off) applies and stacks with RunAPI's base discount, so recurring automation jobs cost significantly less.
Image inputs are billed by tile — OpenAI divides the image into 512×512 tiles and charges per tile. Audio is billed per second of input. Neither uses the per-million-token unit. RunAPI passes through image and audio pricing at the same 50% discount, so a GPT-4o vision request or Whisper transcription costs half the official rate.
Sim. A RunAPI é compatível com OpenAI. Aponte qualquer cliente OpenAI para https://api.runapi.ai/v1, use sua chave RunAPI e passe um ID de modelo GPT. O código existente que já usa o SDK OpenAI funciona sem quaisquer alterações além da URL base e da chave, então migrar um projeto estabelecido leva cerca de um minuto.
Sim. O GPT-5.3-codex está disponível através da RunAPI com 50% da taxa oficial, que é $1,25 de entrada e $7,50 de saída por milhão de tokens. Funciona com Codex e outras ferramentas de codagem compatíveis com OpenAI substituindo a URL base e a chave nas configurações. Os descontos de entrada em cache e em lote também são repassados, reduzindo ainda mais o custo efetivo de sessões de codagem repetitivas.
Sim. As novas contas RunAPI recebem créditos gratuitos para testar qualquer modelo GPT antes de se comprometer. Depois disso, a cobrança é estritamente por uso, sem gasto mínimo, sem assinatura e sem compromisso mensal — você financia um saldo e cada chamada deduz seu custo de token. Você pode recarregar qualquer valor e acompanhar o uso por modelo no painel.
Claude Opus, Sonnet e Haiku com 50% de desconto em relação às tarifas da Anthropic.
Comparativo de precos do ChatGPT e GPT-5 para desenvolvedores.
Custo real do Codex CLI por sessão com cobrança via RunAPI.
Compare mais de 130 modelos de texto, imagem, vídeo e áudio.
Crie uma conta RunAPI gratuita, obtenha sua chave de API e chame qualquer modelo OpenAI GPT com 50% de desconto nos preços oficiais.