# Preços da API OpenAI em 2026

GPT-5.4 costs $2.50 input and $15 output per million tokens; GPT-5.5 costs $5 and $30. RunAPI gives you the same models at half those rates — same API, same output, same behavior, lower number on your invoice.

*Updated June 18, 2026 · RunAPI Editorial*

## Quanto custa a API OpenAI agora?

OpenAI bills per million tokens, with separate rates for input (your prompt) and output (the model&#39;s response). Output tokens cost more — the model has to generate each one. There is also a cheaper cached-input rate when you resend the same prompt prefix. All figures below are per million tokens.

- **Mais popular**: GPT-5.4 a $1,25/M de entrada e $7,50/M de saída pela RunAPI. Taxa oficial é $2,50/$15.
- **Opção mais barata**: GPT-5.4-mini — the cheaper option for high-volume work where you don&#39;t need the full flagship. Billed at 50% off through RunAPI.
- **Capacidade máxima**: GPT-5.5 a $2,50/M de entrada e $15/M de saída pela RunAPI. Taxa oficial é $5/$30.
- **Desconto de cache**: Tokens de entrada em cache custam uma fração da entrada padrão — repassados com 50% de desconto na RunAPI.

## Quanto custa cada modelo GPT por milhão de tokens?

The table shows official OpenAI pricing alongside RunAPI pricing. Output tokens cost significantly more than input tokens — that is by design, since generating each token requires more compute than reading it. RunAPI applies a flat 50% discount across all GPT models. No volume commits, no subscriptions.

| Modelo | Entrada oficial /M | Saída oficial /M | Entrada RunAPI /M | Saída RunAPI /M | Janela de contexto |
|---|---|---|---|---|---|
| GPT-5.5 | $5,00 | $30,00 | $2,50 | $15,00 | 400K |
| GPT-5.4 | $2,50 | $15,00 | $1,25 | $7,50 | 400K |
| GPT-5.4-mini | $0,25 | $2,00 | $0,13 | $1,00 | 400K |
| GPT-5.3-codex | $2,50 | $15,00 | $1,25 | $7,50 | 400K |

## Como os descontos de cache e lote reduzem sua conta GPT?

OpenAI bills less for cached input tokens and cuts batch request costs in half for jobs that can wait up to 24 hours. Both matter if you&#39;re running a coding agent or processing large batches — repeated context and bulk work add up fast.

### Entrada em cache

Prefixos de prompt repetidos são cobrados a uma taxa de entrada reduzida. A RunAPI repassa o desconto com 50% da taxa em cache da OpenAI.

### API em lote (50% de desconto)

Solicitações enviadas à API em lote são executadas com metade da taxa padrão com até 24 horas de processamento. A RunAPI repassa isso além do seu próprio desconto.

### Esforço de raciocínio

Os modelos GPT-5 permitem definir o esforço de raciocínio. Menor esforço emite menos tokens de raciocínio, reduzindo diretamente o custo de saída na cobrança por uso.

### Controle de tokens de saída

Limite o máximo de tokens de saída por solicitação para controlar custos e evitar gerações excessivas em tarefas agentivas longas.


## Quanto custa a API GPT para cargas de trabalho reais?

Token rates look abstract until you map them to real work. A customer-support chatbot handling 50 conversations a day is a different cost profile than a coding agent running all day or a content pipeline processing hundreds of documents. Below are common developer workloads — including automation workflows — with estimated monthly costs at two usage levels, billed at RunAPI rates.

| Carga de trabalho | Modelo | Uso leve (~50 tarefas/dia) | Uso intensivo (~200 tarefas/dia) | Economia mensal vs oficial |
|---|---|---|---|---|
| Agente de codagem (Codex) | GPT-5.3-codex | $20/mês | $80/mês | $20–$80 |
| Chatbot de suporte ao cliente | GPT-5.4-mini | $6/mês | $24/mês | $6–$24 |
| Assistente de conhecimento RAG | GPT-5.4 | $18/mês | $72/mês | $18–$72 |
| Pipeline de geração de conteúdo | GPT-5.4 | $25/mês | $100/mês | $25–$100 |
| Orquestrador multi-agentes | GPT-5.5 | $90/mês | $360/mês | $90–$360 |

## A API OpenAI é mais barata que Claude e Gemini?

Locking into a single provider is a real risk when one price cut overnight can make a competitor 30% cheaper. Here is how the flagship models compare per million tokens — OpenAI, Anthropic, and Google side by side — so you can make the call without digging through three billing pages. RunAPI gives you one API key that routes to all three.

| Provedor | Modelo principal | Entrada /M | Saída /M | Taxa RunAPI |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2,50 | $15,00 | $1,25 / $7,50 |
| Anthropic | Claude Opus 4.7 | $10,00 | $50,00 | $5,00 / $25,00 |
| Google | Gemini 2.5 Pro | $1,25 | $10,00 | $0,63 / $5,00 |

## Como usar a API OpenAI através da RunAPI

1. **Criar uma conta RunAPI** — Cadastre-se em runapi.ai. Nenhum cartão de crédito é necessário para o nível gratuito.
2. **Copiar sua chave de API** — Vá para Painel → Chaves de API. Crie uma chave e salve-a — você a usará como sua chave de API OpenAI.
3. **Apontar seu SDK para a RunAPI** — Defina a URL base como https://runapi.ai/v1 e use sua chave RunAPI. Qualquer cliente compatível com OpenAI funciona.
4. **Começar a fazer solicitações** — Use gpt-5.4, gpt-5.5 ou qualquer ID de modelo GPT no parâmetro de modelo. A RunAPI gerencia o roteamento e a cobrança com 50% da taxa oficial.

## FAQ sobre Preços da API OpenAI

### Quanto custa a API GPT-5 da OpenAI?

O GPT-5.4 custa $2,50 por milhão de tokens de entrada e $15 por milhão de tokens de saída oficialmente. O GPT-5.5 custa $5 e $30. Através da RunAPI, cada modelo GPT é cobrado pela metade dessas taxas — o GPT-5.4 custa $1,25 de entrada e $7,50 de saída por milhão de tokens.

### Por que a RunAPI é 50% mais barata que a OpenAI?

A RunAPI negocia preços de volume com os provedores de modelos e repassa as economias para os desenvolvedores. As solicitações chegam aos mesmos modelos OpenAI com saída, filtros de segurança e comportamento idênticos, então a única diferença é a taxa mais baixa na sua fatura. Não há troca de qualidade e nenhuma camada de cobrança separada — o desconto se aplica automaticamente a todos os modelos GPT.

### Is there a free tier for the OpenAI API?

Yes. New RunAPI accounts get free credits to test any GPT model — no credit card needed. After that, billing is pay-as-you-go with no monthly minimum and no subscription. Fund a balance and each API call deducts its token cost. You can top up any amount and track usage per model in the dashboard.

### I&#39;m building an n8n bot — how does API billing work for automation workflows?

Yes, and it works well for automation tools like n8n, Make, or Zapier. Each workflow step that calls a GPT model is billed by tokens used — there is no separate per-call fee or rate limit tier. For workflows that run on a schedule or process batches, the Batch API discount (50% off) applies and stacks with RunAPI&#39;s base discount, so recurring automation jobs cost significantly less.

### How are image and audio inputs priced — it&#39;s not just tokens?

Image inputs are billed by tile — OpenAI divides the image into 512×512 tiles and charges per tile. Audio is billed per second of input. Neither uses the per-million-token unit. RunAPI passes through image and audio pricing at the same 50% discount, so a GPT-4o vision request or Whisper transcription costs half the official rate.

### Posso usar o SDK da OpenAI com a RunAPI?

Sim. A RunAPI é compatível com OpenAI. Aponte qualquer cliente OpenAI para https://runapi.ai/v1, use sua chave RunAPI e passe um ID de modelo GPT. O código existente que já usa o SDK OpenAI funciona sem quaisquer alterações além da URL base e da chave, então migrar um projeto estabelecido leva cerca de um minuto.

### A RunAPI suporta GPT-5.3-codex para codagem?

Sim. O GPT-5.3-codex está disponível através da RunAPI com 50% da taxa oficial, que é $1,25 de entrada e $7,50 de saída por milhão de tokens. Funciona com Codex e outras ferramentas de codagem compatíveis com OpenAI substituindo a URL base e a chave nas configurações. Os descontos de entrada em cache e em lote também são repassados, reduzindo ainda mais o custo efetivo de sessões de codagem repetitivas.

### Existe um nível gratuito?

Sim. As novas contas RunAPI recebem créditos gratuitos para testar qualquer modelo GPT antes de se comprometer. Depois disso, a cobrança é estritamente por uso, sem gasto mínimo, sem assinatura e sem compromisso mensal — você financia um saldo e cada chamada deduz seu custo de token. Você pode recarregar qualquer valor e acompanhar o uso por modelo no painel.

