Entrada en caché
Los prefijos de prompt repetidos se facturan a una tarifa de entrada reducida. RunAPI transfiere el descuento al 50% de la tarifa en caché de OpenAI.
GPT-5.4 cuesta $2.50 de entrada y $15 de salida por millón de tokens; GPT-5.5 cuesta $5 y $30. RunAPI te ofrece los mismos modelos a la mitad de esas tarifas — misma API, misma salida, mismo comportamiento, número más bajo en tu factura.
OpenAI factura por millón de tokens, con tarifas separadas para entrada (tu prompt) y salida (la respuesta del modelo). Los tokens de salida cuestan más — el modelo tiene que generar cada uno. También hay una tarifa de entrada en caché más económica cuando reenvías el mismo prefijo de prompt. Todas las cifras a continuación son por millón de tokens.
GPT-5.4 a $1.25/M de entrada y $7.50/M de salida a través de RunAPI. La tarifa oficial es $2.50/$15.
GPT-5.4-mini — la opción más económica para trabajo de alto volumen donde no necesitas el flagship completo. Facturado al 50% de descuento a través de RunAPI.
GPT-5.5 a $2.50/M de entrada y $15/M de salida a través de RunAPI. La tarifa oficial es $5/$30.
Los tokens de entrada en caché cuestan una fracción de la entrada estándar — transferidos al 50% en RunAPI.
La tabla muestra los precios oficiales de OpenAI junto con los precios de RunAPI. Los tokens de salida cuestan significativamente más que los de entrada — eso es por diseño, ya que generar cada token requiere más cómputo que leerlo. RunAPI aplica un descuento fijo del 50% en todos los modelos GPT. Sin compromisos de volumen, sin suscripciones.
| Modelo | Entrada oficial /M | Salida oficial /M | Entrada RunAPI /M | Salida RunAPI /M | Ventana de contexto |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI cobra menos por los tokens de entrada en caché y reduce a la mitad los costos de solicitudes por lotes para trabajos que pueden esperar hasta 24 horas. Ambos importan si ejecutas un agente de codificación o procesas grandes lotes — el contexto repetido y el trabajo masivo se acumulan rápido.
Los prefijos de prompt repetidos se facturan a una tarifa de entrada reducida. RunAPI transfiere el descuento al 50% de la tarifa en caché de OpenAI.
Las solicitudes enviadas a la API por lotes se ejecutan a la mitad de la tarifa estándar con hasta 24 horas de entrega. RunAPI transfiere esto además de su propio descuento.
Los modelos GPT-5 te permiten establecer el esfuerzo de razonamiento. Un menor esfuerzo emite menos tokens de razonamiento, reduciendo directamente el costo de salida en la facturación medida.
Limita los tokens de salida máximos por solicitud para acotar el costo y evitar generaciones descontroladas en tareas agénticas largas.
Las tarifas de tokens parecen abstractas hasta que las mapeas al trabajo real. Un chatbot de soporte al cliente que maneja 50 conversaciones al día tiene un perfil de costo diferente al de un agente de codificación que trabaja todo el día o un pipeline de contenido que procesa cientos de documentos. A continuación se muestran cargas de trabajo comunes para desarrolladores — incluyendo flujos de trabajo de automatización — con costos mensuales estimados en dos niveles de uso, facturados a las tarifas de RunAPI.
| Carga de trabajo | Modelo | Uso ligero (~50 tareas/día) | Uso intensivo (~200 tareas/día) | Ahorro mensual vs oficial |
|---|---|---|---|---|
| Agente de codificación (Codex) | GPT-5.3-codex | $20/mes | $80/mes | $20–$80 |
| Chatbot de soporte al cliente | GPT-5.4-mini | $6/mes | $24/mes | $6–$24 |
| Asistente de conocimiento RAG | GPT-5.4 | $18/mes | $72/mes | $18–$72 |
| Pipeline de generación de contenido | GPT-5.4 | $25/mes | $100/mes | $25–$100 |
| Orquestador multi-agente | GPT-5.5 | $90/mes | $360/mes | $90–$360 |
Bloquearse con un solo proveedor es un riesgo real cuando un recorte de precios de la noche a la mañana puede hacer que un competidor sea un 30% más barato. Aquí se muestra cómo los modelos insignia se comparan por millón de tokens — OpenAI, Anthropic y Google uno al lado del otro — para que puedas decidir sin tener que hurgar en tres páginas de facturación. RunAPI te da una clave API que enruta a los tres.
| Proveedor | Modelo insignia | Entrada /M | Salida /M | Tarifa RunAPI |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI aplica un 50% de descuento en todos los proveedores listados anteriormente. Precios verificados en junio de 2026.
Regístrate en runapi.ai. No se requiere tarjeta de crédito para el nivel gratuito.
Ve a Panel → Claves API. Crea una clave y guárdala — la usarás como tu clave API de OpenAI.
Establece la URL base en https://runapi.ai/v1 y usa tu clave RunAPI. Cualquier cliente compatible con OpenAI funciona.
Usa gpt-5.4, gpt-5.5 o cualquier ID de modelo GPT en el parámetro del modelo. RunAPI gestiona el enrutamiento y la facturación al 50% de la tarifa oficial.
GPT-5.4 cuesta $2.50 por millón de tokens de entrada y $15 por millón de tokens de salida oficialmente. GPT-5.5 cuesta $5 y $30. A través de RunAPI, todos los modelos GPT se facturan a la mitad de esas tarifas — GPT-5.4 corre $1.25 de entrada y $7.50 de salida por millón de tokens.
RunAPI negocia precios de volumen con los proveedores de modelos y transfiere los ahorros a los desarrolladores. Las solicitudes llegan a los mismos modelos de OpenAI con salida, filtros de seguridad y comportamiento idénticos, por lo que la única diferencia es la tarifa más baja en tu factura. No hay compromiso de calidad y no hay nivel de facturación separado — el descuento se aplica automáticamente a todos los modelos GPT.
Sí. Las cuentas nuevas de RunAPI obtienen créditos gratuitos para probar cualquier modelo GPT — no se requiere tarjeta de crédito. Después de eso, la facturación es de pago por uso sin mínimo mensual y sin suscripción. Financia un saldo y cada llamada API descuenta su costo de tokens. Puedes recargar cualquier cantidad y rastrear el uso por modelo en el panel.
Sí, y funciona bien para herramientas de automatización como n8n, Make o Zapier. Cada paso del flujo de trabajo que llama a un modelo GPT se factura por los tokens usados — no hay cargo separado por llamada ni nivel de límite de velocidad. Para flujos de trabajo que se ejecutan en un horario o procesan lotes, se aplica el descuento de la API por lotes (50% de descuento) y se acumula con el descuento base de RunAPI, por lo que los trabajos de automatización recurrentes cuestan significativamente menos.
Las entradas de imagen se facturan por mosaico — OpenAI divide la imagen en mosaicos de 512×512 y cobra por mosaico. El audio se factura por segundo de entrada. Ninguno usa la unidad de por millón de tokens. RunAPI transfiere los precios de imagen y audio con el mismo descuento del 50%, por lo que una solicitud de visión GPT-4o o transcripción de Whisper cuesta la mitad de la tarifa oficial.
Sí. RunAPI es compatible con OpenAI. Apunta cualquier cliente OpenAI a https://runapi.ai/v1, usa tu clave RunAPI y pasa un ID de modelo GPT. El código existente que ya usa el SDK de OpenAI funciona sin ningún cambio más allá de la URL base y la clave, por lo que migrar un proyecto establecido lleva aproximadamente un minuto.
Sí. GPT-5.3-codex está disponible a través de RunAPI al 50% de la tarifa oficial, que es $1.25 de entrada y $7.50 de salida por millón de tokens. Funciona con Codex y otras herramientas de codificación compatibles con OpenAI anulando la URL base y la clave en su configuración. Los descuentos de entrada en caché y por lotes también se transfieren, reduciendo el costo efectivo de las sesiones de codificación repetitivas.
Claude Opus, Sonnet y Haiku al 50% de las tarifas oficiales de Anthropic.
Comparativa de precios de ChatGPT y GPT-5 para desarrolladores.
Coste real de Codex CLI por sesion con facturación RunAPI.
Compara 220+ modelos de texto, imagen, video y audio.
Crea una cuenta gratuita de RunAPI, obtén tu clave API y llama a cualquier modelo GPT de OpenAI al 50% del precio oficial.