Precios de la API LLM

Precios de la API de Gemini en 2026

Google cobra $1.25–$10 por millón de tokens para Gemini 2.5 Pro y mucho menos para Flash. El nivel gratuito te da alrededor de 20 solicitudes por minuto antes de alcanzar el límite. RunAPI refleja todos los modelos Gemini a la mitad de la tarifa oficial — pega tu clave directamente en cualquier cliente compatible con OpenAI.

Actualizado June 18, 2026 RunAPI Editorial
De un vistazo

¿Cuánto cuesta la API de Gemini ahora mismo?

Google publica precios por token para dos niveles principales: Flash para tareas rápidas y económicas y Pro para máxima capacidad. También hay un nivel gratuito con límites de solicitudes diarias — útil para pruebas, pero los agentes de IA y las herramientas de codificación pueden agotarlo rápidamente. Todos los precios a continuación son por millón de tokens, la unidad de facturación que usa Google.

Opción más económica

Gemini 2.5 Flash a $0.08/M de entrada y $0.30/M de salida a través de RunAPI. La tarifa oficial es $0.15/$0.60.

Máxima capacidad

Gemini 2.5 Pro a $0.63/M de entrada y $5.00/M de salida a través de RunAPI. La tarifa oficial es $1.25/$10.

Nivel gratuito

El nivel gratuito de Google te da alrededor de 20 solicitudes por minuto y 500 solicitudes por día en Flash — suficiente para prototipos, pero puedes agotarlo en pocas horas con un agente de IA.

Insignia más económico

Gemini 2.5 Pro supera a Claude Sonnet y GPT-5.4 en precio de entrada, convirtiéndolo en el insignia más económico de los tres grandes.

Desglose modelo por modelo

¿Cuánto cuesta cada modelo Gemini por millón de tokens?

La tabla siguiente muestra los precios oficiales de Google junto con los precios de RunAPI. RunAPI aplica un descuento fijo del 50% en todos los modelos Gemini. Sin compromisos de volumen, sin suscripciones.

Modelo Entrada oficial /M Salida oficial /M Entrada RunAPI /M Salida RunAPI /M Ventana de contexto
Gemini 2.5 Pro $1.25 $10.00 $0.63 $5.00 1M
Gemini 2.5 Flash $0.15 $0.60 $0.08 $0.30 1M
Gemini 2.5 Flash-Lite $0.10 $0.40 $0.05 $0.20 1M
Nivel gratuito

¿Cómo funciona el nivel gratuito de Gemini de Google?

Google ofrece un nivel gratuito para que puedas hacer prototipos antes de pagar. El nivel gratuito limita las solicitudes a alrededor de 20 por minuto y 500 por día en Gemini 2.5 Flash. Cuando alcanzas el límite, obtienes un error — no se te factura automáticamente. El nivel gratuito solo está disponible en ciertos países; si el endpoint gratuito no está disponible en tu región, la API de pago o RunAPI es el siguiente paso.

Límite de solicitudes diarias

Hasta 500 solicitudes por día en Gemini 2.5 Flash a través del nivel gratuito. Suficiente para hacer prototipos y proyectos de bajo volumen, pero los agentes de IA y las herramientas de codificación pueden agotarlo en pocas horas.

Límites de velocidad

El nivel gratuito limita las solicitudes a alrededor de 20 por minuto. Cualquier tráfico de ráfaga — como ejecutar un agente de IA — alcanzará este límite rápidamente y comenzará a devolver errores.

Términos de uso de datos

Las entradas del nivel gratuito pueden usarse para mejorar los productos de Google. El tráfico del nivel de pago y de RunAPI no se usa para entrenamiento, lo cual importa para datos sensibles.

Cuándo actualizar

Pasa al nivel de pago o RunAPI una vez que necesites un rendimiento constante, límites de velocidad más altos o un manejo de datos más sólido. RunAPI cobra el 50% de la tarifa oficial de pago sin límite diario.

Comparación de proveedores

¿Es Gemini más barato que Claude y GPT?

Los desarrolladores a menudo comparan Gemini con Claude Sonnet y GPT-5.4. Aquí se muestra cómo los modelos insignia se comparan en base a costos por millón de tokens a través de RunAPI.

Proveedor Modelo insignia Entrada /M Salida /M Tarifa RunAPI
Google Gemini 2.5 Pro $1.25 $10.00 $0.63 / $5.00
OpenAI GPT-5.4 $2.50 $15.00 $1.25 / $7.50
Anthropic Claude Sonnet 4.6 $6.00 $30.00 $3.00 / $15.00

RunAPI aplica un 50% de descuento en todos los proveedores listados anteriormente. Gemini 2.5 Pro es el insignia más económico en precio de entrada. Precios verificados en junio de 2026.

Costos del mundo real

¿Cuánto cuesta realmente la API de Gemini para cargas de trabajo reales?

Los costos de tokens parecen abstractos hasta que los vinculas a tareas reales. A continuación se muestran cinco cargas de trabajo comunes para desarrolladores con costos mensuales estimados en dos niveles de uso a través de RunAPI.

Carga de trabajo Modelo Uso ligero (~50 tareas/día) Uso intensivo (~200 tareas/día) Ahorro mensual vs oficial
Análisis de documentos de contexto largo Gemini 2.5 Pro $18/mes $72/mes $18–$72
Clasificación de alto volumen Gemini 2.5 Flash $3/mes $12/mes $3–$12
Chatbot de documentación con RAG Gemini 2.5 Flash $5/mes $20/mes $5–$20
Pipeline de generación de contenido Gemini 2.5 Pro $15/mes $60/mes $15–$60
Orquestador multi-agente Gemini 2.5 Pro $60/mes $240/mes $60–$240
Primeros pasos

Cómo acceder a la API de Gemini a través de RunAPI

1

Crea una cuenta RunAPI

Regístrate en runapi.ai. No se requiere tarjeta de crédito para el nivel gratuito.

2

Copia tu clave API

Ve a Panel → Claves API. Crea una clave y guárdala — la usarás como tu clave API de OpenAI.

3

Apunta tu SDK a RunAPI

Establece la URL base en https://runapi.ai/v1 y usa tu clave API de RunAPI. Cualquier cliente compatible con OpenAI funciona — Python, Node.js, Go, Ruby o curl.

4

Empieza a hacer solicitudes

Usa gemini-2.5-pro, gemini-2.5-flash o cualquier ID de modelo Gemini en el parámetro del modelo. RunAPI gestiona el enrutamiento y la facturación al 50% de la tarifa oficial.

Preguntas frecuentes

Preguntas frecuentes sobre precios de la API de Gemini

¿Cuánto cuesta la API de Gemini?

Los precios oficiales de Google para Gemini 2.5 Pro son $1.25/M de entrada y $10/M de salida. Gemini 2.5 Flash es $0.15/M de entrada y $0.60/M de salida. A través de RunAPI, todos los modelos Gemini son a la mitad de esa tarifa, sin suscripción ni compromiso de volumen. Solo pagas por los tokens que usa cada solicitud.

¿Es Gemini más barato que Claude y GPT?

En precio de entrada, sí. Gemini 2.5 Pro a $1.25/M de entrada supera a GPT-5.4 ($2.50) y Claude Sonnet ($6) en la tarifa oficial, convirtiéndolo en el insignia más económico de los tres grandes. RunAPI reduce a la mitad los tres, por lo que la brecha se mantiene.

¿Cuáles son los límites de velocidad en el nivel gratuito y qué sucede cuando los alcanzo?

El nivel gratuito te limita a alrededor de 20 solicitudes por minuto y 500 solicitudes por día en Gemini 2.5 Flash. Cuando alcanzas el límite, las solicitudes devuelven un error — no se te factura automáticamente. Las entradas del nivel gratuito pueden usarse para mejorar los productos de Google, así que evita los datos sensibles. Una vez que necesites un rendimiento constante, pasa al nivel de pago.

¿Por qué RunAPI es un 50% más barato que la API oficial?

RunAPI negocia precios de volumen con los proveedores de modelos y transfiere los ahorros a los desarrolladores. No hay diferencia de calidad — mismos modelos, misma API compatible con OpenAI, misma salida. Solo cambias la URL base y la clave, y tu código cliente existente sigue funcionando sin cambios.

¿Puedo usar Gemini con el SDK de OpenAI?

Sí. RunAPI es compatible con OpenAI. Apunta cualquier cliente OpenAI a runapi.ai/v1 y usa IDs de modelos Gemini como gemini-2.5-pro. El código SDK de OpenAI existente funciona sin cambios más allá de la URL base y la clave.

¿Por qué es Gemini bueno para tareas de contexto largo?

Gemini 2.5 Pro y Flash ofrecen una ventana de contexto de 1M tokens, mayor que la mayoría de los modelos Claude y GPT. Combinado con precios de entrada bajos, esto hace que Gemini sea rentable para analizar documentos largos, bases de código grandes o muchos archivos a la vez.

Sigo agotando los límites del nivel gratuito. ¿Cuáles son mis opciones?

RunAPI te da una clave API que funciona con Gemini, Claude y GPT — sin configuración de proyecto de Google Cloud, sin cuenta de facturación que gestionar. Si has alcanzado los límites del nivel gratuito o encontrado que ninguna clave API gratuita funciona en tu región, el acceso de pago de RunAPI está disponible globalmente al 50% de las tarifas oficiales.

¿Cómo funciona la facturación?

Pago por uso. Financias tu cuenta con un saldo, y cada llamada API descuenta el costo de tokens a la mitad de la tarifa oficial. Sin suscripciones, sin facturas, sin contratos. Puedes monitorear el gasto por clave desde el panel de RunAPI y configurar alertas antes de que el saldo sea bajo.

RELACIONADO

Explorar más

Empieza a usar Gemini a mitad de precio.

Crea una cuenta gratuita de RunAPI, obtén tu clave API y comienza a llamar a Gemini 2.5 Pro o Flash al 50% del precio oficial de Google — el insignia más económico de los tres grandes.