---
title: 'API de Gemini 2.5 Flash-Lite: ID, contexto 1M y SDK de OpenAI | RunAPI'
description: Llama a gemini-2.5-flash-lite con la API Chat Completions compatible con OpenAI de RunAPI. Contexto de 1M tokens, salida de 65K, thinking desactivado por defecto.
url: https://runapi.ai/es/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/es/models/gemini/2.5-flash-lite
locale: es
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1K tokens
status: active
---

> HTML version: https://runapi.ai/es/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite  API

Llama a gemini-2.5-flash-lite de la familia Gemini mediante RunAPI. Se factura por token, sin suscripción, y una petición que falla antes de que empiece su respuesta no se cobra.

**Google / [Gemini](https://runapi.ai/es/models/gemini.md)**
**Operativo · text · Uso comercial compatible**

## Para qué está pensado Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite es el nivel Flash-Lite de la generación Gemini 2.5 de Google, pensado para clasificación y extracción de alto volumen y otros trabajos de baja latencia. Llegó a disponibilidad general el 22 de julio de 2025, con fecha de corte de conocimiento en enero de 2025. La ventana de contexto es de 1.048.576 tokens y la salida llega a 65.536 tokens.

El thinking está desactivado por defecto, y Google documenta un modo thinking opcional para prompts más difíciles. Google admite function calling y salidas estructuradas en este modelo.

El modelo de Google acepta entrada de texto, imagen, vídeo, audio y PDF. En RunAPI, envía texto a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions); RunAPI solo acepta entrada de texto para este modelo. Google recomienda Gemini 3.5 Flash-Lite para proyectos nuevos, y RunAPI lo ofrece como gemini-3.5-flash-lite.

**ID del modelo:** gemini-2.5-flash-lite
**Lanzamiento:** 22 de julio de 2025 (disponibilidad general)
**Fecha de corte de conocimiento:** Enero de 2025
**Ventana de contexto:** 1.048.576 tokens
**Salida máxima:** 65.536 tokens
**Thinking:** Opcional, desactivado por defecto
**Endpoint en RunAPI:** OpenAI Chat Completions, entrada de texto



<!-- catalog-model-detail-slot: model-playground -->

## Prueba Gemini 2.5 Flash-Lite

Elige cualquier modelo y genera en segundos.


**Modelo:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · Entrada $0.10 / 1M de tokens | Salida $0.40 / 1M de tokens

**Prompt:** Describe lo que quieres crear...

**Estimado:** Entrada $0.10 / 1M de tokens | Salida $0.40 / 1M de tokens

- [Generar](https://runapi.ai/es/login)
Inicia sesión para generar con RunAPI.
<!-- /catalog-model-detail-slot: model-playground -->

### Cambiar variante

- [gemini-2.5-flash](https://runapi.ai/es/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/es/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/es/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/es/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/es/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/es/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/es/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/es/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/es/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/es/models/gemini/3.8-flash.md)

11 versiones disponibles





gemini-2.5-flash-lite es uno de los modelos Gemini en RunAPI. Usa la misma API key que cualquier otro modelo, y cambias a él modificando el ID de modelo en tu petición. Cada llamada es síncrona y se factura en USD según los tokens de entrada, salida y caché, sin suscripción ni gasto mínimo. Una petición que falla antes de que empiece la respuesta no se cobra; una vez que la respuesta va en streaming, se cobran los tokens ya generados, aunque el cliente se desconecte.

- Facturación por token en USD, sin suscripción
- Sin cobro si una petición falla antes de su respuesta
- Streaming token a token
- Cambia de modelo modificando un solo ID de modelo
- Una API key y una factura para todos los modelos y proveedores

## Métricas de uso

- **Llamadas a la API / Día:** 6
- **Tasa de éxito:** 100.0%
- **Generación media:** 1.8s

Los testimonios de clientes verificados aún no están disponibles para este modelo.



## FICHA TÉCNICA

| Campo | Valor |
|---|---|
| Proveedor | Google |
| ID del modelo | gemini-2.5-flash-lite |
| Modalidad | Texto |
| Tipos de tarea | Synchronous |
| Endpoint de API | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| Unidad de facturación | 1K tokens |
| Estado del catálogo | Operativo |



**CÓMO FUNCIONA**

## Usa este modelo en 3 pasos

1. **Crea tu clave** - Regístrate gratis y crea una clave de API para gemini-2.5-flash-lite desde el panel de control.
2. **Envía una solicitud** - Envía una solicitud POST a /v1/chat/completions con el identificador del modelo gemini-2.5-flash-lite y tus parámetros.
3. **Obtén resultados** - Lee directamente la respuesta completada de gemini-2.5-flash-lite desde el endpoint.



<!-- catalog-model-detail-slot: feature-cards -->

## Qué ofrece este modelo

- **Cobertura de endpoints** — Expone 1 endpoint(s) público(s): chat_completion.
- **Facturación por uso** — Medido por 1K tokens sin requisito de suscripción.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite PRECIOS

| Endpoint | Precio |
|---|---|
| `chat_completion` | Entrada: $0.10 / 1M de tokens<br>Salida: $0.40 / 1M de tokens<br>Lectura de caché: $0.01 / 1M de tokens |



**REFERENCIA API**

## Especificación del endpoint

| Field | Value |
|---|---|
| Endpoint | `POST /v1/chat/completions` |
| ID del modelo | `gemini-2.5-flash-lite` |
| Tipos de tarea | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Parámetros de solicitud

No hay parámetros de solicitud publicados para este endpoint.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."
    }
  ]
}
```

### Habilidad de modelo — gemini-2.5-flash-lite

Instala la habilidad una vez y luego usa el ID de variante de esta página mientras construyes.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Usa el SDK de OpenAI / Anthropic / Google Gen AI con tu API key de RunAPI y `model: "gemini-2.5-flash-lite"`.

### Cómo usar gemini-2.5-flash-lite

1. **Instala** — Instala el model skill de la línea Gemini. Carga documentación, formatos de petición y notas de precios en tu espacio de trabajo de código.
2. **Ajusta** — Apunta tu SDK a https://runapi.ai y define tu API key de RunAPI. La misma clave funciona en todos los modelos y proveedores.
3. **Llama** — Envía una petición en un formato de API compatible con este modelo, con el campo model fijado al ID de modelo de esta página. RunAPI la reenvía al proveedor.
4. **Recibe** — Lee la respuesta de esa misma llamada, o recíbela en streaming mientras se genera. El campo usage muestra los tokens que se te facturan.

### Comparativa de gemini-2.5-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite; contexto 1M, thinking desactivado por defecto; Chat Completions compatible con OpenAI** — Optimizado en velocidad/coste; contexto 1M; baseline de generación anterior
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite; contexto 1M, thinking desactivado por defecto; Chat Completions compatible con OpenAI** — Mejor razonamiento de la generación 2.5; contexto 1M
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite; contexto 1M, thinking desactivado por defecto; Chat Completions compatible con OpenAI** — gemini-3-flash-preview

## CASOS DE USO

**Chat**

Usa LLMs para chat y razonamiento.

**Código**

Genera y revisa trabajo de implementación.

**Automatización**

Conecta modelos a tareas backend.



## Preguntas frecuentes sobre Gemini 2.5 Flash-Lite

### ¿Uso Gemini 2.5 Flash-Lite o Gemini 3.5 Flash-Lite?

Google recomienda Gemini 3.5 Flash-Lite o Gemini 3.8 Flash para trabajo nuevo. Elige gemini-2.5-flash-lite cuando una carga, un conjunto de prompts o una evaluación existentes se construyeron sobre él. Ambos modelos están en RunAPI con la misma API key.

### ¿Puedo seguir usando Gemini 2.5 Flash-Lite?

Sí. Google no ha anunciado fecha de retirada, aunque su propia API ahora limita el acceso a los modelos 2.5 a usuarios que ya los usaban. En RunAPI, gemini-2.5-flash-lite está disponible para todas las cuentas.

### ¿Puedo llamar a Gemini 2.5 Flash-Lite con el SDK de OpenAI?

Sí. Apunta el SDK de OpenAI a https://runapi.ai/v1 con tu API key de RunAPI y envía peticiones Chat Completions con model en gemini-2.5-flash-lite. Las herramientas usan el formato estándar de OpenAI.

### ¿Gemini 2.5 Flash-Lite piensa antes de responder?

No por defecto. Google lo distribuye con el thinking desactivado para trabajo de alto volumen y baja latencia, y documenta un modo thinking opcional.

### ¿Cómo selecciono gemini-2.5-flash-lite?

Pasa el ID de modelo que aparece en el quickstart.

### ¿El precio es por uso?

Sí. El precio se mide por llamada o unidad.


### RELACIONADO

- [gemini-3.5-flash-lite](https://runapi.ai/es/models/gemini/3.5-flash-lite.md) — por Google · Entrada $0.15 / 1M de tokens | Salida $1.25 / 1M de tokens
- [gemini-3.1-flash-lite](https://runapi.ai/es/models/gemini/3.1-flash-lite.md) — por Google · Entrada $0.25 / 1M de tokens | Salida $1.50 / 1M de tokens
- [gemini-2.5-flash](https://runapi.ai/es/models/gemini/2.5-flash.md) — por Google · Entrada $0.30 / 1M de tokens | Salida $2.50 / 1M de tokens
- [gemini-3-flash-preview](https://runapi.ai/es/models/gemini/3-flash-preview.md) — por Google · Entrada $0.50 / 1M de tokens | Salida $3.00 / 1M de tokens · Entrada $0.30 / 1M de tokens | Salida $1.80 / 1M de tokens

### Empieza con Gemini hoy.

- [Crear cuenta gratis](https://runapi.ai/es/login)
- [Leer inicio rápido →](https://runapi.ai/es/docs/api/openai/chat-completions)
## ¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

[Contacta con nosotros](https://runapi.ai/es/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/es/.md)
### Producto
- [Catálogo de modelos](https://runapi.ai/es/models.md)
- [Precios](https://runapi.ai/es/pricing.md)
- [Proveedores](https://runapi.ai/es/models#all-models)
### Desarrolladores
- [Documentación](https://runapi.ai/es/docs/guides)
- [SDKs](https://runapi.ai/es/sdk.md)
- [CLI](https://runapi.ai/es/cli.md)
- [Servidor MCP](https://runapi.ai/es/mcp.md)
- [x402](https://runapi.ai/es/x402.md)
### Guías
- [Claude Code vs Cursor](https://runapi.ai/es/claude-code-vs-cursor.md)
- [Configuración de Cursor API](https://runapi.ai/es/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/es/openrouter-alternative.md)
### Empresa
- [Enterprise](https://runapi.ai/es/contact.md)
- [Contacto](https://runapi.ai/es/contact.md)
### Legal
- [Términos](https://runapi.ai/es/terms.md)
- [Privacidad](https://runapi.ai/es/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/es",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/es/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/es",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/esicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/es"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/es/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/es/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/es/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "HowTo",
    "name": "Cómo usar gemini-2.5-flash-lite",
    "description": "Llama a gemini-2.5-flash-lite de la familia Gemini mediante RunAPI: precio por token, ID de modelo, formatos de API compatibles y guía de configuración.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Instala",
        "text": "Instala el model skill de la línea Gemini. Carga documentación, formatos de petición y notas de precios en tu espacio de trabajo de código.",
        "url": "https://runapi.ai/es/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Ajusta",
        "text": "Apunta tu SDK a https://runapi.ai y define tu API key de RunAPI. La misma clave funciona en todos los modelos y proveedores.",
        "url": "https://runapi.ai/es/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Llama",
        "text": "Envía una petición en un formato de API compatible con este modelo, con el campo model fijado al ID de modelo de esta página. RunAPI la reenvía al proveedor.",
        "url": "https://runapi.ai/es/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Recibe",
        "text": "Lee la respuesta de esa misma llamada, o recíbela en streaming mientras se genera. El campo usage muestra los tokens que se te facturan.",
        "url": "https://runapi.ai/es/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "es",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "¿Uso Gemini 2.5 Flash-Lite o Gemini 3.5 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google recomienda Gemini 3.5 Flash-Lite o Gemini 3.8 Flash para trabajo nuevo. Elige gemini-2.5-flash-lite cuando una carga, un conjunto de prompts o una evaluación existentes se construyeron sobre él. Ambos modelos están en RunAPI con la misma API key."
        }
      },
      {
        "@type": "Question",
        "name": "¿Puedo seguir usando Gemini 2.5 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sí. Google no ha anunciado fecha de retirada, aunque su propia API ahora limita el acceso a los modelos 2.5 a usuarios que ya los usaban. En RunAPI, gemini-2.5-flash-lite está disponible para todas las cuentas."
        }
      },
      {
        "@type": "Question",
        "name": "¿Puedo llamar a Gemini 2.5 Flash-Lite con el SDK de OpenAI?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sí. Apunta el SDK de OpenAI a https://runapi.ai/v1 con tu API key de RunAPI y envía peticiones Chat Completions con model en gemini-2.5-flash-lite. Las herramientas usan el formato estándar de OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "¿Gemini 2.5 Flash-Lite piensa antes de responder?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "No por defecto. Google lo distribuye con el thinking desactivado para trabajo de alto volumen y baja latencia, y documenta un modo thinking opcional."
        }
      },
      {
        "@type": "Question",
        "name": "¿Cómo selecciono gemini-2.5-flash-lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Pasa el ID de modelo que aparece en el quickstart."
        }
      },
      {
        "@type": "Question",
        "name": "¿El precio es por uso?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sí. El precio se mide por llamada o unidad."
        }
      }
    ]
  }
]
```
