Google

Gemini 2.5 Flash-Lite

Texto

Gemini 2.5 Flash-Lite; contexto 1M, thinking desactivado por defecto; Chat Completions compatible con OpenAI

Entrada $0.10 / 1M de tokens | Salida $0.40 / 1M de tokens Gemini 2.5 Flash-Lite Leer la documentación →
Salud del modelo Datos insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después." }]
});
https://runapi.ai 5 endpoints
RESUMEN

Para qué está pensado Gemini 2.5 Flash-Lite

Gemini 2.5 Flash-Lite es el nivel Flash-Lite de la generación Gemini 2.5 de Google, pensado para clasificación y extracción de alto volumen y otros trabajos de baja latencia. Llegó a disponibilidad general el 22 de julio de 2025, con fecha de corte de conocimiento en enero de 2025. La ventana de contexto es de 1.048.576 tokens y la salida llega a 65.536 tokens.

El thinking está desactivado por defecto, y Google documenta un modo thinking opcional para prompts más difíciles. Google admite function calling y salidas estructuradas en este modelo.

El modelo de Google acepta entrada de texto, imagen, vídeo, audio y PDF. En RunAPI, envía texto a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions); RunAPI solo acepta entrada de texto para este modelo. Google recomienda Gemini 3.5 Flash-Lite para proyectos nuevos, y RunAPI lo ofrece como gemini-3.5-flash-lite.

ID del modelo
gemini-2.5-flash-lite
Lanzamiento
22 de julio de 2025 (disponibilidad general)
Fecha de corte de conocimiento
Enero de 2025
Ventana de contexto
1.048.576 tokens
Salida máxima
65.536 tokens
Thinking
Opcional, desactivado por defecto
Endpoint en RunAPI
OpenAI Chat Completions, entrada de texto
Playground

Prueba Gemini 2.5 Flash-Lite

Elige cualquier modelo y genera en segundos.

Estimado: Entrada $0.10 / 1M de tokens | Salida $0.40 / 1M de tokens

Inicia sesión para generar con RunAPI.

Inicia sesión para generar

Inicia sesión para comenzar a generar con tus modelos de lenguaje disponibles.

Especificaciones

FICHA TÉCNICA

Proveedor Google
ID del modelo gemini-2.5-flash-lite
Modalidad Texto
Tipos de tarea Synchronous
Endpoint de API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
Unidad de facturación 1K tokens
Estado del catálogo Operativo
CÓMO FUNCIONA

Usa este modelo en 3 pasos

  1. Crea tu clave

    Regístrate gratis y crea una clave de API para gemini-2.5-flash-lite desde el panel de control.

  2. Envía una solicitud

    Envía una solicitud POST a /v1/chat/completions con el identificador del modelo gemini-2.5-flash-lite y tus parámetros.

  3. Obtén resultados

    Lee directamente la respuesta completada de gemini-2.5-flash-lite desde el endpoint.

Qué ofrece este modelo

Cobertura de endpoints

Expone 1 endpoint(s) público(s): chat_completion.

Facturación por uso

Medido por 1K tokens sin requisito de suscripción.

Gemini 2.5 Flash-Lite PRECIOS

Endpoint
Precio
chat_completion
Entrada: $0.10 / 1M de tokens Salida: $0.40 / 1M de tokens
  • Lectura de caché: $0.01 / 1M de tokens
REFERENCIA API

Especificación del endpoint

Endpoint
POST /v1/chat/completions
ID del modelo
gemini-2.5-flash-lite
Tipos de tarea
chat_completion

Parámetros de solicitud

No hay parámetros de solicitud publicados para este endpoint.

CASOS DE USO

Chat

Usa LLMs para chat y razonamiento.

Código

Genera y revisa trabajo de implementación.

Automatización

Conecta modelos a tareas backend.

Métricas de uso

La confianza de desarrolladores
6
Llamadas a la API / Día
100.0%
Tasa de éxito
1.8s
Generación media

Los testimonios de clientes verificados aún no están disponibles para este modelo.

FAQ

Preguntas frecuentes sobre Gemini 2.5 Flash-Lite

¿Uso Gemini 2.5 Flash-Lite o Gemini 3.5 Flash-Lite?

Google recomienda Gemini 3.5 Flash-Lite o Gemini 3.8 Flash para trabajo nuevo. Elige gemini-2.5-flash-lite cuando una carga, un conjunto de prompts o una evaluación existentes se construyeron sobre él. Ambos modelos están en RunAPI con la misma API key.

¿Puedo seguir usando Gemini 2.5 Flash-Lite?

Sí. Google no ha anunciado fecha de retirada, aunque su propia API ahora limita el acceso a los modelos 2.5 a usuarios que ya los usaban. En RunAPI, gemini-2.5-flash-lite está disponible para todas las cuentas.

¿Puedo llamar a Gemini 2.5 Flash-Lite con el SDK de OpenAI?

Sí. Apunta el SDK de OpenAI a https://runapi.ai/v1 con tu API key de RunAPI y envía peticiones Chat Completions con model en gemini-2.5-flash-lite. Las herramientas usan el formato estándar de OpenAI.

¿Gemini 2.5 Flash-Lite piensa antes de responder?

No por defecto. Google lo distribuye con el thinking desactivado para trabajo de alto volumen y baja latencia, y documenta un modo thinking opcional.

¿Cómo selecciono gemini-2.5-flash-lite?

Pasa el ID de modelo que aparece en el quickstart.

¿El precio es por uso?

Sí. El precio se mide por llamada o unidad.

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros