Google

Gemini 3.1 Flash-Lite

Texto

Gemini 3.1 Flash-Lite; contexto 1M, thinking ajustable; peticiones de texto con Chat Completions compatible con OpenAI

Entrada $0.25 / 1M de tokens | Salida $1.50 / 1M de tokens Gemini 3.1 Flash-Lite Leer la documentación →
Salud del modelo Datos insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después." }]
});
https://runapi.ai 5 endpoints
RESUMEN

Para qué está pensado Gemini 3.1 Flash-Lite

Gemini 3.1 Flash-Lite es el modelo de baja latencia y bajo coste de la serie Gemini 3 de Google. Google lo diseña para tareas sencillas de alto volumen, como traducción, clasificación y extracción de entidades, triaje de documentos y enrutamiento de peticiones entre modelos. La versión estable gemini-3.1-flash-lite llegó a disponibilidad general el 7 de mayo de 2026. La ventana de contexto es de 1.048.576 tokens y la salida llega a 65.536 tokens.

El thinking es ajustable: Google ofrece cuatro niveles de thinking, de mínimo a alto, y cuenta los tokens de thinking como salida. Google admite function calling y salidas estructuradas en este modelo.

El modelo de Google acepta entrada de texto, imagen, vídeo, audio y PDF. En RunAPI, gemini-3.1-flash-lite solo acepta entrada de texto. Envía las peticiones a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages o Gemini generateContent. Google indica Gemini 3.5 Flash-Lite como sustituto, y RunAPI lo ofrece como gemini-3.5-flash-lite.

ID del modelo
gemini-3.1-flash-lite
Lanzamiento
7 de mayo de 2026 (disponibilidad general)
Ventana de contexto
1.048.576 tokens
Salida máxima
65.536 tokens
Thinking
Ajustable, de mínimo a alto
Fecha de cierre más temprana (Google)
7 de mayo de 2027
Endpoint en RunAPI
OpenAI Chat Completions, entrada de texto
Playground

Prueba Gemini 3.1 Flash-Lite

Elige cualquier modelo y genera en segundos.

Estimado: Entrada $0.25 / 1M de tokens | Salida $1.50 / 1M de tokens

Inicia sesión para generar con RunAPI.

Inicia sesión para generar

Inicia sesión para comenzar a generar con tus modelos de lenguaje disponibles.

Especificaciones

FICHA TÉCNICA

Proveedor Google
ID del modelo gemini-3.1-flash-lite
Modalidad Texto
Tipos de tarea Synchronous
Endpoint de API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Unidad de facturación 1K tokens
Estado del catálogo Operativo
CÓMO FUNCIONA

Usa este modelo en 3 pasos

  1. Crea tu clave

    Regístrate gratis y crea una clave de API para gemini-3.1-flash-lite desde el panel de control.

  2. Envía una solicitud

    Envía una solicitud POST a /v1/chat/completions con el identificador del modelo gemini-3.1-flash-lite y tus parámetros.

  3. Obtén resultados

    Lee directamente la respuesta completada de gemini-3.1-flash-lite desde el endpoint.

Qué ofrece este modelo

Cobertura de endpoints

Expone 1 endpoint(s) público(s): chat_completion.

Facturación por uso

Medido por 1K tokens sin requisito de suscripción.

Gemini 3.1 Flash-Lite PRECIOS

Endpoint
Precio
chat_completion
Entrada: $0.25 / 1M de tokens Salida: $1.50 / 1M de tokens
  • Lectura de caché: $0.03 / 1M de tokens
REFERENCIA API

Especificación del endpoint

Endpoint
POST /v1/chat/completions
ID del modelo
gemini-3.1-flash-lite
Tipos de tarea
chat_completion

Parámetros de solicitud

No hay parámetros de solicitud publicados para este endpoint.

CASOS DE USO

Chat

Usa LLMs para chat y razonamiento.

Código

Genera y revisa trabajo de implementación.

Automatización

Conecta modelos a tareas backend.

Métricas de uso

La confianza de desarrolladores
6
Llamadas a la API / Día
100.0%
Tasa de éxito
1.9s
Generación media

Los testimonios de clientes verificados aún no están disponibles para este modelo.

FAQ

Preguntas frecuentes sobre Gemini 3.1 Flash-Lite

¿Uso Gemini 3.1 Flash-Lite o Gemini 3.5 Flash-Lite?

Google indica Gemini 3.5 Flash-Lite como sustituto de 3.1 Flash-Lite. Empieza los proyectos nuevos con gemini-3.5-flash-lite y elige gemini-3.1-flash-lite cuando una carga, un conjunto de prompts o una evaluación existentes se construyeron sobre él. Ambos modelos están en RunAPI con la misma API key.

¿Hasta cuándo estará disponible Gemini 3.1 Flash-Lite?

Google fija el 7 de mayo de 2027 como la fecha de cierre más temprana de gemini-3.1-flash-lite. El modelo preview se cerró en mayo de 2026, así que usa el ID de modelo estable.

¿Puedo llamar a Gemini 3.1 Flash-Lite con el SDK de OpenAI?

Sí. Apunta el SDK de OpenAI a https://runapi.ai/v1 con tu API key de RunAPI y envía peticiones Chat Completions con model en gemini-3.1-flash-lite. Las herramientas usan el formato estándar de OpenAI.

¿Puedo enviar imágenes o audio a gemini-3.1-flash-lite en RunAPI?

Todavía no. El modelo de Google lee imágenes, vídeo, audio y PDF, pero RunAPI solo acepta entrada de texto para gemini-3.1-flash-lite, y las peticiones con partes multimedia se rechazan.

¿Cómo selecciono gemini-3.1-flash-lite?

Pasa el ID de modelo que aparece en el quickstart.

¿El precio es por uso?

Sí. El precio se mide por llamada o unidad.

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros