Cobertura de endpoints
Expone 1 endpoint(s) público(s): chat_completion.
Gemini 3.1 Flash-Lite; contexto 1M, thinking ajustable; peticiones de texto con Chat Completions compatible con OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después." }]
});
11 versiones disponibles
Gemini 3.1 Flash-Lite es el modelo de baja latencia y bajo coste de la serie Gemini 3 de Google. Google lo diseña para tareas sencillas de alto volumen, como traducción, clasificación y extracción de entidades, triaje de documentos y enrutamiento de peticiones entre modelos. La versión estable gemini-3.1-flash-lite llegó a disponibilidad general el 7 de mayo de 2026. La ventana de contexto es de 1.048.576 tokens y la salida llega a 65.536 tokens.
El thinking es ajustable: Google ofrece cuatro niveles de thinking, de mínimo a alto, y cuenta los tokens de thinking como salida. Google admite function calling y salidas estructuradas en este modelo.
El modelo de Google acepta entrada de texto, imagen, vídeo, audio y PDF. En RunAPI, gemini-3.1-flash-lite solo acepta entrada de texto. Envía las peticiones a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions), OpenAI Responses, Anthropic Messages o Gemini generateContent. Google indica Gemini 3.5 Flash-Lite como sustituto, y RunAPI lo ofrece como gemini-3.5-flash-lite.
Elige cualquier modelo y genera en segundos.
| Proveedor | |
| ID del modelo | gemini-3.1-flash-lite |
| Modalidad | Texto |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| Unidad de facturación | 1K tokens |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para gemini-3.1-flash-lite desde el panel de control.
Envía una solicitud POST a /v1/chat/completions con el identificador del modelo gemini-3.1-flash-lite y tus parámetros.
Lee directamente la respuesta completada de gemini-3.1-flash-lite desde el endpoint.
Expone 1 endpoint(s) público(s): chat_completion.
Medido por 1K tokens sin requisito de suscripción.
No hay parámetros de solicitud publicados para este endpoint.
Usa LLMs para chat y razonamiento.
Genera y revisa trabajo de implementación.
Conecta modelos a tareas backend.
Los testimonios de clientes verificados aún no están disponibles para este modelo.
Google indica Gemini 3.5 Flash-Lite como sustituto de 3.1 Flash-Lite. Empieza los proyectos nuevos con gemini-3.5-flash-lite y elige gemini-3.1-flash-lite cuando una carga, un conjunto de prompts o una evaluación existentes se construyeron sobre él. Ambos modelos están en RunAPI con la misma API key.
Google fija el 7 de mayo de 2027 como la fecha de cierre más temprana de gemini-3.1-flash-lite. El modelo preview se cerró en mayo de 2026, así que usa el ID de modelo estable.
Sí. Apunta el SDK de OpenAI a https://runapi.ai/v1 con tu API key de RunAPI y envía peticiones Chat Completions con model en gemini-3.1-flash-lite. Las herramientas usan el formato estándar de OpenAI.
Todavía no. El modelo de Google lee imágenes, vídeo, audio y PDF, pero RunAPI solo acepta entrada de texto para gemini-3.1-flash-lite, y las peticiones con partes multimedia se rechazan.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros