Google

Gemini 3.1 Flash-Lite

Texto

Gemini 3.1 Flash-Lite; contexto de 1M, thinking ajustável; requisições de texto pelo Chat Completions compatível com OpenAI

Entrada $0.25 / 1M de tokens | Saída $1.50 / 1M de tokens Gemini 3.1 Flash-Lite Ler a documentação →
Saúde do modelo Dados insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Para que serve o Gemini 3.1 Flash-Lite

O Gemini 3.1 Flash-Lite é o modelo de baixa latência e baixo custo da série Gemini 3 do Google. O Google o criou para tarefas simples em grande volume, como tradução, classificação e extração de entidades, triagem de documentos e roteamento de requisições entre modelos. O gemini-3.1-flash-lite estável ficou disponível de forma geral em 7 de maio de 2026. A janela de contexto é de 1.048.576 tokens e a saída chega a 65.536 tokens.

O thinking é ajustável: o Google oferece quatro níveis de thinking, de minimal a high, e conta os tokens de thinking como saída. O Google oferece function calling e structured outputs no modelo.

O modelo do Google aceita entrada de texto, imagem, vídeo, áudio e PDF. No RunAPI, o gemini-3.1-flash-lite aceita somente entrada de texto. Envie requisições pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions), pelo OpenAI Responses, pelo Anthropic Messages ou pelo Gemini generateContent. O Google indica o Gemini 3.5 Flash-Lite como substituto, e o RunAPI o oferece como gemini-3.5-flash-lite.

ID do modelo
gemini-3.1-flash-lite
Lançamento
07/05/2026 (disponibilidade geral)
Janela de contexto
1.048.576 tokens
Saída máxima
65.536 tokens
Thinking
Ajustável, de minimal a high
Desligamento mais cedo (Google)
07/05/2027
Endpoint no RunAPI
OpenAI Chat Completions, somente entrada de texto
Playground

Experimente Gemini 3.1 Flash-Lite

Escolha qualquer modelo e gere em segundos.

Estimado: Entrada $0.25 / 1M de tokens | Saída $1.50 / 1M de tokens

Entre para gerar com a RunAPI.

Faça login para gerar

Entre para começar a gerar com seus modelos de linguagem disponíveis.

Especificações

FICHA TÉCNICA

Provedor Google
ID do modelo gemini-3.1-flash-lite
Modalidade Texto
Tipos de tarefa Synchronous
Endpoint da API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
Unidade de cobrança 1K tokens
Status do catálogo Operacional
COMO FUNCIONA

Use este modelo em 3 etapas

  1. Crie sua chave

    Cadastre-se gratuitamente e crie uma chave de API para gemini-3.1-flash-lite no painel.

  2. Envie uma solicitação

    Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo gemini-3.1-flash-lite e seus parâmetros.

  3. Obtenha os resultados

    Leia diretamente do endpoint a resposta concluída de gemini-3.1-flash-lite.

O que este modelo oferece

Cobertura de endpoints

Expõe 1 endpoint(s) público(s): chat_completion.

Cobrança por uso

Medido por 1K tokens, sem exigência de assinatura.

Gemini 3.1 Flash-Lite PREÇOS

Endpoint
Preço
chat_completion
Entrada: $0.25 / 1M de tokens Saída: $1.50 / 1M de tokens
  • Leitura de cache: $0.03 / 1M de tokens
REFERÊNCIA DA API

Especificação do endpoint

Endpoint
POST /v1/chat/completions
ID do modelo
gemini-3.1-flash-lite
Tipos de tarefa
chat_completion

Parâmetros da solicitação

Nenhum parâmetro de solicitação foi publicado para este endpoint.

CASOS DE USO

Chat

Use LLMs para chat e raciocínio.

Código

Gere e revise trabalho de implementação.

Automação

Conecte modelos a tarefas backend.

Métricas de uso

Desenvolvedores confiam em nós
6
Chamadas de API / Dia
100.0%
Taxa de sucesso
1.9s
Geração média

Feedback verificado de clientes ainda não está disponível para este modelo.

FAQ

Perguntas frequentes sobre Gemini 3.1 Flash-Lite

Devo usar o Gemini 3.1 Flash-Lite ou o Gemini 3.5 Flash-Lite?

O Google indica o Gemini 3.5 Flash-Lite como substituto do 3.1 Flash-Lite. Comece novos projetos com o gemini-3.5-flash-lite e escolha o gemini-3.1-flash-lite quando uma carga, um conjunto de prompts ou uma avaliação que já existe foi construída sobre ele. Os dois modelos estão no RunAPI com a mesma chave de API.

Por quanto tempo o Gemini 3.1 Flash-Lite continuará disponível?

O Google informa 7 de maio de 2027 como a data de desligamento mais cedo do gemini-3.1-flash-lite. O modelo preview foi desligado em maio de 2026, então use o ID do modelo estável.

Posso chamar o Gemini 3.1 Flash-Lite com o SDK da OpenAI?

Sim. Aponte o SDK da OpenAI para https://runapi.ai/v1 com sua chave de API do RunAPI e envie requisições Chat Completions com model definido como gemini-3.1-flash-lite. As ferramentas seguem o formato tools padrão da OpenAI.

Posso enviar imagens ou áudio ao gemini-3.1-flash-lite no RunAPI?

Ainda não. O modelo do Google lê imagens, vídeo, áudio e PDFs, mas o RunAPI aceita somente entrada de texto para o gemini-3.1-flash-lite, e requisições com partes de mídia são rejeitadas.

Como seleciono gemini-3.1-flash-lite?

Envie o ID de modelo mostrado no quickstart.

O preço é por uso?

Sim. O preço é medido por chamada ou unidade.

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco