Google

Gemini 2.5 Flash-Lite

Texto

Gemini 2.5 Flash-Lite; contexto de 1M, thinking desativado por padrão; Chat Completions compatível com OpenAI

Entrada $0.10 / 1M de tokens | Saída $0.40 / 1M de tokens Gemini 2.5 Flash-Lite Ler a documentação →
Saúde do modelo Dados insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Para que serve o Gemini 2.5 Flash-Lite

O Gemini 2.5 Flash-Lite é o nível Flash-Lite da geração Gemini 2.5 do Google, voltado para classificação, extração e outros trabalhos de baixa latência em grande volume. Ele ficou disponível de forma geral em 22 de julho de 2025, com data de corte de conhecimento em janeiro de 2025. A janela de contexto é de 1.048.576 tokens e a saída chega a 65.536 tokens.

O thinking vem desativado por padrão, e o Google documenta um modo thinking opcional para prompts mais difíceis. O Google oferece function calling e structured outputs no modelo.

O modelo do Google aceita entrada de texto, imagem, vídeo, áudio e PDF. No RunAPI, envie texto pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions); o RunAPI aceita somente entrada de texto para este modelo. O Google recomenda o Gemini 3.5 Flash-Lite para novos projetos, e o RunAPI o oferece como gemini-3.5-flash-lite.

ID do modelo
gemini-2.5-flash-lite
Lançamento
22/07/2025 (disponibilidade geral)
Data de corte de conhecimento
Janeiro de 2025
Janela de contexto
1.048.576 tokens
Saída máxima
65.536 tokens
Thinking
Opcional, desativado por padrão
Endpoint no RunAPI
OpenAI Chat Completions, somente entrada de texto
Playground

Experimente Gemini 2.5 Flash-Lite

Escolha qualquer modelo e gere em segundos.

Estimado: Entrada $0.10 / 1M de tokens | Saída $0.40 / 1M de tokens

Entre para gerar com a RunAPI.

Faça login para gerar

Entre para começar a gerar com seus modelos de linguagem disponíveis.

Especificações

FICHA TÉCNICA

Provedor Google
ID do modelo gemini-2.5-flash-lite
Modalidade Texto
Tipos de tarefa Synchronous
Endpoint da API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
Unidade de cobrança 1K tokens
Status do catálogo Operacional
COMO FUNCIONA

Use este modelo em 3 etapas

  1. Crie sua chave

    Cadastre-se gratuitamente e crie uma chave de API para gemini-2.5-flash-lite no painel.

  2. Envie uma solicitação

    Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo gemini-2.5-flash-lite e seus parâmetros.

  3. Obtenha os resultados

    Leia diretamente do endpoint a resposta concluída de gemini-2.5-flash-lite.

O que este modelo oferece

Cobertura de endpoints

Expõe 1 endpoint(s) público(s): chat_completion.

Cobrança por uso

Medido por 1K tokens, sem exigência de assinatura.

Gemini 2.5 Flash-Lite PREÇOS

Endpoint
Preço
chat_completion
Entrada: $0.10 / 1M de tokens Saída: $0.40 / 1M de tokens
  • Leitura de cache: $0.01 / 1M de tokens
REFERÊNCIA DA API

Especificação do endpoint

Endpoint
POST /v1/chat/completions
ID do modelo
gemini-2.5-flash-lite
Tipos de tarefa
chat_completion

Parâmetros da solicitação

Nenhum parâmetro de solicitação foi publicado para este endpoint.

CASOS DE USO

Chat

Use LLMs para chat e raciocínio.

Código

Gere e revise trabalho de implementação.

Automação

Conecte modelos a tarefas backend.

Métricas de uso

Desenvolvedores confiam em nós
6
Chamadas de API / Dia
100.0%
Taxa de sucesso
1.8s
Geração média

Feedback verificado de clientes ainda não está disponível para este modelo.

FAQ

Perguntas frequentes sobre Gemini 2.5 Flash-Lite

Devo usar o Gemini 2.5 Flash-Lite ou o Gemini 3.5 Flash-Lite?

O Google recomenda o Gemini 3.5 Flash-Lite ou o Gemini 3.8 Flash para novos trabalhos. Escolha o gemini-2.5-flash-lite quando uma carga, um conjunto de prompts ou uma avaliação que já existe foi construída sobre ele. Os dois modelos estão no RunAPI com a mesma chave de API.

Ainda posso usar o Gemini 2.5 Flash-Lite?

Sim. O Google não anunciou data de desligamento para ele, embora a própria API do Google agora limite o acesso aos modelos 2.5 a usuários que já os usavam antes. No RunAPI, o gemini-2.5-flash-lite está disponível para todas as contas.

Posso chamar o Gemini 2.5 Flash-Lite com o SDK da OpenAI?

Sim. Aponte o SDK da OpenAI para https://runapi.ai/v1 com sua chave de API do RunAPI e envie requisições Chat Completions com model definido como gemini-2.5-flash-lite. As ferramentas seguem o formato tools padrão da OpenAI.

O Gemini 2.5 Flash-Lite raciocina antes de responder?

Não por padrão. O Google o distribui com o thinking desativado, para trabalhos de baixa latência em grande volume, e documenta um modo thinking opcional.

Como seleciono gemini-2.5-flash-lite?

Envie o ID de modelo mostrado no quickstart.

O preço é por uso?

Sim. O preço é medido por chamada ou unidade.

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco