---
title: 'API do Gemini 2.5 Flash-Lite: ID do modelo, contexto 1M, SDK | RunAPI'
description: Chame o gemini-2.5-flash-lite pela API Chat Completions compatível com OpenAI do RunAPI. Contexto de 1M tokens, 65K de saída, thinking desativado por padrão.
url: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
locale: pt-BR
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1K tokens
status: active
---

> HTML version: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite  API

Chame gemini-2.5-flash-lite da família Gemini pela RunAPI. A cobrança é por token, sem assinatura, e uma requisição que falha antes de a resposta começar não é cobrada.

**Google / [Gemini](https://runapi.ai/pt-BR/models/gemini.md)**
**Operacional · text · Uso comercial permitido**

## Para que serve o Gemini 2.5 Flash-Lite

O Gemini 2.5 Flash-Lite é o nível Flash-Lite da geração Gemini 2.5 do Google, voltado para classificação, extração e outros trabalhos de baixa latência em grande volume. Ele ficou disponível de forma geral em 22 de julho de 2025, com data de corte de conhecimento em janeiro de 2025. A janela de contexto é de 1.048.576 tokens e a saída chega a 65.536 tokens.

O thinking vem desativado por padrão, e o Google documenta um modo thinking opcional para prompts mais difíceis. O Google oferece function calling e structured outputs no modelo.

O modelo do Google aceita entrada de texto, imagem, vídeo, áudio e PDF. No RunAPI, envie texto pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions); o RunAPI aceita somente entrada de texto para este modelo. O Google recomenda o Gemini 3.5 Flash-Lite para novos projetos, e o RunAPI o oferece como gemini-3.5-flash-lite.

**ID do modelo:** gemini-2.5-flash-lite
**Lançamento:** 22/07/2025 (disponibilidade geral)
**Data de corte de conhecimento:** Janeiro de 2025
**Janela de contexto:** 1.048.576 tokens
**Saída máxima:** 65.536 tokens
**Thinking:** Opcional, desativado por padrão
**Endpoint no RunAPI:** OpenAI Chat Completions, somente entrada de texto



<!-- catalog-model-detail-slot: model-playground -->

## Experimente Gemini 2.5 Flash-Lite

Escolha qualquer modelo e gere em segundos.


**Modelo:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · Entrada $0.10 / 1M de tokens | Saída $0.40 / 1M de tokens

**Prompt:** Descreva o que você quer criar...

**Estimado:** Entrada $0.10 / 1M de tokens | Saída $0.40 / 1M de tokens

- [Gerar](https://runapi.ai/pt-BR/login)
Entre para gerar com a RunAPI.
<!-- /catalog-model-detail-slot: model-playground -->

### Trocar variante

- [gemini-2.5-flash](https://runapi.ai/pt-BR/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/pt-BR/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/pt-BR/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/pt-BR/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/pt-BR/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/pt-BR/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/pt-BR/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/pt-BR/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/pt-BR/models/gemini/3.8-flash.md)

11 variantes disponíveis





gemini-2.5-flash-lite é um dos modelos Gemini na RunAPI. Ele usa a mesma API key de todos os outros modelos, e você troca de modelo alterando o ID do modelo na requisição. Cada chamada é síncrona e cobrada em USD pelos tokens de entrada, saída e cache, sem assinatura nem gasto mínimo. Uma requisição que falha antes de a resposta começar não é cobrada; depois que a resposta entra em streaming, os tokens já gerados são cobrados, mesmo que o cliente se desconecte.

- Cobrança por token em USD, sem assinatura
- Sem cobrança se a requisição falhar antes da resposta
- Streaming de token em token
- Troque de modelo alterando um único ID de modelo
- Uma API key e uma fatura para todos os modelos e provedores

## Métricas de uso

- **Chamadas de API / Dia:** 6
- **Taxa de sucesso:** 100.0%
- **Geração média:** 1.8s

Feedback verificado de clientes ainda não está disponível para este modelo.



## FICHA TÉCNICA

| Campo | Valor |
|---|---|
| Provedor | Google |
| ID do modelo | gemini-2.5-flash-lite |
| Modalidade | Texto |
| Tipos de tarefa | Synchronous |
| Endpoint da API | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| Unidade de cobrança | 1K tokens |
| Status do catálogo | Operacional |



**COMO FUNCIONA**

## Use este modelo em 3 etapas

1. **Crie sua chave** - Cadastre-se gratuitamente e crie uma chave de API para gemini-2.5-flash-lite no painel.
2. **Envie uma solicitação** - Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo gemini-2.5-flash-lite e seus parâmetros.
3. **Obtenha os resultados** - Leia diretamente do endpoint a resposta concluída de gemini-2.5-flash-lite.



<!-- catalog-model-detail-slot: feature-cards -->

## O que este modelo oferece

- **Cobertura de endpoints** — Expõe 1 endpoint(s) público(s): chat_completion.
- **Cobrança por uso** — Medido por 1K tokens, sem exigência de assinatura.
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite PREÇOS

| Endpoint | Preço |
|---|---|
| `chat_completion` | Entrada: $0.10 / 1M de tokens<br>Saída: $0.40 / 1M de tokens<br>Leitura de cache: $0.01 / 1M de tokens |



**REFERÊNCIA DA API**

## Especificação do endpoint

| Field | Value |
|---|---|
| Endpoint | `POST /v1/chat/completions` |
| ID do modelo | `gemini-2.5-flash-lite` |
| Tipos de tarefa | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## Parâmetros da solicitação

Nenhum parâmetro de solicitação foi publicado para este endpoint.
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois."
    }
  ]
}
```

### Skill do modelo — gemini-2.5-flash-lite

Instale o skill uma vez, depois use o ID do variant desta página durante o desenvolvimento.

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

Use o SDK de OpenAI / Anthropic / Google Gen AI com sua API key da RunAPI e `model: "gemini-2.5-flash-lite"`.

### Como usar gemini-2.5-flash-lite

1. **Instalação** — Instale o model skill da linha Gemini. Ele carrega documentação, formatos de requisição e notas de preço no seu workspace de código.
2. **Configuração** — Aponte seu SDK para https://runapi.ai e defina sua API key da RunAPI. A mesma chave funciona em todos os modelos e provedores.
3. **Chamada** — Envie uma requisição em um formato de API compatível com este modelo, com o campo model definido como o ID do modelo desta página. A RunAPI a encaminha ao provedor.
4. **Recebimento** — Leia a resposta na própria chamada, ou receba-a em streaming conforme é gerada. O campo usage mostra os tokens que você paga.

### Comparativo de gemini-2.5-flash-lite

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite; contexto de 1M, thinking desativado por padrão; Chat Completions compatível com OpenAI** — Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite; contexto de 1M, thinking desativado por padrão; Chat Completions compatível com OpenAI** — Melhor raciocínio na geração 2.5; 1M contexto
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite; contexto de 1M, thinking desativado por padrão; Chat Completions compatível com OpenAI** — gemini-3-flash-preview

## CASOS DE USO

**Chat**

Use LLMs para chat e raciocínio.

**Código**

Gere e revise trabalho de implementação.

**Automação**

Conecte modelos a tarefas backend.



## Perguntas frequentes sobre Gemini 2.5 Flash-Lite

### Devo usar o Gemini 2.5 Flash-Lite ou o Gemini 3.5 Flash-Lite?

O Google recomenda o Gemini 3.5 Flash-Lite ou o Gemini 3.8 Flash para novos trabalhos. Escolha o gemini-2.5-flash-lite quando uma carga, um conjunto de prompts ou uma avaliação que já existe foi construída sobre ele. Os dois modelos estão no RunAPI com a mesma chave de API.

### Ainda posso usar o Gemini 2.5 Flash-Lite?

Sim. O Google não anunciou data de desligamento para ele, embora a própria API do Google agora limite o acesso aos modelos 2.5 a usuários que já os usavam antes. No RunAPI, o gemini-2.5-flash-lite está disponível para todas as contas.

### Posso chamar o Gemini 2.5 Flash-Lite com o SDK da OpenAI?

Sim. Aponte o SDK da OpenAI para https://runapi.ai/v1 com sua chave de API do RunAPI e envie requisições Chat Completions com model definido como gemini-2.5-flash-lite. As ferramentas seguem o formato tools padrão da OpenAI.

### O Gemini 2.5 Flash-Lite raciocina antes de responder?

Não por padrão. O Google o distribui com o thinking desativado, para trabalhos de baixa latência em grande volume, e documenta um modo thinking opcional.

### Como seleciono gemini-2.5-flash-lite?

Envie o ID de modelo mostrado no quickstart.

### O preço é por uso?

Sim. O preço é medido por chamada ou unidade.


### RELACIONADO

- [gemini-3.5-flash-lite](https://runapi.ai/pt-BR/models/gemini/3.5-flash-lite.md) — por Google · Entrada $0.15 / 1M de tokens | Saída $1.25 / 1M de tokens
- [gemini-3.1-flash-lite](https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite.md) — por Google · Entrada $0.25 / 1M de tokens | Saída $1.50 / 1M de tokens
- [gemini-2.5-flash](https://runapi.ai/pt-BR/models/gemini/2.5-flash.md) — por Google · Entrada $0.30 / 1M de tokens | Saída $2.50 / 1M de tokens
- [gemini-3-flash-preview](https://runapi.ai/pt-BR/models/gemini/3-flash-preview.md) — por Google · Entrada $0.50 / 1M de tokens | Saída $3.00 / 1M de tokens · Entrada $0.30 / 1M de tokens | Saída $1.80 / 1M de tokens

### Comece com Gemini hoje.

- [Criar conta grátis](https://runapi.ai/pt-BR/login)
- [Ler início rápido →](https://runapi.ai/pt-BR/docs/api/openai/chat-completions)
## Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

[Fale conosco](https://runapi.ai/pt-BR/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/pt-BR/.md)
### Produto
- [Catálogo de modelos](https://runapi.ai/pt-BR/models.md)
- [Preços](https://runapi.ai/pt-BR/pricing.md)
- [Provedores](https://runapi.ai/pt-BR/models#all-models)
### Desenvolvedores
- [Documentação](https://runapi.ai/pt-BR/docs/guides)
- [SDKs](https://runapi.ai/pt-BR/sdk.md)
- [CLI](https://runapi.ai/pt-BR/cli.md)
- [Servidor MCP](https://runapi.ai/pt-BR/mcp.md)
- [x402](https://runapi.ai/pt-BR/x402.md)
### Guias
- [Claude Code vs Cursor](https://runapi.ai/pt-BR/claude-code-vs-cursor.md)
- [Configuração da API do Cursor](https://runapi.ai/pt-BR/cursor-api-setup.md)
- [RunAPI vs OpenRouter](https://runapi.ai/pt-BR/openrouter-alternative.md)
### Empresa
- [Enterprise](https://runapi.ai/pt-BR/contact.md)
- [Contato](https://runapi.ai/pt-BR/contact.md)
### Legal
- [Termos](https://runapi.ai/pt-BR/terms.md)
- [Privacidade](https://runapi.ai/pt-BR/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/pt-BR",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/pt-BR/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/pt-BR",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/pt-BRicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/pt-BR"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/pt-BR/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/pt-BR/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "HowTo",
    "name": "Como usar gemini-2.5-flash-lite",
    "description": "Chame gemini-2.5-flash-lite da família Gemini pela RunAPI: preço por token, ID do modelo, formatos de API compatíveis e guia de configuração.",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "Instalação",
        "text": "Instale o model skill da linha Gemini. Ele carrega documentação, formatos de requisição e notas de preço no seu workspace de código.",
        "url": "https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "Configuração",
        "text": "Aponte seu SDK para https://runapi.ai e defina sua API key da RunAPI. A mesma chave funciona em todos os modelos e provedores.",
        "url": "https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "Chamada",
        "text": "Envie uma requisição em um formato de API compatível com este modelo, com o campo model definido como o ID do modelo desta página. A RunAPI a encaminha ao provedor.",
        "url": "https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "Recebimento",
        "text": "Leia a resposta na própria chamada, ou receba-a em streaming conforme é gerada. O campo usage mostra os tokens que você paga.",
        "url": "https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "pt-BR",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "Devo usar o Gemini 2.5 Flash-Lite ou o Gemini 3.5 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "O Google recomenda o Gemini 3.5 Flash-Lite ou o Gemini 3.8 Flash para novos trabalhos. Escolha o gemini-2.5-flash-lite quando uma carga, um conjunto de prompts ou uma avaliação que já existe foi construída sobre ele. Os dois modelos estão no RunAPI com a mesma chave de API."
        }
      },
      {
        "@type": "Question",
        "name": "Ainda posso usar o Gemini 2.5 Flash-Lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sim. O Google não anunciou data de desligamento para ele, embora a própria API do Google agora limite o acesso aos modelos 2.5 a usuários que já os usavam antes. No RunAPI, o gemini-2.5-flash-lite está disponível para todas as contas."
        }
      },
      {
        "@type": "Question",
        "name": "Posso chamar o Gemini 2.5 Flash-Lite com o SDK da OpenAI?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sim. Aponte o SDK da OpenAI para https://runapi.ai/v1 com sua chave de API do RunAPI e envie requisições Chat Completions com model definido como gemini-2.5-flash-lite. As ferramentas seguem o formato tools padrão da OpenAI."
        }
      },
      {
        "@type": "Question",
        "name": "O Gemini 2.5 Flash-Lite raciocina antes de responder?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Não por padrão. O Google o distribui com o thinking desativado, para trabalhos de baixa latência em grande volume, e documenta um modo thinking opcional."
        }
      },
      {
        "@type": "Question",
        "name": "Como seleciono gemini-2.5-flash-lite?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Envie o ID de modelo mostrado no quickstart."
        }
      },
      {
        "@type": "Question",
        "name": "O preço é por uso?",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Sim. O preço é medido por chamada ou unidade."
        }
      }
    ]
  }
]
```
