---
title: Gemini 2.5 Flash-Lite API：模型 ID、100 万上下文与 OpenAI SDK | RunAPI
description: 通过 RunAPI 的 OpenAI 兼容 Chat Completions API 调用 gemini-2.5-flash-lite。100 万 token 上下文，65K 输出，默认关闭思考，支持文本输入。
url: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite.md
canonical: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
locale: zh-CN
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/2.5-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
  es: https://runapi.ai/es/models/gemini/2.5-flash-lite
  ja: https://runapi.ai/ja/models/gemini/2.5-flash-lite
  de: https://runapi.ai/de/models/gemini/2.5-flash-lite
  fr: https://runapi.ai/fr/models/gemini/2.5-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/2.5-flash-lite
  ko: https://runapi.ai/ko/models/gemini/2.5-flash-lite
  it: https://runapi.ai/it/models/gemini/2.5-flash-lite
  nl: https://runapi.ai/nl/models/gemini/2.5-flash-lite
  pl: https://runapi.ai/pl/models/gemini/2.5-flash-lite
  tr: https://runapi.ai/tr/models/gemini/2.5-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/2.5-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/2.5-flash-lite
  ar: https://runapi.ai/ar/models/gemini/2.5-flash-lite
  x-default: https://runapi.ai/models/gemini/2.5-flash-lite
model: Gemini
provider: Google
variant_id: gemini-2.5-flash-lite
sdk_model_id: gemini-2.5-flash-lite
modality: text
billing_unit: 1K tokens
status: active
---

> HTML version: https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-2.5-flash-lite API

通过 RunAPI 调用 Gemini 系列的 gemini-2.5-flash-lite。按 token 计费，无需订阅，响应开始前失败的请求不计费。

**Google / [Gemini](https://runapi.ai/zh-CN/models/gemini.md)**
**运行中 · text · 可商用**

## Gemini 2.5 Flash-Lite 适合做什么

Gemini 2.5 Flash-Lite 是 Google Gemini 2.5 代的 Flash-Lite 档位，面向大批量的分类、信息抽取和其他低延迟任务。它于 2025 年 7 月 22 日正式发布（GA），知识截止时间为 2025 年 1 月。上下文窗口为 1,048,576 token，最多输出 65,536 token。

思考默认关闭，Google 文档中提供了可选的思考模式，用于较难的提示。Google 在该模型上支持函数调用和结构化输出。

Google 的模型接受文本、图像、视频、音频和 PDF 输入。在 RunAPI 上，可通过 OpenAI 兼容的 Chat Completions 端点（/v1/chat/completions）发送文本；RunAPI 对该模型只接受文本输入。Google 建议新项目使用 Gemini 3.5 Flash-Lite，它在 RunAPI 上的模型 ID 为 gemini-3.5-flash-lite。

**模型 ID:** gemini-2.5-flash-lite
**发布日期:** 2025 年 7 月 22 日（正式发布）
**知识截止时间:** 2025 年 1 月
**上下文窗口:** 1,048,576 token
**最大输出:** 65,536 token
**思考:** 可选，默认关闭
**RunAPI 上的端点:** OpenAI Chat Completions，文本输入



<!-- catalog-model-detail-slot: model-playground -->

## 体验 Gemini 2.5 Flash-Lite

选择任意模型，几秒内开始生成。


**模型:**
- **Chat completion** — `chat_completion` · `gemini-2.5-flash-lite` · 输入 $0.10 / 百万 tokens | 输出 $0.40 / 百万 tokens

**提示词:** 描述你想创建的内容……

**预计：** 输入 $0.10 / 百万 tokens | 输出 $0.40 / 百万 tokens

- [生成](https://runapi.ai/zh-CN/login)
登录后即可使用 RunAPI 生成。
<!-- /catalog-model-detail-slot: model-playground -->

### 切换变体

- [gemini-2.5-flash](https://runapi.ai/zh-CN/models/gemini/2.5-flash.md)
- **gemini-2.5-flash-lite** (current)
- [gemini-2.5-pro](https://runapi.ai/zh-CN/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/zh-CN/models/gemini/3-flash-preview.md)
- [gemini-3.1-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite.md)
- [gemini-3.1-pro-preview](https://runapi.ai/zh-CN/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/zh-CN/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/zh-CN/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/zh-CN/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/zh-CN/models/gemini/3.8-flash.md)

11 个版本可用





gemini-2.5-flash-lite 是 RunAPI 上 Gemini 系列的模型之一。它与其他所有模型使用同一个 API key，只需修改请求中的模型 ID 即可切换。每次调用为同步调用，按输入、输出和缓存 token 以 USD 计费，无订阅，无最低消费。响应开始前失败的请求不计费；响应开始流式输出后，已生成的 token 会计费，即使客户端断开连接。

- 按 token 以 USD 计费，无需订阅
- 响应开始前失败的请求不计费
- 逐 token 流式输出
- 修改一个模型 ID 即可切换模型
- 所有模型和供应商共用一个 API key、一张账单

## 使用指标

- **API 调用量 / 天:** 6
- **成功率:** 100.0%
- **平均生成时间:** 1.8s

该模型暂无已验证的用户反馈。



## 技术细节

| 字段 | 值 |
|---|---|
| 提供商 | Google |
| 模型 ID | gemini-2.5-flash-lite |
| 模态 | 文本 |
| 任务类型 | Synchronous |
| API 端点 | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-2.5-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` |
| 计费单位 | 1K tokens |
| 目录状态 | 运行中 |



**工作原理**

## 3 步使用此模型

1. **获取 API 密钥** - 免费注册后，在控制台创建用于 gemini-2.5-flash-lite 的 API 密钥。
2. **发送请求** - 向 /v1/chat/completions 发送 POST 请求，并传入 gemini-2.5-flash-lite 模型 ID 和参数。
3. **获取结果** - 直接从端点读取已完成的 gemini-2.5-flash-lite 响应。



<!-- catalog-model-detail-slot: feature-cards -->

## 该模型的核心能力

- **Endpoint 覆盖** — 提供 1 个公开 endpoint：chat_completion。
- **按量计费** — 按 1K tokens 计量，无需订阅。
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 2.5 Flash-Lite 定价

| 端点 | 价格 |
|---|---|
| `chat_completion` | 输入: $0.10 / 百万 tokens<br>输出: $0.40 / 百万 tokens<br>缓存读取: $0.01 / 百万 tokens |



**API 参考**

## 端点规格

| Field | Value |
|---|---|
| 端点 | `POST /v1/chat/completions` |
| 模型 ID | `gemini-2.5-flash-lite` |
| 任务类型 | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## 请求参数

此端点尚未发布请求参数。
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "分析这段代码库，给出三项性能优化建议，包含优化前后的对比示例。"
    }
  ]
}
```

### 模型 Skill — gemini-2.5-flash-lite

安装一次 skill，开发时使用本页的变体 ID。

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-2.5-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

使用 OpenAI / Anthropic / Google Gen AI SDK，配合您的 RunAPI API key 和 `model: "gemini-2.5-flash-lite"` 调用。

### 用 model skill 使用 gemini-2.5-flash-lite

1. **安装** — 安装 Gemini 系列对应的 model skill，它会把文档、请求格式和价格说明加载到您的编码工作区。
2. **配置** — 把 SDK 指向 https://runapi.ai，并设置您的 RunAPI API key。同一个 key 适用于所有模型和供应商。
3. **调用** — 使用该模型支持的 API 格式发送请求，并把 model 字段设置为本页展示的模型 ID。RunAPI 会把请求转发给供应商。
4. **接收** — 从同一次调用中读取响应，或在生成过程中以流式方式接收。usage 字段显示您被计费的 token。

### gemini-2.5-flash-lite 与其它变体的差异

- **VS GEMINI-2.5-FLASH: Gemini 2.5 Flash-Lite；100 万上下文，默认关闭思考；OpenAI 兼容 Chat Completions** — 速度/成本优化；100 万上下文；稳定基线
- **VS GEMINI-2.5-PRO: Gemini 2.5 Flash-Lite；100 万上下文，默认关闭思考；OpenAI 兼容 Chat Completions** — 2.5 代最强推理；100 万上下文
- **VS GEMINI-3-FLASH-PREVIEW: Gemini 2.5 Flash-Lite；100 万上下文，默认关闭思考；OpenAI 兼容 Chat Completions** — gemini-3-flash-preview

## 应用场景

**客户支持**

基于私有知识库回答客户问题，减少工单量。

**文档分析**

起草合同摘要并标记关键条款供律师审阅。

**代码生成**

在 CI 中自动生成单元测试、代码审查和重构建议。



## Gemini 2.5 Flash-Lite 常见问题

### 应该用 Gemini 2.5 Flash-Lite 还是 Gemini 3.5 Flash-Lite？

Google 建议新项目使用 Gemini 3.5 Flash-Lite 或 Gemini 3.8 Flash。如果现有工作负载、提示词集或评测是基于 gemini-2.5-flash-lite 搭建的，就继续用它。两个模型在 RunAPI 上共用同一个 API key。

### Gemini 2.5 Flash-Lite 现在还能用吗？

能。Google 尚未公布它的停用日期，不过 Google 自己的 API 现在只向此前用过 2.5 模型的用户开放访问。在 RunAPI 上，所有账号都可以使用 gemini-2.5-flash-lite。

### 能用 OpenAI SDK 调用 Gemini 2.5 Flash-Lite 吗？

能。把 OpenAI SDK 指向 https://runapi.ai/v1，使用你的 RunAPI API key，发送 model 为 gemini-2.5-flash-lite 的 Chat Completions 请求。工具使用标准的 OpenAI tools 格式。

### Gemini 2.5 Flash-Lite 会先思考再作答吗？

默认不会。Google 发布时就关闭了思考，以适应大批量、低延迟的任务，同时在文档中提供可选的思考模式。

### 如何选择 gemini-2.5-flash-lite？

传入 quickstart 中显示的模型 ID。

### 该变体的限流？

Key 级限流随使用层级伸缩。当前限制见定价页。

### 能切到其它变体吗？

可以——变体只是参数，改 model 字段即可。

### 支持流式吗？

模型支持流式时，RunAPI 端到端流式。

### 质量问题在哪里报？

在公共 GitHub 仓库提 issue 或邮件联系 support。


### 相关

- [gemini-3.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.5-flash-lite.md) — 由 Google 提供 · 输入 $0.15 / 百万 tokens | 输出 $1.25 / 百万 tokens
- [gemini-3.1-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite.md) — 由 Google 提供 · 输入 $0.25 / 百万 tokens | 输出 $1.50 / 百万 tokens
- [gemini-2.5-flash](https://runapi.ai/zh-CN/models/gemini/2.5-flash.md) — 由 Google 提供 · 输入 $0.30 / 百万 tokens | 输出 $2.50 / 百万 tokens
- [gemini-3-flash-preview](https://runapi.ai/zh-CN/models/gemini/3-flash-preview.md) — 由 Google 提供 · 输入 $0.50 / 百万 tokens | 输出 $3.00 / 百万 tokens · 输入 $0.30 / 百万 tokens | 输出 $1.80 / 百万 tokens

### 立即体验 Gemini。

- [免费注册](https://runapi.ai/zh-CN/login)
- [阅读快速开始 →](https://runapi.ai/zh-CN/docs/api/openai/chat-completions)
## 需要团队接入支持？

我们可以协助团队接入、完成系统集成并解答技术问题。

[联系我们](https://runapi.ai/zh-CN/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/zh-CN/.md)
### 产品
- [模型目录](https://runapi.ai/zh-CN/models.md)
- [定价](https://runapi.ai/zh-CN/pricing.md)
- [提供方](https://runapi.ai/zh-CN/models#all-models)
### 开发者
- [文档](https://runapi.ai/zh-CN/docs/guides)
- [SDK](https://runapi.ai/zh-CN/sdk.md)
- [CLI](https://runapi.ai/zh-CN/cli.md)
- [MCP Server](https://runapi.ai/zh-CN/mcp.md)
- [x402](https://runapi.ai/zh-CN/x402.md)
### 指南
- [Claude Code 与 Cursor](https://runapi.ai/zh-CN/claude-code-vs-cursor.md)
- [Cursor API 设置](https://runapi.ai/zh-CN/cursor-api-setup.md)
- [RunAPI 与 OpenRouter](https://runapi.ai/zh-CN/openrouter-alternative.md)
### 公司
- [企业版](https://runapi.ai/zh-CN/contact.md)
- [联系](https://runapi.ai/zh-CN/contact.md)
### 法律
- [服务条款](https://runapi.ai/zh-CN/terms.md)
- [隐私政策](https://runapi.ai/zh-CN/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/zh-CN",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/zh-CN/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/zh-CN",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/zh-CNicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-2.5-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/zh-CN"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/zh-CN/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/zh-CN/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-2.5-flash-lite",
        "item": "https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "HowTo",
    "name": "用 model skill 使用 gemini-2.5-flash-lite",
    "description": "通过 RunAPI 调用 Gemini 系列的 gemini-2.5-flash-lite：按 token 计费、模型 ID、支持的 API 格式和接入指南。",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "安装",
        "text": "安装 Gemini 系列对应的 model skill，它会把文档、请求格式和价格说明加载到您的编码工作区。",
        "url": "https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "配置",
        "text": "把 SDK 指向 https://runapi.ai，并设置您的 RunAPI API key。同一个 key 适用于所有模型和供应商。",
        "url": "https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "调用",
        "text": "使用该模型支持的 API 格式发送请求，并把 model 字段设置为本页展示的模型 ID。RunAPI 会把请求转发给供应商。",
        "url": "https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "接收",
        "text": "从同一次调用中读取响应，或在生成过程中以流式方式接收。usage 字段显示您被计费的 token。",
        "url": "https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "应该用 Gemini 2.5 Flash-Lite 还是 Gemini 3.5 Flash-Lite？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google 建议新项目使用 Gemini 3.5 Flash-Lite 或 Gemini 3.8 Flash。如果现有工作负载、提示词集或评测是基于 gemini-2.5-flash-lite 搭建的，就继续用它。两个模型在 RunAPI 上共用同一个 API key。"
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite 现在还能用吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "能。Google 尚未公布它的停用日期，不过 Google 自己的 API 现在只向此前用过 2.5 模型的用户开放访问。在 RunAPI 上，所有账号都可以使用 gemini-2.5-flash-lite。"
        }
      },
      {
        "@type": "Question",
        "name": "能用 OpenAI SDK 调用 Gemini 2.5 Flash-Lite 吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "能。把 OpenAI SDK 指向 https://runapi.ai/v1，使用你的 RunAPI API key，发送 model 为 gemini-2.5-flash-lite 的 Chat Completions 请求。工具使用标准的 OpenAI tools 格式。"
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 2.5 Flash-Lite 会先思考再作答吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "默认不会。Google 发布时就关闭了思考，以适应大批量、低延迟的任务，同时在文档中提供可选的思考模式。"
        }
      },
      {
        "@type": "Question",
        "name": "如何选择 gemini-2.5-flash-lite？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "传入 quickstart 中显示的模型 ID。"
        }
      },
      {
        "@type": "Question",
        "name": "该变体的限流？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Key 级限流随使用层级伸缩。当前限制见定价页。"
        }
      },
      {
        "@type": "Question",
        "name": "能切到其它变体吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "可以——变体只是参数，改 model 字段即可。"
        }
      },
      {
        "@type": "Question",
        "name": "支持流式吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "模型支持流式时，RunAPI 端到端流式。"
        }
      },
      {
        "@type": "Question",
        "name": "质量问题在哪里报？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "在公共 GitHub 仓库提 issue 或邮件联系 support。"
        }
      }
    ]
  }
]
```
