---
title: Gemini 3.1 Flash-Lite API：模型 ID、100 万上下文与 OpenAI SDK | RunAPI
description: 通过 RunAPI 的 OpenAI 兼容 Chat Completions API 调用 gemini-3.1-flash-lite。100 万 token 上下文，65K 输出，可调思考，支持文本输入。
url: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite.md
canonical: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
locale: zh-CN
site: RunAPI
image: https://runapi.ai/assets/opengraph-bfaaa0f0.png
alternates:
  en: https://runapi.ai/models/gemini/3.1-flash-lite
  zh-CN: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
  es: https://runapi.ai/es/models/gemini/3.1-flash-lite
  ja: https://runapi.ai/ja/models/gemini/3.1-flash-lite
  de: https://runapi.ai/de/models/gemini/3.1-flash-lite
  fr: https://runapi.ai/fr/models/gemini/3.1-flash-lite
  pt-BR: https://runapi.ai/pt-BR/models/gemini/3.1-flash-lite
  ko: https://runapi.ai/ko/models/gemini/3.1-flash-lite
  it: https://runapi.ai/it/models/gemini/3.1-flash-lite
  nl: https://runapi.ai/nl/models/gemini/3.1-flash-lite
  pl: https://runapi.ai/pl/models/gemini/3.1-flash-lite
  tr: https://runapi.ai/tr/models/gemini/3.1-flash-lite
  zh-TW: https://runapi.ai/zh-TW/models/gemini/3.1-flash-lite
  zh-HK: https://runapi.ai/zh-HK/models/gemini/3.1-flash-lite
  ar: https://runapi.ai/ar/models/gemini/3.1-flash-lite
  x-default: https://runapi.ai/models/gemini/3.1-flash-lite
model: Gemini
provider: Google
variant_id: gemini-3.1-flash-lite
sdk_model_id: gemini-3.1-flash-lite
modality: text
billing_unit: 1K tokens
status: active
---

> HTML version: https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite
> Site index for agents: https://runapi.ai/llms.txt


# gemini-3.1-flash-lite API

通过 RunAPI 调用 Gemini 系列的 gemini-3.1-flash-lite。按 token 计费，无需订阅，响应开始前失败的请求不计费。

**Google / [Gemini](https://runapi.ai/zh-CN/models/gemini.md)**
**运行中 · text · 可商用**

## Gemini 3.1 Flash-Lite 适合做什么

Gemini 3.1 Flash-Lite 是 Google Gemini 3 系列中低延迟、低成本的模型。Google 将它用于大批量的简单任务，例如翻译、分类与实体抽取、文档分拣，以及在模型之间路由请求。稳定版 gemini-3.1-flash-lite 于 2026 年 5 月 7 日正式发布（GA）。上下文窗口为 1,048,576 token，最多输出 65,536 token。

思考可调：Google 提供从 minimal 到 high 共四档思考级别，思考 token 计入输出。Google 在该模型上支持函数调用和结构化输出。

Google 的模型接受文本、图像、视频、音频和 PDF 输入。在 RunAPI 上，gemini-3.1-flash-lite 只接受文本输入。可通过 OpenAI 兼容的 Chat Completions 端点（/v1/chat/completions）、OpenAI Responses、Anthropic Messages 或 Gemini generateContent 发送请求。Google 指定 Gemini 3.5 Flash-Lite 为后继模型，它在 RunAPI 上的模型 ID 为 gemini-3.5-flash-lite。

**模型 ID:** gemini-3.1-flash-lite
**发布日期:** 2026 年 5 月 7 日（正式发布）
**上下文窗口:** 1,048,576 token
**最大输出:** 65,536 token
**思考:** 可调，从 minimal 到 high
**最早停用日期（Google）:** 2027 年 5 月 7 日
**RunAPI 上的端点:** OpenAI Chat Completions，文本输入



<!-- catalog-model-detail-slot: model-playground -->

## 体验 Gemini 3.1 Flash-Lite

选择任意模型，几秒内开始生成。


**模型:**
- **Chat completion** — `chat_completion` · `gemini-3.1-flash-lite` · 输入 $0.25 / 百万 tokens | 输出 $1.50 / 百万 tokens

**提示词:** 描述你想创建的内容……

**预计：** 输入 $0.25 / 百万 tokens | 输出 $1.50 / 百万 tokens

- [生成](https://runapi.ai/zh-CN/login)
登录后即可使用 RunAPI 生成。
<!-- /catalog-model-detail-slot: model-playground -->

### 切换变体

- [gemini-2.5-flash](https://runapi.ai/zh-CN/models/gemini/2.5-flash.md)
- [gemini-2.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite.md)
- [gemini-2.5-pro](https://runapi.ai/zh-CN/models/gemini/2.5-pro.md)
- [gemini-3-flash-preview](https://runapi.ai/zh-CN/models/gemini/3-flash-preview.md)
- **gemini-3.1-flash-lite** (current)
- [gemini-3.1-pro-preview](https://runapi.ai/zh-CN/models/gemini/3.1-pro-preview.md)
- [gemini-3.5-flash](https://runapi.ai/zh-CN/models/gemini/3.5-flash.md)
- [gemini-3.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.5-flash-lite.md)
- [gemini-3.6-flash](https://runapi.ai/zh-CN/models/gemini/3.6-flash.md)
- [gemini-3.7-flash](https://runapi.ai/zh-CN/models/gemini/3.7-flash.md)
- [gemini-3.8-flash](https://runapi.ai/zh-CN/models/gemini/3.8-flash.md)

11 个版本可用





gemini-3.1-flash-lite 是 RunAPI 上 Gemini 系列的模型之一。它与其他所有模型使用同一个 API key，只需修改请求中的模型 ID 即可切换。每次调用为同步调用，按输入、输出和缓存 token 以 USD 计费，无订阅，无最低消费。响应开始前失败的请求不计费；响应开始流式输出后，已生成的 token 会计费，即使客户端断开连接。

- 按 token 以 USD 计费，无需订阅
- 响应开始前失败的请求不计费
- 逐 token 流式输出
- 修改一个模型 ID 即可切换模型
- 所有模型和供应商共用一个 API key、一张账单

## 使用指标

- **API 调用量 / 天:** 6
- **成功率:** 100.0%
- **平均生成时间:** 1.9s

该模型暂无已验证的用户反馈。



## 技术细节

| 字段 | 值 |
|---|---|
| 提供商 | Google |
| 模型 ID | gemini-3.1-flash-lite |
| 模态 | 文本 |
| 任务类型 | Synchronous |
| API 端点 | `/v1/chat/completions` |
|  | `/v1/responses` |
|  | `/v1/messages` |
|  | `/v1beta/models/gemini-3.1-flash-lite:generateContent` |
|  | `/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` |
| 计费单位 | 1K tokens |
| 目录状态 | 运行中 |



**工作原理**

## 3 步使用此模型

1. **获取 API 密钥** - 免费注册后，在控制台创建用于 gemini-3.1-flash-lite 的 API 密钥。
2. **发送请求** - 向 /v1/chat/completions 发送 POST 请求，并传入 gemini-3.1-flash-lite 模型 ID 和参数。
3. **获取结果** - 直接从端点读取已完成的 gemini-3.1-flash-lite 响应。



<!-- catalog-model-detail-slot: feature-cards -->

## 该模型的核心能力

- **Endpoint 覆盖** — 提供 1 个公开 endpoint：chat_completion。
- **按量计费** — 按 1K tokens 计量，无需订阅。
<!-- /catalog-model-detail-slot: feature-cards -->



## Gemini 3.1 Flash-Lite 定价

| 端点 | 价格 |
|---|---|
| `chat_completion` | 输入: $0.25 / 百万 tokens<br>输出: $1.50 / 百万 tokens<br>缓存读取: $0.03 / 百万 tokens |



**API 参考**

## 端点规格

| Field | Value |
|---|---|
| 端点 | `POST /v1/chat/completions` |
| 模型 ID | `gemini-3.1-flash-lite` |
| 任务类型 | `chat_completion` |


<!-- catalog-model-detail-slot: request-parameters -->

## 请求参数

此端点尚未发布请求参数。
<!-- /catalog-model-detail-slot: request-parameters -->

**Request example**

```json
{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "分析这段代码库，给出三项性能优化建议，包含优化前后的对比示例。"
    }
  ]
}
```

### 模型 Skill — gemini-3.1-flash-lite

安装一次 skill，开发时使用本页的变体 ID。

Base URL: `https://runapi.ai`

| Endpoint | Protocol |
|---|---|
| `POST /v1/chat/completions` | OpenAI compatible |
| `POST /v1/responses` | OpenAI Responses |
| `POST /v1/messages` | Anthropic compatible |
| `POST /v1beta/models/gemini-3.1-flash-lite:generateContent` | Gemini generateContent |
| `POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent` | Gemini streamGenerateContent |

使用 OpenAI / Anthropic / Google Gen AI SDK，配合您的 RunAPI API key 和 `model: "gemini-3.1-flash-lite"` 调用。

### 用 model skill 使用 gemini-3.1-flash-lite

1. **安装** — 安装 Gemini 系列对应的 model skill，它会把文档、请求格式和价格说明加载到您的编码工作区。
2. **配置** — 把 SDK 指向 https://runapi.ai，并设置您的 RunAPI API key。同一个 key 适用于所有模型和供应商。
3. **调用** — 使用该模型支持的 API 格式发送请求，并把 model 字段设置为本页展示的模型 ID。RunAPI 会把请求转发给供应商。
4. **接收** — 从同一次调用中读取响应，或在生成过程中以流式方式接收。usage 字段显示您被计费的 token。

### gemini-3.1-flash-lite 与其它变体的差异

- **VS GEMINI-2.5-FLASH: Gemini 3.1 Flash-Lite；100 万上下文，可调思考；通过 OpenAI 兼容 Chat Completions 发送文本请求** — 速度/成本优化；100 万上下文；稳定基线
- **VS GEMINI-2.5-FLASH-LITE: Gemini 3.1 Flash-Lite；100 万上下文，可调思考；通过 OpenAI 兼容 Chat Completions 发送文本请求** — Gemini 2.5 Flash-Lite；100 万上下文，默认关闭思考；OpenAI 兼容 Chat Completions
- **VS GEMINI-2.5-PRO: Gemini 3.1 Flash-Lite；100 万上下文，可调思考；通过 OpenAI 兼容 Chat Completions 发送文本请求** — 2.5 代最强推理；100 万上下文

## 应用场景

**客户支持**

基于私有知识库回答客户问题，减少工单量。

**文档分析**

起草合同摘要并标记关键条款供律师审阅。

**代码生成**

在 CI 中自动生成单元测试、代码审查和重构建议。



## Gemini 3.1 Flash-Lite 常见问题

### 应该用 Gemini 3.1 Flash-Lite 还是 Gemini 3.5 Flash-Lite？

Google 指定 Gemini 3.5 Flash-Lite 作为 3.1 Flash-Lite 的后继模型。新项目建议从 gemini-3.5-flash-lite 开始；如果现有工作负载、提示词集或评测是基于 gemini-3.1-flash-lite 搭建的，就继续用它。两个模型在 RunAPI 上共用同一个 API key。

### Gemini 3.1 Flash-Lite 还能用多久？

Google 将 2027 年 5 月 7 日列为 gemini-3.1-flash-lite 的最早停用日期。预览版模型已于 2026 年 5 月停用，请使用稳定版模型 ID。

### 能用 OpenAI SDK 调用 Gemini 3.1 Flash-Lite 吗？

能。把 OpenAI SDK 指向 https://runapi.ai/v1，使用你的 RunAPI API key，发送 model 为 gemini-3.1-flash-lite 的 Chat Completions 请求。工具使用标准的 OpenAI tools 格式。

### 在 RunAPI 上可以向 gemini-3.1-flash-lite 发送图片或音频吗？

目前不可以。Google 的模型能读取图像、视频、音频和 PDF，但 RunAPI 对 gemini-3.1-flash-lite 只接受文本输入，包含媒体部分的请求会被拒绝。

### 如何选择 gemini-3.1-flash-lite？

传入 quickstart 中显示的模型 ID。

### 该变体的限流？

Key 级限流随使用层级伸缩。当前限制见定价页。

### 能切到其它变体吗？

可以——变体只是参数，改 model 字段即可。

### 支持流式吗？

模型支持流式时，RunAPI 端到端流式。

### 质量问题在哪里报？

在公共 GitHub 仓库提 issue 或邮件联系 support。


### 相关

- [gemini-2.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/2.5-flash-lite.md) — 由 Google 提供 · 输入 $0.10 / 百万 tokens | 输出 $0.40 / 百万 tokens
- [gemini-3.5-flash-lite](https://runapi.ai/zh-CN/models/gemini/3.5-flash-lite.md) — 由 Google 提供 · 输入 $0.15 / 百万 tokens | 输出 $1.25 / 百万 tokens
- [gemini-2.5-flash](https://runapi.ai/zh-CN/models/gemini/2.5-flash.md) — 由 Google 提供 · 输入 $0.30 / 百万 tokens | 输出 $2.50 / 百万 tokens
- [gemini-3-flash-preview](https://runapi.ai/zh-CN/models/gemini/3-flash-preview.md) — 由 Google 提供 · 输入 $0.50 / 百万 tokens | 输出 $3.00 / 百万 tokens · 输入 $0.30 / 百万 tokens | 输出 $1.80 / 百万 tokens

### 立即体验 Gemini。

- [免费注册](https://runapi.ai/zh-CN/login)
- [阅读快速开始 →](https://runapi.ai/zh-CN/docs/api/openai/chat-completions)
## 需要团队接入支持？

我们可以协助团队接入、完成系统集成并解答技术问题。

[联系我们](https://runapi.ai/zh-CN/contact.md)



---

## More from RunAPI

- [Home](https://runapi.ai/zh-CN/.md)
### 产品
- [模型目录](https://runapi.ai/zh-CN/models.md)
- [定价](https://runapi.ai/zh-CN/pricing.md)
- [提供方](https://runapi.ai/zh-CN/models#all-models)
### 开发者
- [文档](https://runapi.ai/zh-CN/docs/guides)
- [SDK](https://runapi.ai/zh-CN/sdk.md)
- [CLI](https://runapi.ai/zh-CN/cli.md)
- [MCP Server](https://runapi.ai/zh-CN/mcp.md)
- [x402](https://runapi.ai/zh-CN/x402.md)
### 指南
- [Claude Code 与 Cursor](https://runapi.ai/zh-CN/claude-code-vs-cursor.md)
- [Cursor API 设置](https://runapi.ai/zh-CN/cursor-api-setup.md)
- [RunAPI 与 OpenRouter](https://runapi.ai/zh-CN/openrouter-alternative.md)
### 公司
- [企业版](https://runapi.ai/zh-CN/contact.md)
- [联系](https://runapi.ai/zh-CN/contact.md)
### 法律
- [服务条款](https://runapi.ai/zh-CN/terms.md)
- [隐私政策](https://runapi.ai/zh-CN/privacy.md)
- [Site index for agents](https://runapi.ai/llms.txt)

Contact: contact@runapi.ai

## Structured data

```json
[
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "WebSite",
    "name": "RunAPI",
    "url": "https://runapi.ai/zh-CN",
    "potentialAction": {
      "@type": "SearchAction",
      "target": {
        "@type": "EntryPoint",
        "urlTemplate": "https://runapi.ai/zh-CN/models?q={search_term_string}"
      },
      "query-input": "required name=search_term_string"
    }
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "Organization",
    "name": "RunAPI",
    "url": "https://runapi.ai/zh-CN",
    "logo": {
      "@type": "ImageObject",
      "url": "https://runapi.ai/zh-CNicon.svg"
    },
    "sameAs": [
      "https://github.com/runapi-ai"
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "SoftwareApplication",
    "name": "Gemini gemini-3.1-flash-lite",
    "applicationCategory": "DeveloperApplication"
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "BreadcrumbList",
    "itemListElement": [
      {
        "@type": "ListItem",
        "position": 1,
        "name": "Home",
        "item": "https://runapi.ai/zh-CN"
      },
      {
        "@type": "ListItem",
        "position": 2,
        "name": "Models",
        "item": "https://runapi.ai/zh-CN/models"
      },
      {
        "@type": "ListItem",
        "position": 3,
        "name": "Gemini",
        "item": "https://runapi.ai/zh-CN/models/gemini"
      },
      {
        "@type": "ListItem",
        "position": 4,
        "name": "gemini-3.1-flash-lite",
        "item": "https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "HowTo",
    "name": "用 model skill 使用 gemini-3.1-flash-lite",
    "description": "通过 RunAPI 调用 Gemini 系列的 gemini-3.1-flash-lite：按 token 计费、模型 ID、支持的 API 格式和接入指南。",
    "totalTime": "PT5M",
    "step": [
      {
        "@type": "HowToStep",
        "position": 1,
        "name": "安装",
        "text": "安装 Gemini 系列对应的 model skill，它会把文档、请求格式和价格说明加载到您的编码工作区。",
        "url": "https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite#how-step-1"
      },
      {
        "@type": "HowToStep",
        "position": 2,
        "name": "配置",
        "text": "把 SDK 指向 https://runapi.ai，并设置您的 RunAPI API key。同一个 key 适用于所有模型和供应商。",
        "url": "https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite#how-step-2"
      },
      {
        "@type": "HowToStep",
        "position": 3,
        "name": "调用",
        "text": "使用该模型支持的 API 格式发送请求，并把 model 字段设置为本页展示的模型 ID。RunAPI 会把请求转发给供应商。",
        "url": "https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite#how-step-3"
      },
      {
        "@type": "HowToStep",
        "position": 4,
        "name": "接收",
        "text": "从同一次调用中读取响应，或在生成过程中以流式方式接收。usage 字段显示您被计费的 token。",
        "url": "https://runapi.ai/zh-CN/models/gemini/3.1-flash-lite#how-step-4"
      }
    ]
  },
  {
    "@context": "https://schema.org",
    "inLanguage": "zh-CN",
    "@type": "FAQPage",
    "mainEntity": [
      {
        "@type": "Question",
        "name": "应该用 Gemini 3.1 Flash-Lite 还是 Gemini 3.5 Flash-Lite？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google 指定 Gemini 3.5 Flash-Lite 作为 3.1 Flash-Lite 的后继模型。新项目建议从 gemini-3.5-flash-lite 开始；如果现有工作负载、提示词集或评测是基于 gemini-3.1-flash-lite 搭建的，就继续用它。两个模型在 RunAPI 上共用同一个 API key。"
        }
      },
      {
        "@type": "Question",
        "name": "Gemini 3.1 Flash-Lite 还能用多久？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Google 将 2027 年 5 月 7 日列为 gemini-3.1-flash-lite 的最早停用日期。预览版模型已于 2026 年 5 月停用，请使用稳定版模型 ID。"
        }
      },
      {
        "@type": "Question",
        "name": "能用 OpenAI SDK 调用 Gemini 3.1 Flash-Lite 吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "能。把 OpenAI SDK 指向 https://runapi.ai/v1，使用你的 RunAPI API key，发送 model 为 gemini-3.1-flash-lite 的 Chat Completions 请求。工具使用标准的 OpenAI tools 格式。"
        }
      },
      {
        "@type": "Question",
        "name": "在 RunAPI 上可以向 gemini-3.1-flash-lite 发送图片或音频吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "目前不可以。Google 的模型能读取图像、视频、音频和 PDF，但 RunAPI 对 gemini-3.1-flash-lite 只接受文本输入，包含媒体部分的请求会被拒绝。"
        }
      },
      {
        "@type": "Question",
        "name": "如何选择 gemini-3.1-flash-lite？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "传入 quickstart 中显示的模型 ID。"
        }
      },
      {
        "@type": "Question",
        "name": "该变体的限流？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "Key 级限流随使用层级伸缩。当前限制见定价页。"
        }
      },
      {
        "@type": "Question",
        "name": "能切到其它变体吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "可以——变体只是参数，改 model 字段即可。"
        }
      },
      {
        "@type": "Question",
        "name": "支持流式吗？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "模型支持流式时，RunAPI 端到端流式。"
        }
      },
      {
        "@type": "Question",
        "name": "质量问题在哪里报？",
        "acceptedAnswer": {
          "@type": "Answer",
          "text": "在公共 GitHub 仓库提 issue 或邮件联系 support。"
        }
      }
    ]
  }
]
```
