Google

Gemini 3.1 Flash-Lite

文本

Gemini 3.1 Flash-Lite;100 万上下文,可调思考;通过 OpenAI 兼容 Chat Completions 发送文本请求

输入 $0.25 / 百万 tokens | 输出 $1.50 / 百万 tokens Gemini 3.1 Flash-Lite API 参考 →
模型健康状态 数据不足
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "分析这段代码库,给出三项性能优化建议,包含优化前后的对比示例。" }]
});
https://runapi.ai 5 endpoints
概览

Gemini 3.1 Flash-Lite 适合做什么

Gemini 3.1 Flash-Lite 是 Google Gemini 3 系列中低延迟、低成本的模型。Google 将它用于大批量的简单任务,例如翻译、分类与实体抽取、文档分拣,以及在模型之间路由请求。稳定版 gemini-3.1-flash-lite 于 2026 年 5 月 7 日正式发布(GA)。上下文窗口为 1,048,576 token,最多输出 65,536 token。

思考可调:Google 提供从 minimal 到 high 共四档思考级别,思考 token 计入输出。Google 在该模型上支持函数调用和结构化输出。

Google 的模型接受文本、图像、视频、音频和 PDF 输入。在 RunAPI 上,gemini-3.1-flash-lite 只接受文本输入。可通过 OpenAI 兼容的 Chat Completions 端点(/v1/chat/completions)、OpenAI Responses、Anthropic Messages 或 Gemini generateContent 发送请求。Google 指定 Gemini 3.5 Flash-Lite 为后继模型,它在 RunAPI 上的模型 ID 为 gemini-3.5-flash-lite。

模型 ID
gemini-3.1-flash-lite
发布日期
2026 年 5 月 7 日(正式发布)
上下文窗口
1,048,576 token
最大输出
65,536 token
思考
可调,从 minimal 到 high
最早停用日期(Google)
2027 年 5 月 7 日
RunAPI 上的端点
OpenAI Chat Completions,文本输入
模型体验

体验 Gemini 3.1 Flash-Lite

选择任意模型,几秒内开始生成。

预计: 输入 $0.25 / 百万 tokens | 输出 $1.50 / 百万 tokens

登录后即可使用 RunAPI 生成。

登录后生成

登录后即可使用可用语言模型开始生成。

规格

技术细节

提供商 Google
模型 ID gemini-3.1-flash-lite
模态 文本
任务类型 Synchronous
API 端点 /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
计费单位 1K tokens
目录状态 运行中
工作原理

3 步使用此模型

  1. 获取 API 密钥

    免费注册后,在控制台创建用于 gemini-3.1-flash-lite 的 API 密钥。

  2. 发送请求

    向 /v1/chat/completions 发送 POST 请求,并传入 gemini-3.1-flash-lite 模型 ID 和参数。

  3. 获取结果

    直接从端点读取已完成的 gemini-3.1-flash-lite 响应。

该模型的核心能力

Endpoint 覆盖

提供 1 个公开 endpoint:chat_completion。

按量计费

按 1K tokens 计量,无需订阅。

Gemini 3.1 Flash-Lite 定价

端点
价格
chat_completion
输入: $0.25 / 百万 tokens 输出: $1.50 / 百万 tokens
  • 缓存读取: $0.03 / 百万 tokens
API 参考

端点规格

端点
POST /v1/chat/completions
模型 ID
gemini-3.1-flash-lite
任务类型
chat_completion

请求参数

此端点尚未发布请求参数。

应用场景

客户支持

基于私有知识库回答客户问题,减少工单量。

文档分析

起草合同摘要并标记关键条款供律师审阅。

代码生成

在 CI 中自动生成单元测试、代码审查和重构建议。

使用指标

深受开发者信赖
6
API 调用量 / 天
100.0%
成功率
1.9s
平均生成时间

该模型暂无已验证的用户反馈。

常见问题

Gemini 3.1 Flash-Lite 常见问题

应该用 Gemini 3.1 Flash-Lite 还是 Gemini 3.5 Flash-Lite?

Google 指定 Gemini 3.5 Flash-Lite 作为 3.1 Flash-Lite 的后继模型。新项目建议从 gemini-3.5-flash-lite 开始;如果现有工作负载、提示词集或评测是基于 gemini-3.1-flash-lite 搭建的,就继续用它。两个模型在 RunAPI 上共用同一个 API key。

Gemini 3.1 Flash-Lite 还能用多久?

Google 将 2027 年 5 月 7 日列为 gemini-3.1-flash-lite 的最早停用日期。预览版模型已于 2026 年 5 月停用,请使用稳定版模型 ID。

能用 OpenAI SDK 调用 Gemini 3.1 Flash-Lite 吗?

能。把 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,发送 model 为 gemini-3.1-flash-lite 的 Chat Completions 请求。工具使用标准的 OpenAI tools 格式。

在 RunAPI 上可以向 gemini-3.1-flash-lite 发送图片或音频吗?

目前不可以。Google 的模型能读取图像、视频、音频和 PDF,但 RunAPI 对 gemini-3.1-flash-lite 只接受文本输入,包含媒体部分的请求会被拒绝。

如何选择 gemini-3.1-flash-lite?

传入 quickstart 中显示的模型 ID。

该变体的限流?

Key 级限流随使用层级伸缩。当前限制见定价页。

能切到其它变体吗?

可以——变体只是参数,改 model 字段即可。

支持流式吗?

模型支持流式时,RunAPI 端到端流式。

质量问题在哪里报?

在公共 GitHub 仓库提 issue 或邮件联系 support。

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们