Google

Gemini 3.1 Flash-Lite

文字

Gemini 3.1 Flash-Lite;100 萬上下文,可調整思考;透過 OpenAI 相容 Chat Completions 傳送文字請求

輸入 $0.25 / 百萬 tokens | 輸出 $1.50 / 百萬 tokens Gemini 3.1 Flash-Lite API reference →
模型健康狀態 資料不足
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-3.1-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-3.1-flash-lite",
    messages=[{"role": "user", "content": "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-3.1-flash-lite",
  messages: [{ role: "user", content: "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。" }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Gemini 3.1 Flash-Lite 適合用來做什麼

Gemini 3.1 Flash-Lite 是 Google Gemini 3 系列中低延遲、低成本的模型。Google 將它用於大量的簡單工作,例如翻譯、分類與實體擷取、文件分流,以及在模型之間分派請求。穩定版 gemini-3.1-flash-lite 於 2026 年 5 月 7 日正式推出(GA)。上下文視窗為 1,048,576 token,最多輸出 65,536 token。

思考可以調整:Google 提供從 minimal 到 high 共四個思考等級,思考 token 會計入輸出。Google 在這個模型上支援函式呼叫與結構化輸出。

Google 的模型接受文字、圖片、影片、音訊與 PDF 輸入。在 RunAPI 上,gemini-3.1-flash-lite 只接受文字輸入。可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)、OpenAI Responses、Anthropic Messages 或 Gemini generateContent 傳送請求。Google 指定 Gemini 3.5 Flash-Lite 為後繼模型,它在 RunAPI 上的模型 ID 為 gemini-3.5-flash-lite。

模型 ID
gemini-3.1-flash-lite
發布日期
2026 年 5 月 7 日(正式推出)
上下文視窗
1,048,576 token
最大輸出
65,536 token
思考
可調整,從 minimal 到 high
最早停用日期(Google)
2027 年 5 月 7 日
RunAPI 上的端點
OpenAI Chat Completions,文字輸入
Playground

試用 Gemini 3.1 Flash-Lite

選擇任一模型,幾秒內即可開始生成。

預估: 輸入 $0.25 / 百萬 tokens | 輸出 $1.50 / 百萬 tokens

請登入以使用 RunAPI 生成。

請登入以生成

登入後,即可使用您可用的語言模型開始生成。

規格

技術細節

提供者 Google
模型 ID gemini-3.1-flash-lite
模態 文字
任務類型 Synchronous
API 端點 /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-3.1-flash-lite:generateContent
/v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
計費單位 1K tokens
目錄狀態 可直接上線
使用方式

3 個步驟使用此模型

  1. 取得 API 金鑰

    免費註冊後,從控制台建立 gemini-3.1-flash-lite 的 API 金鑰。

  2. 傳送請求

    向 /v1/chat/completions 傳送 POST 請求,並傳入 gemini-3.1-flash-lite 模型 ID 與參數。

  3. 取得結果

    直接從端點讀取已完成的 gemini-3.1-flash-lite 回應。

此模型提供的功能

Endpoint 覆蓋範圍

公開 1 個公共 endpoint:chat_completion。

用量計費

依 1K tokens 計量,無需訂閱。

Gemini 3.1 Flash-Lite 價格

API endpoint
價格
chat_completion
輸入: $0.25 / 百萬 tokens 輸出: $1.50 / 百萬 tokens
  • 快取讀取: $0.03 / 百萬 tokens
API 參考

端點規格

端點
POST /v1/chat/completions
模型 ID
gemini-3.1-flash-lite
工作類型
chat_completion

請求參數

此端點尚未發布請求參數。

使用情境

客服支援

從私有知識庫回答顧客問題,減少工單量。

文件分析

起草合約摘要,並標示關鍵條款供律師審閱。

程式碼生成

在 CI 中自動產生單元測試、程式碼審查與重構建議。

使用指標

深受開發者信賴
6
API 呼叫次數 / 天
100.0%
成功率
1.9s
平均生成時間

此模型目前尚無已驗證的客戶回饋。

FAQ

關於 Gemini 3.1 Flash-Lite 的常見問題

該用 Gemini 3.1 Flash-Lite 還是 Gemini 3.5 Flash-Lite?

Google 指定 Gemini 3.5 Flash-Lite 為 3.1 Flash-Lite 的後繼模型。新專案建議從 gemini-3.5-flash-lite 開始;如果現有的工作負載、提示集或評估是以 gemini-3.1-flash-lite 建立,就繼續使用它。兩個模型在 RunAPI 上共用同一組 API key。

Gemini 3.1 Flash-Lite 還能用多久?

Google 將 2027 年 5 月 7 日列為 gemini-3.1-flash-lite 的最早停用日期。預覽版模型已於 2026 年 5 月停用,請使用穩定版模型 ID。

能用 OpenAI SDK 呼叫 Gemini 3.1 Flash-Lite 嗎?

可以。將 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,傳送 model 為 gemini-3.1-flash-lite 的 Chat Completions 請求。工具採用標準的 OpenAI tools 格式。

在 RunAPI 上可以對 gemini-3.1-flash-lite 傳送圖片或音訊嗎?

目前不行。Google 的模型能讀取圖片、影片、音訊與 PDF,但 RunAPI 對 gemini-3.1-flash-lite 只接受文字輸入,包含媒體部分的請求會被拒絕。

如何選擇 gemini-3.1-flash-lite?

傳入 quickstart 顯示的 model ID。

這個 variant 的速率限制是多少?

每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。

之後可以切換 variant 嗎?

可以——variant 只是旗標。只要變更 model 參數即可切換。

它支援串流嗎?

只要支援串流,RunAPI 就會端到端串流。

我該在哪裡回報品質問題?

請在公開 GitHub repo 提交 issue,或寄信給支援。

正在與團隊一起打造?

我們可以協助企業接入、整合與技術問題。

聯絡我們