Endpoint 涵蓋範圍
開放 1 個公開 endpoint:chat_completion。
Gemini 3.1 Flash-Lite;100 萬上下文,可調思考;透過 OpenAI 相容 Chat Completions 傳送文字請求
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-3.1-flash-lite:generateContent
POST /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite",
"messages": [
{
"role": "user",
"content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-3.1-flash-lite",
messages=[{"role": "user", "content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-3.1-flash-lite",
messages: [{ role: "user", content: "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。" }]
});
11 個版本可用
Gemini 3.1 Flash-Lite 是 Google Gemini 3 系列中低延遲、低成本的模型。Google 將它用於大量的簡單工作,例如翻譯、分類及實體擷取、文件分流,以及在模型之間分派請求。穩定版 gemini-3.1-flash-lite 於 2026 年 5 月 7 日正式推出(GA)。上下文視窗為 1,048,576 token,最多輸出 65,536 token。
思考可調:Google 提供由 minimal 至 high 共四個思考級別,思考 token 計入輸出。Google 在此模型上支援函數調用及結構化輸出。
Google 的模型接受文字、圖片、影片、音訊及 PDF 輸入。在 RunAPI 上,gemini-3.1-flash-lite 只接受文字輸入。可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)、OpenAI Responses、Anthropic Messages 或 Gemini generateContent 傳送請求。Google 指定 Gemini 3.5 Flash-Lite 為後續模型,它在 RunAPI 上的模型 ID 為 gemini-3.5-flash-lite。
選擇任意模型,數秒內即可開始生成。
| 提供者 | |
| 模型 ID | gemini-3.1-flash-lite |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-3.1-flash-lite:generateContent | |
| /v1beta/models/gemini-3.1-flash-lite:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 可正常運作 |
免費註冊後,在控制台建立 gemini-3.1-flash-lite 的 API 金鑰。
向 /v1/chat/completions 發送 POST 請求,並傳入 gemini-3.1-flash-lite 模型 ID 和參數。
直接從端點讀取已完成的 gemini-3.1-flash-lite 回應。
開放 1 個公開 endpoint:chat_completion。
按 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答客戶問題,減少工單數量。
草擬合約摘要,並標示重點條款供律師審閱。
在 CI 自動生成單元測試、程式碼審查同重構建議。
此模型目前尚無經驗證的客戶評價。
Google 指定 Gemini 3.5 Flash-Lite 為 3.1 Flash-Lite 的後續模型。新項目建議由 gemini-3.5-flash-lite 開始;如現有的工作負載、提示集或評估是以 gemini-3.1-flash-lite 建立,便繼續使用它。兩個模型在 RunAPI 上共用同一組 API key。
Google 將 2027 年 5 月 7 日列為 gemini-3.1-flash-lite 的最早停用日期。預覽版模型已於 2026 年 5 月停用,請使用穩定版模型 ID。
可以。將 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,傳送 model 為 gemini-3.1-flash-lite 的 Chat Completions 請求。工具採用標準的 OpenAI tools 格式。
暫時不可以。Google 的模型能讀取圖片、影片、音訊及 PDF,但 RunAPI 對 gemini-3.1-flash-lite 只接受文字輸入,包含媒體部分的請求會被拒絕。
傳入 quickstart 顯示嘅 model ID。
每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。
可以——variant 只係一個旗標。只要更改 model 參數就可以切換。
在可用 streaming 的情況下,RunAPI 會端到端串流。
可以在公開 GitHub repo 開 issue,或者電郵支援團隊。