Endpoint 涵蓋範圍
開放 1 個公開 endpoint:chat_completion。
Gemini 2.5 Flash-Lite;100 萬上下文,預設關閉思考;OpenAI 相容 Chat Completions
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash-lite",
"messages": [
{
"role": "user",
"content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-2.5-flash-lite",
messages=[{"role": "user", "content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-2.5-flash-lite",
messages: [{ role: "user", content: "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。" }]
});
11 個版本可用
Gemini 2.5 Flash-Lite 是 Google Gemini 2.5 世代的 Flash-Lite 層級,針對大量的分類、資料擷取及其他低延遲工作。它於 2025 年 7 月 22 日正式推出(GA),知識截止時間為 2025 年 1 月。上下文視窗為 1,048,576 token,最多輸出 65,536 token。
思考預設關閉,Google 文件另有說明可選的思考模式,用於較難的提示。Google 在此模型上支援函數調用及結構化輸出。
Google 的模型接受文字、圖片、影片、音訊及 PDF 輸入。在 RunAPI 上,可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)傳送文字;RunAPI 對此模型只接受文字輸入。Google 建議新項目使用 Gemini 3.5 Flash-Lite,它在 RunAPI 上的模型 ID 為 gemini-3.5-flash-lite。
選擇任意模型,數秒內即可開始生成。
| 提供者 | |
| 模型 ID | gemini-2.5-flash-lite |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-2.5-flash-lite:generateContent | |
| /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 可正常運作 |
免費註冊後,在控制台建立 gemini-2.5-flash-lite 的 API 金鑰。
向 /v1/chat/completions 發送 POST 請求,並傳入 gemini-2.5-flash-lite 模型 ID 和參數。
直接從端點讀取已完成的 gemini-2.5-flash-lite 回應。
開放 1 個公開 endpoint:chat_completion。
按 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答客戶問題,減少工單數量。
草擬合約摘要,並標示重點條款供律師審閱。
在 CI 自動生成單元測試、程式碼審查同重構建議。
此模型目前尚無經驗證的客戶評價。
Google 建議新項目使用 Gemini 3.5 Flash-Lite 或 Gemini 3.8 Flash。如現有的工作負載、提示集或評估是以 gemini-2.5-flash-lite 建立,便繼續使用它。兩個模型在 RunAPI 上共用同一組 API key。
可以。Google 尚未公布它的停用日期,不過 Google 自家 API 現時只向曾使用 2.5 模型的用戶開放。在 RunAPI 上,所有帳戶都可以使用 gemini-2.5-flash-lite。
可以。將 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,傳送 model 為 gemini-2.5-flash-lite 的 Chat Completions 請求。工具採用標準的 OpenAI tools 格式。
預設不會。Google 推出時已關閉思考,以配合大量、低延遲的工作,並在文件中提供可選的思考模式。
傳入 quickstart 顯示嘅 model ID。
每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。
可以——variant 只係一個旗標。只要更改 model 參數就可以切換。
在可用 streaming 的情況下,RunAPI 會端到端串流。
可以在公開 GitHub repo 開 issue,或者電郵支援團隊。