Endpoint 覆蓋範圍
公開 1 個公共 endpoint:chat_completion。
Gemini 2.5 Flash-Lite;100 萬上下文,預設關閉思考;OpenAI 相容 Chat Completions
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-2.5-flash-lite",
"messages": [
{
"role": "user",
"content": "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="gemini-2.5-flash-lite",
messages=[{"role": "user", "content": "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "gemini-2.5-flash-lite",
messages: [{ role: "user", content: "分析這個程式碼庫,提出三項效能改善建議,並附上修改前後的範例。" }]
});
11 個版本可用
Gemini 2.5 Flash-Lite 是 Google Gemini 2.5 世代的 Flash-Lite 層級,鎖定大量的分類、資訊擷取與其他低延遲工作。它於 2025 年 7 月 22 日正式推出(GA),知識截止時間為 2025 年 1 月。上下文視窗為 1,048,576 token,最多輸出 65,536 token。
思考預設關閉,Google 文件另有說明可選用的思考模式,用於較困難的提示。Google 在這個模型上支援函式呼叫與結構化輸出。
Google 的模型接受文字、圖片、影片、音訊與 PDF 輸入。在 RunAPI 上,可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)傳送文字;RunAPI 對此模型只接受文字輸入。Google 建議新專案使用 Gemini 3.5 Flash-Lite,它在 RunAPI 上的模型 ID 為 gemini-3.5-flash-lite。
選擇任一模型,幾秒內即可開始生成。
| 提供者 | |
| 模型 ID | gemini-2.5-flash-lite |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/gemini-2.5-flash-lite:generateContent | |
| /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 可直接上線 |
免費註冊後,從控制台建立 gemini-2.5-flash-lite 的 API 金鑰。
向 /v1/chat/completions 傳送 POST 請求,並傳入 gemini-2.5-flash-lite 模型 ID 與參數。
直接從端點讀取已完成的 gemini-2.5-flash-lite 回應。
公開 1 個公共 endpoint:chat_completion。
依 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答顧客問題,減少工單量。
起草合約摘要,並標示關鍵條款供律師審閱。
在 CI 中自動產生單元測試、程式碼審查與重構建議。
此模型目前尚無已驗證的客戶回饋。
Google 建議新專案使用 Gemini 3.5 Flash-Lite 或 Gemini 3.8 Flash。如果現有的工作負載、提示集或評估是以 gemini-2.5-flash-lite 建立,就繼續使用它。兩個模型在 RunAPI 上共用同一組 API key。
可以。Google 尚未公布它的停用日期,不過 Google 自家 API 目前只開放給曾經使用過 2.5 模型的使用者。在 RunAPI 上,所有帳號都可以使用 gemini-2.5-flash-lite。
可以。將 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,傳送 model 為 gemini-2.5-flash-lite 的 Chat Completions 請求。工具採用標準的 OpenAI tools 格式。
預設不會。Google 推出時就關閉了思考,以因應大量、低延遲的工作,同時在文件中提供可選用的思考模式。
傳入 quickstart 顯示的 model ID。
每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。
可以——variant 只是旗標。只要變更 model 參數即可切換。
只要支援串流,RunAPI 就會端到端串流。
請在公開 GitHub repo 提交 issue,或寄信給支援。