Google

Gemini 2.5 Flash-Lite

文字

Gemini 2.5 Flash-Lite;100 萬上下文,預設關閉思考;OpenAI 相容 Chat Completions

輸入 $0.10 / 百萬 tokens | 輸出 $0.40 / 百萬 tokens Gemini 2.5 Flash-Lite API reference →
模型健康狀態 數據不足
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/gemini-2.5-flash-lite:generateContent
POST /v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-2.5-flash-lite",
  "messages": [
    {
      "role": "user",
      "content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="gemini-2.5-flash-lite",
    messages=[{"role": "user", "content": "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "gemini-2.5-flash-lite",
  messages: [{ role: "user", content: "分析這個程式碼庫,並提出三項效能改進建議,附上改動前後的範例。" }]
});
https://runapi.ai 5 endpoints
OVERVIEW

Gemini 2.5 Flash-Lite 適合做甚麼

Gemini 2.5 Flash-Lite 是 Google Gemini 2.5 世代的 Flash-Lite 層級,針對大量的分類、資料擷取及其他低延遲工作。它於 2025 年 7 月 22 日正式推出(GA),知識截止時間為 2025 年 1 月。上下文視窗為 1,048,576 token,最多輸出 65,536 token。

思考預設關閉,Google 文件另有說明可選的思考模式,用於較難的提示。Google 在此模型上支援函數調用及結構化輸出。

Google 的模型接受文字、圖片、影片、音訊及 PDF 輸入。在 RunAPI 上,可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)傳送文字;RunAPI 對此模型只接受文字輸入。Google 建議新項目使用 Gemini 3.5 Flash-Lite,它在 RunAPI 上的模型 ID 為 gemini-3.5-flash-lite。

模型 ID
gemini-2.5-flash-lite
發布日期
2025 年 7 月 22 日(正式推出)
知識截止時間
2025 年 1 月
上下文視窗
1,048,576 token
最大輸出
65,536 token
思考
可選,預設關閉
RunAPI 上的端點
OpenAI Chat Completions,文字輸入
Playground

試用 Gemini 2.5 Flash-Lite

選擇任意模型,數秒內即可開始生成。

預計費用: 輸入 $0.10 / 百萬 tokens | 輸出 $0.40 / 百萬 tokens

登入以使用 RunAPI 生成內容。

登入以生成

登入後即可使用可用的語言模型開始生成。

規格

技術詳情

提供者 Google
模型 ID gemini-2.5-flash-lite
模態 文字
任務類型 Synchronous
API 端點 /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/gemini-2.5-flash-lite:generateContent
/v1beta/models/gemini-2.5-flash-lite:streamGenerateContent
計費單位 1K tokens
目錄狀態 可正常運作
使用方法

3 個步驟使用此模型

  1. 取得 API 金鑰

    免費註冊後,在控制台建立 gemini-2.5-flash-lite 的 API 金鑰。

  2. 發送請求

    向 /v1/chat/completions 發送 POST 請求,並傳入 gemini-2.5-flash-lite 模型 ID 和參數。

  3. 取得結果

    直接從端點讀取已完成的 gemini-2.5-flash-lite 回應。

此模型提供的功能

Endpoint 涵蓋範圍

開放 1 個公開 endpoint:chat_completion。

按用量計費

按 1K tokens 計量,無需訂閱。

Gemini 2.5 Flash-Lite 收費

API endpoint
價格
chat_completion
輸入: $0.10 / 百萬 tokens 輸出: $0.40 / 百萬 tokens
  • 快取讀取: $0.01 / 百萬 tokens
API 參考

端點規格

端點
POST /v1/chat/completions
模型 ID
gemini-2.5-flash-lite
工作類型
chat_completion

請求參數

此端點尚未發布請求參數。

使用場景

客戶支援

從私有知識庫回答客戶問題,減少工單數量。

文件分析

草擬合約摘要,並標示重點條款供律師審閱。

程式碼生成

在 CI 自動生成單元測試、程式碼審查同重構建議。

使用數據

開發者信賴之選
6
API 呼叫次數/天
100.0%
成功率
1.8s
平均生成時間

此模型目前尚無經驗證的客戶評價。

FAQ

關於 Gemini 2.5 Flash-Lite 的常見問題

應該用 Gemini 2.5 Flash-Lite 還是 Gemini 3.5 Flash-Lite?

Google 建議新項目使用 Gemini 3.5 Flash-Lite 或 Gemini 3.8 Flash。如現有的工作負載、提示集或評估是以 gemini-2.5-flash-lite 建立,便繼續使用它。兩個模型在 RunAPI 上共用同一組 API key。

Gemini 2.5 Flash-Lite 現在還可以用嗎?

可以。Google 尚未公布它的停用日期,不過 Google 自家 API 現時只向曾使用 2.5 模型的用戶開放。在 RunAPI 上,所有帳戶都可以使用 gemini-2.5-flash-lite。

可以用 OpenAI SDK 調用 Gemini 2.5 Flash-Lite 嗎?

可以。將 OpenAI SDK 指向 https://runapi.ai/v1,使用你的 RunAPI API key,傳送 model 為 gemini-2.5-flash-lite 的 Chat Completions 請求。工具採用標準的 OpenAI tools 格式。

Gemini 2.5 Flash-Lite 會先思考後作答嗎?

預設不會。Google 推出時已關閉思考,以配合大量、低延遲的工作,並在文件中提供可選的思考模式。

點樣選擇 gemini-2.5-flash-lite?

傳入 quickstart 顯示嘅 model ID。

這個 variant 的 rate limit 係多少?

每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。

之後可以切換 variant 嗎?

可以——variant 只係一個旗標。只要更改 model 參數就可以切換。

支援 streaming 嗎?

在可用 streaming 的情況下,RunAPI 會端到端串流。

我應該在邊度回報品質問題?

可以在公開 GitHub repo 開 issue,或者電郵支援團隊。

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們