LLM API 定價

2026 年 Gemini API 定價

Google 對 Gemini 2.5 Pro 收取每百萬 tokens $1.25–$10,Flash 則低得多。免費層級在你達到上限前提供約每分鐘 20 次請求。RunAPI 以官方價格一半提供每個 Gemini 模型 — 直接將你的 key 貼到任何 OpenAI-compatible client 即可。

更新於 June 18, 2026 RunAPI Editorial
一覽

Gemini API 目前的費用是多少?

Google 為兩個主要層級公布按 token 計價:Flash 用於快速、低成本任務,Pro 用於最高能力。亦設有帶每日請求限制的免費層級 — 適合測試,但 AI agents 和編程工具可以很快用完。以下所有價格均以每百萬 tokens 計算,這是 Google 使用的計費單位。

最低價選項

透過 RunAPI,Gemini 2.5 Flash 輸入 $0.08/M,輸出 $0.30/M。官方費率為 $0.15/$0.60。

最高能力

透過 RunAPI,Gemini 2.5 Pro 輸入 $0.63/M,輸出 $5.00/M。官方費率為 $1.25/$10。

免費方案

Google 的免費層級在 Flash 上提供約每分鐘 20 次請求和每日 500 次請求 — 足夠製作原型,但使用 AI agent 可能幾小時內就會用盡。

最便宜的旗艦

Gemini 2.5 Pro 在輸入價格上低於 Claude Sonnet 和 GPT-5.4,使其成為三大旗艦中最便宜的選擇。

按模型逐一細分

每個 Gemini 模型每百萬 token 的費用是多少?

下表顯示 Google 官方定價和 RunAPI 定價。RunAPI 對所有 Gemini 模型一律提供 50% 折扣。無需批量承諾,無需訂閱。

模型 官方輸入 /M 官方輸出 /M RunAPI 輸入 /M RunAPI 輸出 /M 上下文視窗
Gemini 2.5 Pro $1.25 $10.00 $0.63 $5.00 1M
Gemini 2.5 Flash $0.15 $0.60 $0.08 $0.30 1M
Gemini 2.5 Flash-Lite $0.10 $0.40 $0.05 $0.20 1M
免費方案

Google 的 Gemini 免費方案如何運作?

Google 提供免費層級,讓你在付費前先製作原型。免費層級在 Gemini 2.5 Flash 上將請求限制在約每分鐘 20 次、每日 500 次。當你達到上限時,你會收到錯誤 — 系統不會自動向你收費。免費層級只在指定國家提供;如果你所在地區無法使用免費端點,下一步就是使用付費 API 或 RunAPI。

每日請求上限

透過免費層級,在 Gemini 2.5 Flash 上每日最多可發出 500 次請求。這足夠用於原型製作和低流量個人項目,但 AI agents 和編程工具可在幾小時內用盡。

速率限制

免費層級將請求限制在約每分鐘 20 次。任何突發流量 — 例如運行 AI agent — 都會很快達到此限制並開始返回錯誤。

數據使用條款

免費方案的輸入可能用於改進 Google 的產品。付費方案和 RunAPI 的流量不用於訓練,這對於敏感數據很重要。

何時升級

一旦你需要穩定的吞吐量、更高的速率限制或更強的數據處理保障,就切換到付費方案或 RunAPI。RunAPI 以官方付費費率的 50% 計費,無每日上限。

供應商比較

Gemini 比 Claude 和 GPT 便宜嗎?

開發者常將 Gemini 與 Claude Sonnet 和 GPT-5.4 進行比較。以下是旗艦模型透過 RunAPI 在每百萬 token 費用上的對比。

供應商 旗艦模型 輸入 /M 輸出 /M RunAPI 費率
Google Gemini 2.5 Pro $1.25 $10.00 $0.63 / $5.00
OpenAI GPT-5.4 $2.50 $15.00 $1.25 / $7.50
Anthropic Claude Sonnet 4.6 $6.00 $30.00 $3.00 / $15.00

RunAPI 對以上所有供應商均提供 50% 折扣。Gemini 2.5 Pro 是輸入價格最低的旗艦模型。價格已於 2026 年 6 月核實。

真實場景費用

Gemini API 在真實工作負載下的實際費用是多少?

在與實際任務掛鉤之前,token 費用看起來很抽象。以下是五種常見開發者工作負載在兩個使用量級別下,透過 RunAPI 計費的每月估計費用。

工作負載 模型 輕度使用(每天約 50 個任務) 重度使用(每天約 200 個任務) 相比官方的每月節省
長上下文文件分析 Gemini 2.5 Pro $18/月 $72/月 $18–$72
高量分類 Gemini 2.5 Flash $3/月 $12/月 $3–$12
RAG 驅動的文件聊天機器人 Gemini 2.5 Flash $5/月 $20/月 $5–$20
內容生成流水線 Gemini 2.5 Pro $15/月 $60/月 $15–$60
多 Agent 協調器 Gemini 2.5 Pro $60/月 $240/月 $60–$240
快速開始

如何透過 RunAPI 使用 Gemini API

1

創建 RunAPI 帳戶

在 runapi.ai 註冊。免費方案無需信用卡。

2

複製你的 API key

前往 Dashboard → API Keys。創建一個密鑰並保存——你將以此作為 OpenAI API key。

3

將你的 SDK 指向 RunAPI

將 base URL 設定為 https://runapi.ai/v1,並使用你的 RunAPI API key。任何兼容 OpenAI 的客戶端均可使用——Python、Node.js、Go、Ruby 或 curl。

4

開始發送請求

在 model 參數中使用 gemini-2.5-pro、gemini-2.5-flash 或任何 Gemini 模型 ID。RunAPI 以官方費率的 50% 處理路由和計費。

常見問題

Gemini API 定價 FAQ

Gemini API 的費用是多少?

Google 對 Gemini 2.5 Pro 的官方定價為輸入 $1.25/M,輸出 $10/M。Gemini 2.5 Flash 為輸入 $0.15/M,輸出 $0.60/M。透過 RunAPI,每個 Gemini 模型的費率為一半,無需訂閱或批量承諾。你只需為每次請求使用的 token 付費。

Gemini 比 Claude 和 GPT 便宜嗎?

就輸入價格而言,是的。Gemini 2.5 Pro 的輸入 $1.25/M 低於 GPT-5.4($2.50)和 Claude Sonnet($6),使其成為三大旗艦中最便宜的官方費率。RunAPI 將三者均減半,因此差距依然存在。

Free tier 有甚麼 rate limits,撞到限制時會怎樣?

Free tier 在 Gemini 2.5 Flash 上限制約每分鐘 20 requests、每日 500 requests。當你撞到 limit,requests 會返回 error——不會自動向你收費。Free-tier inputs 可能會用於改善 Google 的產品,所以避免使用敏感資料。一旦你需要穩定 throughput,就轉到 paid。

為什麼 RunAPI 比官方 API 便宜 50%?

RunAPI 與模型供應商協商批量定價,並將節省的費用傳遞給開發者。質量沒有任何差異——相同的模型,相同的兼容 OpenAI 的 API,相同的輸出。你只需更改 base URL 和密鑰,現有的客戶端代碼無需修改即可繼續工作。

我可以將 Gemini 與 OpenAI SDK 一起使用嗎?

可以。RunAPI 兼容 OpenAI。將任何 OpenAI 客戶端指向 runapi.ai/v1,並使用 Gemini 模型 ID,如 gemini-2.5-pro。現有的 OpenAI SDK 代碼除了 base URL 和密鑰外無需任何修改。

Gemini 為什麼適合長上下文任務?

Gemini 2.5 Pro 和 Flash 均提供 1M token 的上下文視窗,比大多數 Claude 和 GPT 模型更大。結合低廉的輸入定價,這使 Gemini 在分析長文件、大型代碼庫或多個文件時具有成本效益。

我不斷用盡免費層級限額。我有咩選擇?

RunAPI 為你提供一個 API key,可跨 Gemini、Claude 同 GPT 使用 — 無需設定 Google Cloud 專案,亦無需管理帳單帳戶。如果你已經用盡免費層級限額,或者發現所在地區連一個免費 API key 都用不到,RunAPI 的付費存取服務全球可用,收費為官方價格的 50%。

計費方式是怎樣的?

按使用量付費。你為帳戶充值後,每次 API 呼叫都會以官方費率一半的費用扣除 token 費用。無需訂閱、無發票、無合約。你可以從 RunAPI Dashboard 按密鑰監控消費,並在餘額不足前設置提醒。

相關內容

繼續探索

以半價開始使用 Gemini。

創建免費 RunAPI 帳戶,獲取你的 API key,以官方 Google 定價的 50% 開始呼叫 Gemini 2.5 Pro 或 Flash——三大旗艦中最便宜的選擇。