每日請求上限
透過免費層級,在 Gemini 2.5 Flash 上每日最多可發出 500 次請求。這足夠用於原型製作和低流量個人項目,但 AI agents 和編程工具可在幾小時內用盡。
Google 對 Gemini 2.5 Pro 收取每百萬 tokens $1.25–$10,Flash 則低得多。免費層級在你達到上限前提供約每分鐘 20 次請求。RunAPI 以官方價格一半提供每個 Gemini 模型 — 直接將你的 key 貼到任何 OpenAI-compatible client 即可。
Google 為兩個主要層級公布按 token 計價:Flash 用於快速、低成本任務,Pro 用於最高能力。亦設有帶每日請求限制的免費層級 — 適合測試,但 AI agents 和編程工具可以很快用完。以下所有價格均以每百萬 tokens 計算,這是 Google 使用的計費單位。
透過 RunAPI,Gemini 2.5 Flash 輸入 $0.08/M,輸出 $0.30/M。官方費率為 $0.15/$0.60。
透過 RunAPI,Gemini 2.5 Pro 輸入 $0.63/M,輸出 $5.00/M。官方費率為 $1.25/$10。
Google 的免費層級在 Flash 上提供約每分鐘 20 次請求和每日 500 次請求 — 足夠製作原型,但使用 AI agent 可能幾小時內就會用盡。
Gemini 2.5 Pro 在輸入價格上低於 Claude Sonnet 和 GPT-5.4,使其成為三大旗艦中最便宜的選擇。
下表顯示 Google 官方定價和 RunAPI 定價。RunAPI 對所有 Gemini 模型一律提供 50% 折扣。無需批量承諾,無需訂閱。
| 模型 | 官方輸入 /M | 官方輸出 /M | RunAPI 輸入 /M | RunAPI 輸出 /M | 上下文視窗 |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |
Google 提供免費層級,讓你在付費前先製作原型。免費層級在 Gemini 2.5 Flash 上將請求限制在約每分鐘 20 次、每日 500 次。當你達到上限時,你會收到錯誤 — 系統不會自動向你收費。免費層級只在指定國家提供;如果你所在地區無法使用免費端點,下一步就是使用付費 API 或 RunAPI。
透過免費層級,在 Gemini 2.5 Flash 上每日最多可發出 500 次請求。這足夠用於原型製作和低流量個人項目,但 AI agents 和編程工具可在幾小時內用盡。
免費層級將請求限制在約每分鐘 20 次。任何突發流量 — 例如運行 AI agent — 都會很快達到此限制並開始返回錯誤。
免費方案的輸入可能用於改進 Google 的產品。付費方案和 RunAPI 的流量不用於訓練,這對於敏感數據很重要。
一旦你需要穩定的吞吐量、更高的速率限制或更強的數據處理保障,就切換到付費方案或 RunAPI。RunAPI 以官方付費費率的 50% 計費,無每日上限。
開發者常將 Gemini 與 Claude Sonnet 和 GPT-5.4 進行比較。以下是旗艦模型透過 RunAPI 在每百萬 token 費用上的對比。
| 供應商 | 旗艦模型 | 輸入 /M | 輸出 /M | RunAPI 費率 |
|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 | |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |
RunAPI 對以上所有供應商均提供 50% 折扣。Gemini 2.5 Pro 是輸入價格最低的旗艦模型。價格已於 2026 年 6 月核實。
在與實際任務掛鉤之前,token 費用看起來很抽象。以下是五種常見開發者工作負載在兩個使用量級別下,透過 RunAPI 計費的每月估計費用。
| 工作負載 | 模型 | 輕度使用(每天約 50 個任務) | 重度使用(每天約 200 個任務) | 相比官方的每月節省 |
|---|---|---|---|---|
| 長上下文文件分析 | Gemini 2.5 Pro | $18/月 | $72/月 | $18–$72 |
| 高量分類 | Gemini 2.5 Flash | $3/月 | $12/月 | $3–$12 |
| RAG 驅動的文件聊天機器人 | Gemini 2.5 Flash | $5/月 | $20/月 | $5–$20 |
| 內容生成流水線 | Gemini 2.5 Pro | $15/月 | $60/月 | $15–$60 |
| 多 Agent 協調器 | Gemini 2.5 Pro | $60/月 | $240/月 | $60–$240 |
在 runapi.ai 註冊。免費方案無需信用卡。
前往 Dashboard → API Keys。創建一個密鑰並保存——你將以此作為 OpenAI API key。
將 base URL 設定為 https://runapi.ai/v1,並使用你的 RunAPI API key。任何兼容 OpenAI 的客戶端均可使用——Python、Node.js、Go、Ruby 或 curl。
在 model 參數中使用 gemini-2.5-pro、gemini-2.5-flash 或任何 Gemini 模型 ID。RunAPI 以官方費率的 50% 處理路由和計費。
Google 對 Gemini 2.5 Pro 的官方定價為輸入 $1.25/M,輸出 $10/M。Gemini 2.5 Flash 為輸入 $0.15/M,輸出 $0.60/M。透過 RunAPI,每個 Gemini 模型的費率為一半,無需訂閱或批量承諾。你只需為每次請求使用的 token 付費。
就輸入價格而言,是的。Gemini 2.5 Pro 的輸入 $1.25/M 低於 GPT-5.4($2.50)和 Claude Sonnet($6),使其成為三大旗艦中最便宜的官方費率。RunAPI 將三者均減半,因此差距依然存在。
Free tier 在 Gemini 2.5 Flash 上限制約每分鐘 20 requests、每日 500 requests。當你撞到 limit,requests 會返回 error——不會自動向你收費。Free-tier inputs 可能會用於改善 Google 的產品,所以避免使用敏感資料。一旦你需要穩定 throughput,就轉到 paid。
RunAPI 與模型供應商協商批量定價,並將節省的費用傳遞給開發者。質量沒有任何差異——相同的模型,相同的兼容 OpenAI 的 API,相同的輸出。你只需更改 base URL 和密鑰,現有的客戶端代碼無需修改即可繼續工作。
可以。RunAPI 兼容 OpenAI。將任何 OpenAI 客戶端指向 runapi.ai/v1,並使用 Gemini 模型 ID,如 gemini-2.5-pro。現有的 OpenAI SDK 代碼除了 base URL 和密鑰外無需任何修改。
Gemini 2.5 Pro 和 Flash 均提供 1M token 的上下文視窗,比大多數 Claude 和 GPT 模型更大。結合低廉的輸入定價,這使 Gemini 在分析長文件、大型代碼庫或多個文件時具有成本效益。
RunAPI 為你提供一個 API key,可跨 Gemini、Claude 同 GPT 使用 — 無需設定 Google Cloud 專案,亦無需管理帳單帳戶。如果你已經用盡免費層級限額,或者發現所在地區連一個免費 API key 都用不到,RunAPI 的付費存取服務全球可用,收費為官方價格的 50%。
按使用量付費。你為帳戶充值後,每次 API 呼叫都會以官方費率一半的費用扣除 token 費用。無需訂閱、無發票、無合約。你可以從 RunAPI Dashboard 按密鑰監控消費,並在餘額不足前設置提醒。
創建免費 RunAPI 帳戶,獲取你的 API key,以官方 Google 定價的 50% 開始呼叫 Gemini 2.5 Pro 或 Flash——三大旗艦中最便宜的選擇。