# 2026 年 Gemini API 定价

Google 对 Gemini 2.5 Pro 收取每百万 token $1.25–$10，Flash 则更便宜。免费套餐每分钟约 20 次请求后触及上限。RunAPI 以官方价格一半镜像所有 Gemini 模型——直接粘贴到任何兼容 OpenAI 的客户端即可使用。

*Updated June 18, 2026 · RunAPI 编辑团队*

## Gemini API 现在的价格是多少？

Google 为两个主要档位发布了按 token 定价：Flash 用于快速、低成本任务，Pro 用于最高能力。还有带每日请求限制的免费套餐——适合测试，但 AI Agent 和编码工具可能很快耗尽。以下所有价格均为每百万 token，这是 Google 使用的计费单位。

- **最低价选项**: 通过 RunAPI，Gemini 2.5 Flash 输入 $0.08/M，输出 $0.30/M。官方价格为 $0.15/$0.60。
- **最高能力**: 通过 RunAPI，Gemini 2.5 Pro 输入 $0.63/M，输出 $5.00/M。官方价格为 $1.25/$10。
- **免费套餐**: Google 的免费套餐每分钟约 20 次请求，Flash 每天 500 次——足以用于原型开发，但 AI Agent 可能在几小时内耗尽。
- **最便宜主力模型**: Gemini 2.5 Pro 的输入价格低于 Claude Sonnet 和 GPT-5.4，是三大服务商中最便宜的主力模型。

## 每个 Gemini 模型每百万 token 的费用是多少？

下表展示 Google 官方定价与 RunAPI 定价对比。RunAPI 对所有 Gemini 模型统一打 5 折。无量级承诺，无订阅。

| 模型 | 官方输入 /M | 官方输出 /M | RunAPI 输入 /M | RunAPI 输出 /M | 上下文窗口 |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |

## Google 的 Gemini 免费套餐如何运作？

Google 提供免费套餐供你在付费前进行原型开发。免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次，每天 500 次。触及上限时会返回错误——不会自动计费。免费套餐仅在部分国家/地区可用；如果你所在地区无法使用免费端点，付费 API 或 RunAPI 是下一步选择。

### 每日请求上限

通过免费套餐，Gemini 2.5 Flash 每天最多 500 次请求。足以用于原型开发和低量级副项目，但 AI Agent 和编码工具可能在几小时内耗尽此限额。

### 速率限制

免费套餐每分钟请求上限约为 20 次。任何突发流量——比如运行 AI Agent——都会很快触及此限制并开始返回错误。

### 数据使用条款

免费套餐输入可能用于改进 Google 产品。付费套餐和 RunAPI 流量不用于训练，这对敏感数据而言很重要。

### 何时升级

一旦需要稳定吞吐量、更高速率限制或更严格的数据处理，请切换到付费版或 RunAPI。RunAPI 以无每日上限的官方付费价格 50% 计费。


## Gemini 比 Claude 和 GPT 便宜吗？

开发者通常将 Gemini 与 Claude Sonnet 和 GPT-5.4 进行对比。以下是主力模型通过 RunAPI 按每百万 token 计算的费用对比。

| 服务商 | 主力模型 | 输入 /M | 输出 /M | RunAPI 费率 |
|---|---|---|---|---|
| Google | Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |

## Gemini API 在真实工作负载下的实际费用是多少？

token 费用看起来很抽象，直到你把它和实际任务联系起来。以下是五种常见开发者工作负载在两种使用量级下通过 RunAPI 的每月估算费用。

| 工作负载 | 模型 | 轻度使用（~50 任务/天） | 重度使用（~200 任务/天） | 较官方价格每月节省 |
|---|---|---|---|---|
| 长上下文文档分析 | Gemini 2.5 Pro | $18/月 | $72/月 | $18–$72 |
| 高量级分类 | Gemini 2.5 Flash | $3/月 | $12/月 | $3–$12 |
| RAG 文档聊天机器人 | Gemini 2.5 Flash | $5/月 | $20/月 | $5–$20 |
| 内容生成流水线 | Gemini 2.5 Pro | $15/月 | $60/月 | $15–$60 |
| 多 Agent 编排器 | Gemini 2.5 Pro | $60/月 | $240/月 | $60–$240 |

## 如何通过 RunAPI 使用 Gemini API

1. **创建 RunAPI 账号** — 在 runapi.ai 注册。免费套餐无需信用卡。
2. **复制你的 API key** — 进入控制台 → API Keys，创建密钥并保存——你将把它作为 OpenAI API key 使用。
3. **将 SDK 指向 RunAPI** — 将 base URL 设置为 https://runapi.ai/v1，并使用你的 RunAPI API key。任何兼容 OpenAI 的客户端均可使用——Python、Node.js、Go、Ruby 或 curl。
4. **开始发起请求** — 在 model 参数中使用 gemini-2.5-pro、gemini-2.5-flash 或任意 Gemini 模型 ID。RunAPI 以官方价格的 50% 处理路由和计费。

## Gemini API 定价 FAQ

### Gemini API 的费用是多少？

Gemini 2.5 Pro 的 Google 官方定价为输入 $1.25/M，输出 $10/M。Gemini 2.5 Flash 为输入 $0.15/M，输出 $0.60/M。通过 RunAPI，所有 Gemini 模型的费率均为一半，无订阅或量级承诺。你只为每次请求使用的 token 付费。

### Gemini 比 Claude 和 GPT 便宜吗？

在输入价格上，是的。Gemini 2.5 Pro 的官方价格 $1.25/M 输入低于 GPT-5.4（$2.50）和 Claude Sonnet（$6），是三大服务商中输入价格最低的主力模型。RunAPI 将三者均减半，因此差距保持不变。

### 免费套餐的速率限制是什么？触及限制时会怎样？

免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次，每天 500 次。触及限制时，请求会返回错误——不会自动计费。免费套餐输入可能用于改进 Google 产品，请避免发送敏感数据。一旦需要稳定吞吐量，请切换到付费版。

### 为什么 RunAPI 比官方 API 便宜 50%？

RunAPI 与模型服务商协商批量价格并将节省传递给开发者。质量没有任何差异——相同的模型、相同的兼容 OpenAI 的 API、相同的输出。你只需更改 base URL 和密钥，现有客户端代码照常运行。

### 我可以用 OpenAI SDK 使用 Gemini 吗？

可以。RunAPI 兼容 OpenAI。将任意 OpenAI 客户端指向 runapi.ai/v1，并使用 gemini-2.5-pro 等 Gemini 模型 ID 即可。现有 OpenAI SDK 代码仅需更改 base URL 和密钥，无需其他修改。

### 为什么 Gemini 适合长上下文任务？

Gemini 2.5 Pro 和 Flash 均提供 100 万 token 的上下文窗口，比大多数 Claude 和 GPT 模型更大。结合低廉的输入价格，这使得 Gemini 非常适合分析长文档、大型代码库或同时处理多个文件的任务。

### 我不断耗尽免费套餐限额，有什么解决办法？

RunAPI 提供一个 API key，可访问 Gemini、Claude 和 GPT——无需设置 Google Cloud 项目，无需管理账单账号。如果你已耗尽免费套餐限额，或发现你所在地区的免费 API key 无法使用，RunAPI 的付费访问在全球范围内以官方价格 50% 提供。

### 如何计费？

按量计费。你为账户充值余额，每次 API 调用以官方价格一半的费率扣除 token 费用。无订阅、无发票、无合同。你可以从 RunAPI 控制台按密钥监控消费，并在余额不足前设置提醒。

