It looks like you may prefer a different language. Switch anytime.

LLM API 定价

2026 年 Gemini API 定价

Google 对 Gemini 2.5 Pro 收取每百万 token $1.25–$10,Flash 则更便宜。免费套餐每分钟约 20 次请求后触及上限。RunAPI 以官方价格一半镜像所有 Gemini 模型——直接粘贴到任何兼容 OpenAI 的客户端即可使用。

更新于 June 18, 2026 RunAPI 编辑团队
一览

Gemini API 现在的价格是多少?

Google 为两个主要档位发布了按 token 定价:Flash 用于快速、低成本任务,Pro 用于最高能力。还有带每日请求限制的免费套餐——适合测试,但 AI Agent 和编码工具可能很快耗尽。以下所有价格均为每百万 token,这是 Google 使用的计费单位。

最低价选项

通过 RunAPI,Gemini 2.5 Flash 输入 $0.08/M,输出 $0.30/M。官方价格为 $0.15/$0.60。

最高能力

通过 RunAPI,Gemini 2.5 Pro 输入 $0.63/M,输出 $5.00/M。官方价格为 $1.25/$10。

免费套餐

Google 的免费套餐每分钟约 20 次请求,Flash 每天 500 次——足以用于原型开发,但 AI Agent 可能在几小时内耗尽。

最便宜主力模型

Gemini 2.5 Pro 的输入价格低于 Claude Sonnet 和 GPT-5.4,是三大服务商中最便宜的主力模型。

逐模型明细

每个 Gemini 模型每百万 token 的费用是多少?

下表展示 Google 官方定价与 RunAPI 定价对比。RunAPI 对所有 Gemini 模型统一打 5 折。无量级承诺,无订阅。

模型 官方输入 /M 官方输出 /M RunAPI 输入 /M RunAPI 输出 /M 上下文窗口
Gemini 2.5 Pro $1.25 $10.00 $0.63 $5.00 1M
Gemini 2.5 Flash $0.15 $0.60 $0.08 $0.30 1M
Gemini 2.5 Flash-Lite $0.10 $0.40 $0.05 $0.20 1M
免费套餐

Google 的 Gemini 免费套餐如何运作?

Google 提供免费套餐供你在付费前进行原型开发。免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次,每天 500 次。触及上限时会返回错误——不会自动计费。免费套餐仅在部分国家/地区可用;如果你所在地区无法使用免费端点,付费 API 或 RunAPI 是下一步选择。

每日请求上限

通过免费套餐,Gemini 2.5 Flash 每天最多 500 次请求。足以用于原型开发和低量级副项目,但 AI Agent 和编码工具可能在几小时内耗尽此限额。

速率限制

免费套餐每分钟请求上限约为 20 次。任何突发流量——比如运行 AI Agent——都会很快触及此限制并开始返回错误。

数据使用条款

免费套餐输入可能用于改进 Google 产品。付费套餐和 RunAPI 流量不用于训练,这对敏感数据而言很重要。

何时升级

一旦需要稳定吞吐量、更高速率限制或更严格的数据处理,请切换到付费版或 RunAPI。RunAPI 以无每日上限的官方付费价格 50% 计费。

服务商对比

Gemini 比 Claude 和 GPT 便宜吗?

开发者通常将 Gemini 与 Claude Sonnet 和 GPT-5.4 进行对比。以下是主力模型通过 RunAPI 按每百万 token 计算的费用对比。

服务商 主力模型 输入 /M 输出 /M RunAPI 费率
Google Gemini 2.5 Pro $1.25 $10.00 $0.63 / $5.00
OpenAI GPT-5.4 $2.50 $15.00 $1.25 / $7.50
Anthropic Claude Sonnet 4.6 $6.00 $30.00 $3.00 / $15.00

RunAPI 对以上所有服务商应用 50% 折扣。Gemini 2.5 Pro 是三大服务商中输入价格最低的主力模型。价格经 2026 年 6 月核实。

真实费用

Gemini API 在真实工作负载下的实际费用是多少?

token 费用看起来很抽象,直到你把它和实际任务联系起来。以下是五种常见开发者工作负载在两种使用量级下通过 RunAPI 的每月估算费用。

工作负载 模型 轻度使用(~50 任务/天) 重度使用(~200 任务/天) 较官方价格每月节省
长上下文文档分析 Gemini 2.5 Pro $18/月 $72/月 $18–$72
高量级分类 Gemini 2.5 Flash $3/月 $12/月 $3–$12
RAG 文档聊天机器人 Gemini 2.5 Flash $5/月 $20/月 $5–$20
内容生成流水线 Gemini 2.5 Pro $15/月 $60/月 $15–$60
多 Agent 编排器 Gemini 2.5 Pro $60/月 $240/月 $60–$240
快速入门

如何通过 RunAPI 接入 Gemini API

1

创建 RunAPI 账号

在 runapi.ai 注册。免费套餐无需信用卡。

2

复制你的 API key

进入控制台 → API Keys,创建密钥并保存——你将把它作为 OpenAI API key 使用。

3

将 SDK 指向 RunAPI

将 base URL 设置为 https://api.runapi.ai/v1,并使用你的 RunAPI API key。任何兼容 OpenAI 的客户端均可使用——Python、Node.js、Go、Ruby 或 curl。

4

开始发起请求

在 model 参数中使用 gemini-2.5-pro、gemini-2.5-flash 或任意 Gemini 模型 ID。RunAPI 以官方价格的 50% 处理路由和计费。

常见问题

Gemini API 定价 FAQ

Gemini API 的费用是多少?

Gemini 2.5 Pro 的 Google 官方定价为输入 $1.25/M,输出 $10/M。Gemini 2.5 Flash 为输入 $0.15/M,输出 $0.60/M。通过 RunAPI,所有 Gemini 模型的费率均为一半,无订阅或量级承诺。你只为每次请求使用的 token 付费。

Gemini 比 Claude 和 GPT 便宜吗?

在输入价格上,是的。Gemini 2.5 Pro 的官方价格 $1.25/M 输入低于 GPT-5.4($2.50)和 Claude Sonnet($6),是三大服务商中输入价格最低的主力模型。RunAPI 将三者均减半,因此差距保持不变。

免费套餐的速率限制是什么?触及限制时会怎样?

免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次,每天 500 次。触及限制时,请求会返回错误——不会自动计费。免费套餐输入可能用于改进 Google 产品,请避免发送敏感数据。一旦需要稳定吞吐量,请切换到付费版。

为什么 RunAPI 比官方 API 便宜 50%?

RunAPI 与模型服务商协商批量价格并将节省传递给开发者。质量没有任何差异——相同的模型、相同的兼容 OpenAI 的 API、相同的输出。你只需更改 base URL 和密钥,现有客户端代码照常运行。

我可以用 OpenAI SDK 使用 Gemini 吗?

可以。RunAPI 兼容 OpenAI。将任意 OpenAI 客户端指向 api.runapi.ai/v1,并使用 gemini-2.5-pro 等 Gemini 模型 ID 即可。现有 OpenAI SDK 代码仅需更改 base URL 和密钥,无需其他修改。

为什么 Gemini 适合长上下文任务?

Gemini 2.5 Pro 和 Flash 均提供 100 万 token 的上下文窗口,比大多数 Claude 和 GPT 模型更大。结合低廉的输入价格,这使得 Gemini 非常适合分析长文档、大型代码库或同时处理多个文件的任务。

我不断耗尽免费套餐限额,有什么解决办法?

RunAPI 提供一个 API key,可访问 Gemini、Claude 和 GPT——无需设置 Google Cloud 项目,无需管理账单账号。如果你已耗尽免费套餐限额,或发现你所在地区的免费 API key 无法使用,RunAPI 的付费访问在全球范围内以官方价格 50% 提供。

如何计费?

按量计费。你为账户充值余额,每次 API 调用以官方价格一半的费率扣除 token 费用。无订阅、无发票、无合同。你可以从 RunAPI 控制台按密钥监控消费,并在余额不足前设置提醒。

相关内容

继续探索

以半价开始使用 Gemini。

创建免费 RunAPI 账号,获取 API key,以 Google 官方定价的 50% 开始调用 Gemini 2.5 Pro 或 Flash——三大服务商中最便宜的主力模型。