每日请求上限
通过免费套餐,Gemini 2.5 Flash 每天最多 500 次请求。足以用于原型开发和低量级副项目,但 AI Agent 和编码工具可能在几小时内耗尽此限额。
Google 对 Gemini 2.5 Pro 收取每百万 token $1.25–$10,Flash 则更便宜。免费套餐每分钟约 20 次请求后触及上限。RunAPI 以官方价格一半镜像所有 Gemini 模型——直接粘贴到任何兼容 OpenAI 的客户端即可使用。
Google 为两个主要档位发布了按 token 定价:Flash 用于快速、低成本任务,Pro 用于最高能力。还有带每日请求限制的免费套餐——适合测试,但 AI Agent 和编码工具可能很快耗尽。以下所有价格均为每百万 token,这是 Google 使用的计费单位。
通过 RunAPI,Gemini 2.5 Flash 输入 $0.08/M,输出 $0.30/M。官方价格为 $0.15/$0.60。
通过 RunAPI,Gemini 2.5 Pro 输入 $0.63/M,输出 $5.00/M。官方价格为 $1.25/$10。
Google 的免费套餐每分钟约 20 次请求,Flash 每天 500 次——足以用于原型开发,但 AI Agent 可能在几小时内耗尽。
Gemini 2.5 Pro 的输入价格低于 Claude Sonnet 和 GPT-5.4,是三大服务商中最便宜的主力模型。
下表展示 Google 官方定价与 RunAPI 定价对比。RunAPI 对所有 Gemini 模型统一打 5 折。无量级承诺,无订阅。
| 模型 | 官方输入 /M | 官方输出 /M | RunAPI 输入 /M | RunAPI 输出 /M | 上下文窗口 |
|---|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 | $5.00 | 1M |
| Gemini 2.5 Flash | $0.15 | $0.60 | $0.08 | $0.30 | 1M |
| Gemini 2.5 Flash-Lite | $0.10 | $0.40 | $0.05 | $0.20 | 1M |
Google 提供免费套餐供你在付费前进行原型开发。免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次,每天 500 次。触及上限时会返回错误——不会自动计费。免费套餐仅在部分国家/地区可用;如果你所在地区无法使用免费端点,付费 API 或 RunAPI 是下一步选择。
通过免费套餐,Gemini 2.5 Flash 每天最多 500 次请求。足以用于原型开发和低量级副项目,但 AI Agent 和编码工具可能在几小时内耗尽此限额。
免费套餐每分钟请求上限约为 20 次。任何突发流量——比如运行 AI Agent——都会很快触及此限制并开始返回错误。
免费套餐输入可能用于改进 Google 产品。付费套餐和 RunAPI 流量不用于训练,这对敏感数据而言很重要。
一旦需要稳定吞吐量、更高速率限制或更严格的数据处理,请切换到付费版或 RunAPI。RunAPI 以无每日上限的官方付费价格 50% 计费。
开发者通常将 Gemini 与 Claude Sonnet 和 GPT-5.4 进行对比。以下是主力模型通过 RunAPI 按每百万 token 计算的费用对比。
| 服务商 | 主力模型 | 输入 /M | 输出 /M | RunAPI 费率 |
|---|---|---|---|---|
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 | |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Sonnet 4.6 | $6.00 | $30.00 | $3.00 / $15.00 |
RunAPI 对以上所有服务商应用 50% 折扣。Gemini 2.5 Pro 是三大服务商中输入价格最低的主力模型。价格经 2026 年 6 月核实。
token 费用看起来很抽象,直到你把它和实际任务联系起来。以下是五种常见开发者工作负载在两种使用量级下通过 RunAPI 的每月估算费用。
| 工作负载 | 模型 | 轻度使用(~50 任务/天) | 重度使用(~200 任务/天) | 较官方价格每月节省 |
|---|---|---|---|---|
| 长上下文文档分析 | Gemini 2.5 Pro | $18/月 | $72/月 | $18–$72 |
| 高量级分类 | Gemini 2.5 Flash | $3/月 | $12/月 | $3–$12 |
| RAG 文档聊天机器人 | Gemini 2.5 Flash | $5/月 | $20/月 | $5–$20 |
| 内容生成流水线 | Gemini 2.5 Pro | $15/月 | $60/月 | $15–$60 |
| 多 Agent 编排器 | Gemini 2.5 Pro | $60/月 | $240/月 | $60–$240 |
在 runapi.ai 注册。免费套餐无需信用卡。
进入控制台 → API Keys,创建密钥并保存——你将把它作为 OpenAI API key 使用。
将 base URL 设置为 https://api.runapi.ai/v1,并使用你的 RunAPI API key。任何兼容 OpenAI 的客户端均可使用——Python、Node.js、Go、Ruby 或 curl。
在 model 参数中使用 gemini-2.5-pro、gemini-2.5-flash 或任意 Gemini 模型 ID。RunAPI 以官方价格的 50% 处理路由和计费。
Gemini 2.5 Pro 的 Google 官方定价为输入 $1.25/M,输出 $10/M。Gemini 2.5 Flash 为输入 $0.15/M,输出 $0.60/M。通过 RunAPI,所有 Gemini 模型的费率均为一半,无订阅或量级承诺。你只为每次请求使用的 token 付费。
在输入价格上,是的。Gemini 2.5 Pro 的官方价格 $1.25/M 输入低于 GPT-5.4($2.50)和 Claude Sonnet($6),是三大服务商中输入价格最低的主力模型。RunAPI 将三者均减半,因此差距保持不变。
免费套餐将 Gemini 2.5 Flash 的请求限制在每分钟约 20 次,每天 500 次。触及限制时,请求会返回错误——不会自动计费。免费套餐输入可能用于改进 Google 产品,请避免发送敏感数据。一旦需要稳定吞吐量,请切换到付费版。
RunAPI 与模型服务商协商批量价格并将节省传递给开发者。质量没有任何差异——相同的模型、相同的兼容 OpenAI 的 API、相同的输出。你只需更改 base URL 和密钥,现有客户端代码照常运行。
可以。RunAPI 兼容 OpenAI。将任意 OpenAI 客户端指向 api.runapi.ai/v1,并使用 gemini-2.5-pro 等 Gemini 模型 ID 即可。现有 OpenAI SDK 代码仅需更改 base URL 和密钥,无需其他修改。
Gemini 2.5 Pro 和 Flash 均提供 100 万 token 的上下文窗口,比大多数 Claude 和 GPT 模型更大。结合低廉的输入价格,这使得 Gemini 非常适合分析长文档、大型代码库或同时处理多个文件的任务。
RunAPI 提供一个 API key,可访问 Gemini、Claude 和 GPT——无需设置 Google Cloud 项目,无需管理账单账号。如果你已耗尽免费套餐限额,或发现你所在地区的免费 API key 无法使用,RunAPI 的付费访问在全球范围内以官方价格 50% 提供。
按量计费。你为账户充值余额,每次 API 调用以官方价格一半的费率扣除 token 费用。无订阅、无发票、无合同。你可以从 RunAPI 控制台按密钥监控消费,并在余额不足前设置提醒。
创建免费 RunAPI 账号,获取 API key,以 Google 官方定价的 50% 开始调用 Gemini 2.5 Pro 或 Flash——三大服务商中最便宜的主力模型。