缓存输入
重复的提示词前缀以降低的输入费率计费。RunAPI 以 OpenAI 缓存费率的 50% 传递此折扣。
GPT-5.4 每百万 token 输入 $2.50,输出 $15;GPT-5.5 为 $5 和 $30。RunAPI 以这些费率的一半提供相同模型——相同 API、相同输出、相同行为,账单数字更低。
OpenAI 按每百万 token 计费,输入(你的提示词)和输出(模型的响应)分别定价。输出 token 更贵——模型必须逐一生成。还有更便宜的缓存输入费率,当你重新发送相同的提示词前缀时适用。以下所有数字均为每百万 token。
通过 RunAPI,GPT-5.4 输入 $1.25/M,输出 $7.50/M。官方价格为 $2.50/$15。
GPT-5.4-mini——适合高量级、不需要完整主力模型能力的低价选项。通过 RunAPI 享受 50% 折扣。
通过 RunAPI,GPT-5.5 输入 $2.50/M,输出 $15/M。官方价格为 $5/$30。
缓存输入 token 的费用仅为标准输入的一小部分——在 RunAPI 上同样享受 50% 折扣。
下表展示 OpenAI 官方定价与 RunAPI 定价对比。输出 token 的费用明显高于输入 token——这是设计使然,因为生成每个 token 比读取它需要更多算力。RunAPI 对所有 GPT 模型统一打 5 折。无量级承诺,无订阅。
| 模型 | 官方输入 /M | 官方输出 /M | RunAPI 输入 /M | RunAPI 输出 /M | 上下文窗口 |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI 对缓存输入 token 收取更低费用,并对可等待最多 24 小时的批量请求提供 50% 折扣。如果你在运行编码 Agent 或处理大批量任务,两者都很重要——重复的上下文和批量工作累积很快。
重复的提示词前缀以降低的输入费率计费。RunAPI 以 OpenAI 缓存费率的 50% 传递此折扣。
提交到 Batch API 的请求以标准费率的一半运行,最多等待 24 小时。RunAPI 在自身折扣之上传递此折扣。
GPT-5 模型允许你设置推理强度。较低强度产生更少的推理 token,直接降低按量计费下的输出费用。
按请求限制最大输出 token 数,以控制费用并避免长时 Agent 任务中的 token 失控。
token 费率看起来很抽象,直到你把它映射到实际工作上。每天处理 50 次对话的客服聊天机器人,与全天运行的编码 Agent 或处理数百个文档的内容流水线,其费用结构截然不同。以下是常见开发者工作负载——包括自动化工作流——在两种使用量级下按 RunAPI 费率计算的每月估算费用。
| 工作负载 | 模型 | 轻度使用(~50 任务/天) | 重度使用(~200 任务/天) | 较官方价格每月节省 |
|---|---|---|---|---|
| 编码 Agent(Codex) | GPT-5.3-codex | $20/月 | $80/月 | $20–$80 |
| 客服聊天机器人 | GPT-5.4-mini | $6/月 | $24/月 | $6–$24 |
| RAG 知识助手 | GPT-5.4 | $18/月 | $72/月 | $18–$72 |
| 内容生成流水线 | GPT-5.4 | $25/月 | $100/月 | $25–$100 |
| 多 Agent 编排器 | GPT-5.5 | $90/月 | $360/月 | $90–$360 |
锁定单一服务商是一个真实风险,因为一次隔夜降价就可能让竞争对手便宜 30%。以下是主力模型按每百万 token 的费用对比——OpenAI、Anthropic 和 Google 并排展示——让你无需翻查三个账单页面即可做出判断。RunAPI 提供一个 API key 路由到全部三家。
| 服务商 | 主力模型 | 输入 /M | 输出 /M | RunAPI 费率 |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI 对以上所有服务商应用 50% 折扣。价格经 2026 年 6 月核实。
在 runapi.ai 注册。免费套餐无需信用卡。
进入控制台 → API Keys,创建密钥并保存——你将把它作为 OpenAI API key 使用。
将 base URL 设置为 https://api.runapi.ai/v1,并使用你的 RunAPI 密钥。任何兼容 OpenAI 的客户端均可使用。
在 model 参数中使用 gpt-5.4、gpt-5.5 或任意 GPT 模型 ID。RunAPI 以官方价格的 50% 处理路由和计费。
GPT-5.4 官方价格为每百万输入 token $2.50,每百万输出 token $15。GPT-5.5 为 $5 和 $30。通过 RunAPI,所有 GPT 模型以这些费率的一半计费——GPT-5.4 每百万 token 输入 $1.25,输出 $7.50。
RunAPI 与模型服务商协商批量价格并将节省传递给开发者。请求到达相同的 OpenAI 模型,具有完全相同的输出、安全过滤和行为,因此唯一的区别是账单上更低的费率。没有质量折损,没有单独计费层——折扣自动应用于所有 GPT 模型。
有。新 RunAPI 账号可获得免费额度来测试任意 GPT 模型——无需信用卡。之后按量计费,无月度最低消费,无订阅。充值余额,每次 API 调用扣除其 token 费用。你可以按任意金额充值,并在控制台按模型追踪用量。
可以,对 n8n、Make 或 Zapier 等自动化工具效果很好。每个调用 GPT 模型的工作流步骤按使用的 token 计费——没有单独的每次调用费用或速率限制层。对于按计划运行或处理批量的工作流,Batch API 折扣(5 折)适用并与 RunAPI 的基础折扣叠加,因此定期自动化任务的费用会显著降低。
图像输入按图块计费——OpenAI 将图像分成 512×512 的图块,按图块收费。音频按输入秒数计费。两者都不使用每百万 token 单位。RunAPI 以相同的 50% 折扣传递图像和音频定价,因此 GPT-4o 视觉请求或 Whisper 转录的费用为官方价格的一半。
可以。RunAPI 兼容 OpenAI。将任意 OpenAI 客户端指向 https://api.runapi.ai/v1,使用你的 RunAPI 密钥,并传入 GPT 模型 ID。已使用 OpenAI SDK 的现有代码无需任何更改,仅替换 base URL 和密钥,迁移一个成熟项目大约只需一分钟。
可以。GPT-5.3-codex 通过 RunAPI 以官方价格 50% 提供,即每百万 token 输入 $1.25,输出 $7.50。通过在 Codex 和其他兼容 OpenAI 的编码工具设置中覆盖 base URL 和密钥,即可使用。缓存输入和批量折扣也会传递,进一步降低重复编码会话的实际费用。