缓存读取
输入 token 享受 90% 折扣。通过 RunAPI,Sonnet 4.6 缓存读取费用为 $0.30/M,而非 $3.00/M。
Anthropic 按模型收取每百万 token $3–$15 的费用。RunAPI 以官方价格的一半提供所有 Claude 模型——相同 API、相同输出、账单减少 50%。
Anthropic 按三个模型档位计费:Haiku 用于轻量任务,Sonnet 用于日常工作负载,Opus 用于最高能力需求。以下所有价格均为每百万 token。一百万 token 大约相当于 75 万单词——上下文消耗往往比大多数人预期的更快。
通过 RunAPI,Haiku 4.5 输入 $1/M,输出 $5/M。官方价格为 $2/$10。
通过 RunAPI,Sonnet 4.6 输入 $3/M,输出 $15/M。官方价格为 $6/$30。
通过 RunAPI,Opus 4.7 输入 $5/M,输出 $25/M。官方价格为 $10/$50。
缓存读取比标准输入 token 便宜 90%——通过 RunAPI,Haiku 仅需 $0.10/M。如果你每次请求都发送相同的系统提示,缓存可大幅降低账单。
下表展示 Anthropic 官方定价与 RunAPI 定价对比。RunAPI 对所有 Claude 模型统一打 5 折。无量级承诺,无订阅。
| 模型 | 官方输入 /M | 官方输出 /M | RunAPI 输入 /M | RunAPI 输出 /M | 上下文窗口 |
|---|---|---|---|---|---|
| Opus 4.8 | $15.00 | $75.00 | $7.50 | $37.50 | 200K |
| Opus 4.7 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Opus 4.6 | $10.00 | $50.00 | $5.00 | $25.00 | 200K |
| Sonnet 4.6 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Sonnet 4.5 | $6.00 | $30.00 | $3.00 | $15.00 | 200K |
| Haiku 4.5 | $2.00 | $10.00 | $1.00 | $5.00 | 200K |
Anthropic 的提示词缓存可存储重复前缀,复用缓存时费用更低。这对 Claude Code 等编码 Agent 尤为重要,因为它们每次请求都会发送相同的系统提示和文件上下文。
输入 token 享受 90% 折扣。通过 RunAPI,Sonnet 4.6 缓存读取费用为 $0.30/M,而非 $3.00/M。
输入费用加收 25%——通过 RunAPI,Sonnet 4.6 为 $3.75/M。缓存前缀可保留 5 分钟。
费率为输入价格的 2 倍——通过 RunAPI,Sonnet 4.6 为 $6.00/M。适用于上下文复用频繁的长时编码会话。
Anthropic 对可接受 24 小时内返回的批量请求提供所有模型 50% 折扣。RunAPI 将此折扣直接传递给用户。
token 费用看起来很抽象,直到你把它和实际任务联系起来。以下是五种常见开发者工作负载在两种使用量级下的每月估算费用。注意,输入 token——系统提示、对话历史、附加文件——在上下文密集型工作流中往往比输出 token 费用更高。
| 工作负载 | 模型 | 轻度使用(~50 任务/天) | 重度使用(~200 任务/天) | 较官方价格每月节省 |
|---|---|---|---|---|
| Vibe 编码会话(Claude Code) | Sonnet 4.6 | $45/月 | $180/月 | $45–$180 |
| PR 代码审查 Agent | Opus 4.7 | $75/月 | $300/月 | $75–$300 |
| RAG 文档聊天机器人 | Haiku 4.5 | $12/月 | $48/月 | $12–$48 |
| 内容生成流水线 | Sonnet 4.6 | $30/月 | $120/月 | $30–$120 |
| 多 Agent 编排器 | Opus 4.7 | $150/月 | $600/月 | $150–$600 |
遇到 Claude 限制的开发者通常会考虑 GPT-5 和 Gemini 2.5 Pro 作为替代方案。以下是主力模型在每百万 token 实际费用上的对比。
| 服务商 | 主力模型 | 输入 /M | 输出 /M | RunAPI 费率 |
|---|---|---|---|---|
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI 对以上所有服务商应用 50% 折扣。价格经 2026 年 6 月核实。
Claude Max 针对重度 Claude Code 使用每月收费 $100(5x 计划为 $200)。API 按 token 计费,无月度承诺。订阅计划有一点不会明说:Pro 计划同时设有每日上限和每周上限,如果你每天高强度使用,可能在周中耗尽额度,需等待 3 天重置。API 没有此类天花板。对于每月 Sonnet 4.6 输出 token 不超过 1000 万的开发者,通过 RunAPI 使用 API 的费用低于 Max 订阅。
在 Claude Code 中无限使用 Sonnet,以及有限使用 Opus。固定月费。第三方工具无法使用 API。
按 token 付费,无月度承诺。Sonnet 4.6 输入 $3/M,输出 $15/M。$100 可购买约 670 万输出 token——对大多数个人开发者已足够。
每月 Sonnet 4.6 输出 token 持续超过 1000 万的重度日常用户。通过 RunAPI 使用 Sonnet 4.6 的盈亏平衡点约为 670 万输出 token。
团队、CI 流水线、多模型组合,以及任何需要 API 访问的工具(OpenClaw、n8n、Cursor)。无上限、无等待、无订阅锁定。你还可以将简单任务路由到 Haiku 4.5——对于不需要完整能力的任务,其每 token 价格约为 Sonnet 的 1/20。
在 runapi.ai 注册。免费套餐无需信用卡。
进入控制台 → API Keys,创建密钥并保存——你将把它作为 OpenAI API key 使用。
将 base URL 设置为 https://runapi.ai/v1,并使用你的 RunAPI API key。任何兼容 OpenAI 的客户端均可使用——Python、Node.js、Go、Ruby 或 curl。
在 model 参数中使用 claude-sonnet-4-6、claude-opus-4-7 或任意 Claude 模型 ID。RunAPI 以官方价格的 50% 处理路由和计费。
这是因为大上下文窗口——系统提示、对话历史、附加文件——主导了 token 费用。一个携带大量上下文的问题可能消耗 5 小时窗口的 20%。API 让你精确控制每次请求发送的上下文,从而避免为不需要的内容付费。
使用 OpenClaw、n8n 或 Cursor 等第三方工具配合 Claude 个人订阅,可能导致账号被封禁。Anthropic 的条款不允许订阅计划为外部应用提供服务。API 是唯一受支持的方式——RunAPI 提供按量计费、无月度承诺的接入。
可以。将 ANTHROPIC_BASE_URL 设置为 https://runapi.ai,并将 RunAPI 密钥作为 API key。Claude Code 无需任何其他修改即可运行。按 token 付费,费率为官方价格的 50%,无需订阅。
RunAPI 在 24 小时内完成调整。50% 折扣始终相对于 Anthropic 已发布价格保持不变。
有。新账号可获得免费额度以测试任何模型。之后严格按量计费,无最低消费。
支持。缓存读取、5 分钟写入和 1 小时写入均以 Anthropic 缓存价格的 50% 计费。如果你每次请求都发送相同的大型系统提示,缓存读取可将输入成本降低 90%——Sonnet 4.6 从 $3.00/M 降至 $0.30/M。
可以。RunAPI 兼容 OpenAI。将任意 OpenAI 客户端指向 runapi.ai/v1,并使用 Claude 模型 ID 即可。如果你已经通过 OpenRouter 或类似网关调用 Claude,切换到 RunAPI 的方式相同——只需更换一个 URL 和一个 API key。
按量计费。你为账户充值余额,每次 API 调用扣除 token 费用。无订阅、无发票、无合同。你还可以在 RunAPI 控制台设置硬性消费上限,避免意外账单——不像直接使用 Anthropic 计费那样让用户措手不及。
创建免费 RunAPI 账号,获取 API key,以官方 Anthropic 定价的 50% 开始调用 Claude Opus、Sonnet 或 Haiku。