Claude/claude-fable-5
通过 /v1/messages 调用 Claude/claude-fable-5。
使用同一 RunAPI key 和相同的请求格式,对比各模型的输出结果。
登录后即可使用可用语言模型开始生成。
通过 /v1/messages 调用 Claude/claude-fable-5。
使用同一 RunAPI key 和相同的请求格式,对比各模型的输出结果。
通过 /v1/messages 调用 Claude/claude-fable-5-1。
使用同一 RunAPI key 和相同的请求格式,对比各模型的输出结果。
通过 /v1/messages 调用 Claude/claude-haiku-4-5-20251001。
使用同一 RunAPI key 和相同的请求格式,对比各模型的输出结果。
各类 SDK 通用的 OpenAI 请求格式。替换 base_url,保留现有请求代码。
适用于系统提示、工具调用和结构化内容块的 Messages API 格式。
适用于多轮 agent 循环、支持服务端会话管理的有状态请求格式。
用于检索的向量 embedding,使用同一 RunAPI key 按 token 计费。
Anthropic
$10.00 / 1M in
Anthropic
$10.00 / 1M in
Anthropic
$0.60 / 1M in
Anthropic
$9.00 / 1M in
Anthropic
$3.00 / 1M in
Anthropic
$3.00 / 1M in
Anthropic
$3.00 / 1M in
Anthropic
$3.00 / 1M in
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
为你的 RunAPI 账户创建一个 Key。
通过文档中的 OpenAI 兼容端点发送请求。
RunAPI 为你的请求选择受支持的路由。
在所选端点支持 SSE 时接收流式输出。
无需管理多套 API 密钥。一次接入,即可访问全部 230+ 个模型。
我们与服务商的批量协议让我们能够提供低于直接采购的价格,无任何加价。
若某服务商出现故障,我们将自动路由至次优选项,确保您的应用持续可用。
OpenAI SDK 的直接替代方案。修改一行代码即可访问任意模型。
只为实际用量付费。按请求计费,无最低消费。支持按模型、按项目追踪费用。
隐私政策说明了请求数据和生成内容的处理与保存方式。
将规划任务路由至 Opus,将编辑任务交给低价模型,一个 key,一张账单。
Embedding 与生成共用同一 endpoint,检索与问答共享同一预算。
将同一 prompt 分发至多个模型并保留最佳结果,无需签署五份服务商合同。
只需修改一个字符串,即可对 Claude、GPT 和 Gemini 进行同 prompt A/B 测试。
| 功能 | RunAPI | OpenRouter | 直接调用 API |
|---|---|---|---|
| LLM 模型 | 66 | 300+ | 1 个提供商 |
| 其他模态 | 视频、图像、音乐、音频 | 否 | 按服务商 |
| 定价 | 低于官方价格 15-25% | 市场价 | 官方费率 |
| 原生 Messages API | 是 | 否 | 是 |
| 统一积分 | 是 | 是 | 否 |
| MCP server + CLI | 是 | 否 | 否 |
将客户端指向 RunAPI 文档中的 base URL,并使用您的 RunAPI key。保持所选 endpoint 支持的请求格式不变。
当所选模型和 endpoint 在其运行时协议中支持流式响应时,即可使用流式输出。
在运行时协议中声明了工具支持的模型和 endpoint 格式上,即可使用工具调用。
输入和输出费率已在模型目录中列出。费用根据请求上报的 token 用量计算。
选择与您现有客户端匹配、且满足请求所需功能的 endpoint 格式。
API 会通过其文档化的响应协议返回请求状态,您的应用可据此进行重试或切换到其他支持的模型。