Claude API
Claude API 调用 Anthropic 大语言模型,擅长复杂推理、代码、分析和超长上下文任务。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/messages \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-5",
"max_tokens": 1024,
"messages": [
{
"role": "user",
"content": "审查这个 PR 的安全漏洞和性能问题,并给出具体改进建议。"
}
]
}'
import anthropic
client = anthropic.Anthropic(
base_url="https://runapi.ai",
api_key="your-runapi-key"
)
message = client.messages.create(
model="claude-sonnet-5",
max_tokens=1024,
messages=[{"role": "user", "content": "审查这个 PR 的安全漏洞和性能问题,并给出具体改进建议。"}]
)
import Anthropic from "@anthropic-ai/sdk";
const client = new Anthropic({
baseURL: "https://runapi.ai",
apiKey: "your-runapi-key"
});
const message = await client.messages.create({
model: "claude-sonnet-5",
max_tokens: 1024,
messages: [{ role: "user", content: "审查这个 PR 的安全漏洞和性能问题,并给出具体改进建议。" }]
});
Claude 是 Anthropic 的大语言模型系列,提供 Opus、Sonnet 和 Haiku 三种规格,专为细致推理、长上下文分析和代码生成而设计,注重准确性、指令遵循和安全可预期的输出。
- 多变体覆盖不同速度/质量层级
- Model skill 包含文档、schema 和接入说明
- 适合面向应用的编码工作流
- 失败的生成不计费
对比全部 API 变体
| Variant | Billing | Pricing | |
|---|---|---|---|
| claude-fable-5 | 1K tokens | Input $10.00 / 1M tokens | Output $50.00 / 1M tokens | 查看 → |
| claude-haiku-4-5-20251001 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | 查看 → |
| claude-opus-4-1-20250805 | 1K tokens | Input $9.00 / 1M tokens | Output $45.00 / 1M tokens | 查看 → |
| claude-opus-4-5-20251101 | 1K tokens | Input $3.00 / 1M tokens | Output $15.00 / 1M tokens | 查看 → |
| claude-opus-4-6 | 1K tokens | Input $3.00 / 1M tokens | Output $15.00 / 1M tokens | 查看 → |
| claude-opus-4-7 | 1K tokens | Input $3.00 / 1M tokens | Output $15.00 / 1M tokens | 查看 → |
| claude-opus-4-8 | 1K tokens | Input $3.00 / 1M tokens | Output $15.00 / 1M tokens | 查看 → |
| claude-opus-5 | 1K tokens | Input $3.00 / 1M tokens | Output $15.00 / 1M tokens | 查看 → |
| claude-sonnet-4-5-20250929 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 查看 → |
| claude-sonnet-4-6 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 查看 → |
| claude-sonnet-5 | 1K tokens | Input $1.36 / 1M tokens | Output $6.78 / 1M tokens | 查看 → |
Claude API 端点
使用 OpenAI 或 Anthropic SDK 配合 RunAPI key 调用,无需额外 SDK。
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
四步从 model skill 到首次结果
选择模型
根据输出类型、质量要求和延迟目标选择模型与变体。
配置
设置 RunAPI key,并在代码工作区安装对应 model skill。
调用
按 skill 里的说明,把模型能力接入到你的应用里。
接收
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
Claude API 是什么?
Claude 是 Anthropic 的 LLM 系列,涵盖 Opus(旗舰)、Sonnet(均衡)和 Haiku(轻量)。通过 RunAPI,所有 Claude 变体共享相同 API 和按 token 计费。
为什么用 RunAPI 调用 Claude API
一把认证,覆盖所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
统一的定价与账单
USD 按次定价,按月结算。失败的生成不计费。
Schema 优先的 SDK
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
常见问题
上下文窗口有多大?
大多数 Claude 模型支持 20 万 token 上下文,最新 Opus 和 Sonnet 模型支持 100 万 token 上下文。不论上下文大小,每个 token 的定价相同。
什么是扩展思考?
扩展思考让 Claude 在回答前逐步推理。思考 token 按输出 token 计费,并计入上下文限制。
Opus、Sonnet 和 Haiku 有什么区别?
Opus 是复杂推理任务中能力最强的。Sonnet 在质量与速度之间取得平衡。Haiku 速度最快、成本最低,适合高吞吐量任务。
Claude 支持工具调用吗?
支持——Claude 可以调用工具、执行代码、搜索网络以及获取 URL。工具调用已正式可用,无需添加 beta 请求头。
支持 prompt 缓存吗?
支持——缓存读取按标准输入费率的约 10% 收费,可大幅降低重复上下文的成本。
应该从哪个变体开始?
选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。
有免费额度吗?
新账户每个模型都有免费调用额度,之后按次计费。
支持流式吗?
模型支持流式时,RunAPI 端到端流式。
失败怎么计费?
失败的生成不计费。
输出会缓存吗?
输出按任务 ID 存储在 R2 供回取。输入不缓存。
可以商用吗?
可以——所有变体默认含商用许可,除非模型许可明确限制;有例外会在变体页面注明。
速率限制?
Key 级限流随使用层级伸缩。当前限制见定价页。
在哪里报问题?
在公共 GitHub 仓库提 issue 或邮件联系 support。