统一认证,接入所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
通过 RunAPI 使用 Kimi API,配套 model skill、统一认证和按需计费。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。" }]
});
Kimi 系列目前以 kimi-k3 为旗舰,推理始终开启。RunAPI 首版为 kimi-k3 提供基础文本同步与 SSE;kimi-k2.5 和 kimi-k2.6 仍可使用。K2 是总参数 1 万亿、每 token 激活 32B、每层 384 专家的 MoE 架构;K2.6 在 SWE-bench Pro 达到 58.6%。
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Endpoint | 分辨率 | 时长 | 价格 | |
|---|---|---|---|---|
| chat_completion | — | — | 输入 $0.60 / 百万 tokens | 输出 $3.00 / 百万 tokens |
当前价格适用于 kimi-k2.5。其他变体保留各自的 endpoint 定价。
根据输出类型、质量要求和延迟目标选择模型与变体。
设置 RunAPI key,并在代码工作区安装对应 model skill。
按 skill 里的说明,把模型能力接入到你的应用里。
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
USD 按次定价,按月结算。失败的生成不计费。
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
kimi-k3 是当前旗舰,推理始终开启。RunAPI 首版支持其基础文本同步与 SSE。
两者属于 K2 架构:总参数 1 万亿、每 token 激活 32B、每层 384 专家。kimi-k2.5 提供 256K 上下文和原生多模态输入;kimi-k2.6 的 SWE-bench Pro 为 58.6%。这些 K2 说明不适用于 kimi-k3。
可使用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 或 Gemini native 接口,并传入所选的 Kimi 模型 ID。
请在 RunAPI catalog 中各 Kimi 模型的模型页面查看当前价格。
选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。
创建账户和 API Key 免费。API 调用采用预付费按量计费,充值后即可使用。