提供方
Moonshot AI AI 模型
Moonshot AI 的 Kimi:kimi-k3 是推理始终开启的当前旗舰,首版提供基础文本同步与 SSE。
1 models
·
4 variants
·
起价 $0.0006
Moonshot AI 全部模型
1 models
概览
Moonshot AI 的 Kimi 系列以 kimi-k3 为当前旗舰,推理始终开启;RunAPI 首版提供基础文本同步与 SSE。kimi-k2.5 和 kimi-k2.6 仍可使用。总参数 1 万亿、每 token 激活 32B、每层 384 专家及 SWE-bench Pro 58.6% 是 K2 的事实,其中后者属于 kimi-k2.6。
- 一把 key 覆盖所有提供方
- Model skill 把文档和 schema 带进代码工作区
- 按次计费,无最低消费
- 失败的生成不计费
特性
亮点
模型
Moonshot AI 全部模型
快速开始
安装一个 Moonshot AI model skill。
选择模型并添加它的 skill,让编码工具获得文档、schema、定价说明和接入步骤。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。" }]
});
参考
Moonshot AI 全部变体
| Model | Variant | Billing | Pricing | |
|---|---|---|---|---|
|
Kimi
|
kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | 查看 → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | 查看 → | |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | 查看 → | |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 查看 → |
常见问题
Moonshot AI 常见问题
这是 Moonshot AI 官方集成吗?
RunAPI 提供托管 API 接入,定价、能力和错误行为都清晰透明。
需要单独的 Moonshot AI 账号吗?
不需要——RunAPI key 即可使用托管接入。
代理会带来多少延迟?
一般在 20 ms 以内。RunAPI 会让代理层尽量靠近模型执行区域。
输出会缓存吗?
输出按任务 ID 存储在 R2 供回取。输入不缓存。
能自带 key 吗?
目前不支持——调用使用 RunAPI 托管接入。
立即开始