文本 Moonshot AI

Kimi API

通过 RunAPI 使用 Kimi API,配套 model skill、统一认证和按需计费。

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。" }]
});
https://runapi.ai 5 endpoints
概览

关于 Kimi

Kimi 系列目前以 kimi-k3 为旗舰,推理始终开启。RunAPI 首版为 kimi-k3 提供基础文本同步与 SSE;kimi-k2.5 和 kimi-k2.6 仍可使用。K2 是总参数 1 万亿、每 token 激活 32B、每层 384 专家的 MoE 架构;K2.6 在 SWE-bench Pro 达到 58.6%。

提供方
Moonshot AI
模态
文本

Kimi API 端点

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

对比全部 API 变体

变体 计费方式 价格
kimi-k2.5 1K tokens 输入 $0.60 / 百万 tokens | 输出 $3.00 / 百万 tokens 查看 →
kimi-k2.6 1K tokens 输入 $0.95 / 百万 tokens | 输出 $4.00 / 百万 tokens 查看 →
kimi-k2.7-code 1K tokens 输入 $0.57 / 百万 tokens | 输出 $2.40 / 百万 tokens 查看 →
kimi-k3 1K tokens 输入 $3.00 / 百万 tokens | 输出 $15.00 / 百万 tokens 查看 →
定价

Kimi 定价

Endpoint 分辨率 时长 价格
chat_completion — — 输入 $0.60 / 百万 tokens | 输出 $3.00 / 百万 tokens

当前价格适用于 kimi-k2.5。其他变体保留各自的 endpoint 定价。

Agent 集成

通过 Agent 运行 Kimi

工作流程

开始使用 Kimi

  1. 选择模型

    根据输出类型、质量要求和延迟目标选择模型与变体。

  2. 配置

    设置 RunAPI key,并在代码工作区安装对应 model skill。

  3. 调用

    按 skill 里的说明,把模型能力接入到你的应用里。

  4. 接收

    按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。

背景

Kimi API 是什么?

kimi-k3 是 Kimi 当前旗舰,推理始终开启,首版仅提供基础文本同步与 SSE。仍可使用 kimi-k2.5 和 kimi-k2.6;256K 上下文、原生多模态输入及 SWE-bench Pro 等说明仅适用于相应的 K2 版本。可使用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 和 Gemini native 接口调用。

提供方
Moonshot AI
查看全部 →
模态
文本
浏览模型 →

为什么用 RunAPI 调用 Kimi API

统一认证,接入所有提供方

一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。

统一的定价与账单

USD 按次定价,按月结算。失败的生成不计费。

Schema 优先的 SDK

Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。

Kimi 常见问题

当前的 Kimi 旗舰是什么?

kimi-k3 是当前旗舰,推理始终开启。RunAPI 首版支持其基础文本同步与 SSE。

kimi-k2.5 和 kimi-k2.6 有什么区别?

两者属于 K2 架构:总参数 1 万亿、每 token 激活 32B、每层 384 专家。kimi-k2.5 提供 256K 上下文和原生多模态输入;kimi-k2.6 的 SWE-bench Pro 为 58.6%。这些 K2 说明不适用于 kimi-k3。

可以用哪些 SDK 通过 RunAPI 调用 Kimi?

可使用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 或 Gemini native 接口,并传入所选的 Kimi 模型 ID。

Kimi 如何计费?

请在 RunAPI catalog 中各 Kimi 模型的模型页面查看当前价格。

应该从哪个变体开始?

选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。

有免费额度吗?

创建账户和 API Key 免费。API 调用采用预付费按量计费,充值后即可使用。

相似模型

如果喜欢 Kimi API,也可以试试这些

立即体验 Kimi API。