Moonshot AI · 文本

Hermes Agent x Kimi

kimi-k3 是 Kimi 当前旗舰,推理始终开启,首版仅提供基础文本同步与 SSE。仍可使用 kimi-k2.5 和 kimi-k2.6;256K 上下文、原生多模态输入及 SWE-bench Pro 等说明仅适用于相应的 K2 版本。可使用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 和 Gemini native 接口调用。

4 variants 起价 $0.57 / 百万 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任务匹配时使用 kimi-k2.5:1T / 32B 激活;256K 上下文;原生多模态输入。

You have access to RunAPI chat models for Kimi.

Available Kimi models:
- kimi-k2.5: 1T / 32B 激活;256K 上下文;原生多模态输入
  chat endpoints: /v1/chat/completions
- kimi-k2.6: 1T / 32B 激活;256K 上下文;SWE-bench Pro 58.6%;300 智能体集群
  chat endpoints: /v1/chat/completions
- kimi-k2.7-code: 专用编码模型;Thinking 始终开启;256K 上下文
  chat endpoints: /v1/chat/completions
- kimi-k3: Kimi 当前旗舰模型,始终开启推理
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 规划并实现一个小型 CLI 工具:搭建项目、编写命令、补充测试,并运行到全部通过。
Verify the active model with: hermes model;hermes doctor

公开版本与端点

模型 ID 端点 起步价格 模型目录
kimi-k2.5
/v1/chat/completions
$0.60 / 百万 tokens 模型详情
kimi-k2.6
/v1/chat/completions
$0.95 / 百万 tokens 模型详情
kimi-k2.7-code
/v1/chat/completions
$0.57 / 百万 tokens 模型详情
kimi-k3
/v1/chat/completions
$3.00 / 百万 tokens 模型详情

验证

轮询,直到 Task 进入终态

选择 <model-id> 后生成验证命令。

配置

指南端点: <endpoint>

选择 <model-id> 后,按端点的公开输入契约生成请求。
使用流程

三步开始使用

  1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 配置 RunAPI

    为该 Agent 添加 Provider 配置。

  3. 验证结果

    运行下方 Agent 状态与模型选择命令。

使用 Hermes Agent + Kimi 可以构建什么

  • Agent 编码与推理

    借助模型的推理能力,让 Agent 规划、编写和审查代码,或处理多步骤问题。

  • 长文档分析与抽取

    总结报告、合同或代码库,并从长文档中抽取结构化字段。

  • 工具调用工作流

    将模型连接到函数和 API,让 Agent 在回复之间查询数据并执行操作。

为什么通过 RunAPI + Hermes Agent 使用 Kimi

  • 4 个变体,一个 API 密钥

    通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。

  • 清晰的用量价格

    发送请求前查看目录中的当前价格,无需订阅或最低消费。

  • 直接返回结果

    同步调用在同一个响应中返回结果,Agent 无需轮询任务即可直接使用。

Hermes Agent + Kimi 常见问题

当前的 Kimi 旗舰是什么?

kimi-k3 是当前旗舰,推理始终开启。RunAPI 首版支持其基础文本同步与 SSE。

kimi-k2.5 和 kimi-k2.6 有什么区别?

两者属于 K2 架构:总参数 1 万亿、每 token 激活 32B、每层 384 专家。kimi-k2.5 提供 256K 上下文和原生多模态输入;kimi-k2.6 的 SWE-bench Pro 为 58.6%。这些 K2 说明不适用于 kimi-k3。

可以用哪些 SDK 通过 RunAPI 调用 Kimi?

可使用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 或 Gemini native 接口,并传入所选的 Kimi 模型 ID。

Kimi 如何计费?

请在 RunAPI catalog 中各 Kimi 模型的模型页面查看当前价格。

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

会。该 Model Line 支持面向客户端的 LLM 协议。

开始在 Hermes Agent 中使用 Kimi

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们