Moonshot AI · 文字

Hermes Agent x Kimi

kimi-k3 係 Kimi 而家嘅旗艦,推理一直啟用,首版只提供基本文字同步同 SSE。kimi-k2.5 同 kimi-k2.6 仍然可以用;256K 上下文、原生多模態輸入同 SWE-bench Pro 等資料只適用於對應嘅 K2 版本。可以用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 同 Gemini native 介面呼叫。

4 variants 由 $0.57 / 百萬 tokens 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 kimi-k2.5:1T / 啟用 32B;256K 上下文;原生多模態輸入。

You have access to RunAPI chat models for Kimi.

Available Kimi models:
- kimi-k2.5: 1T / 啟用 32B;256K 上下文;原生多模態輸入
  chat endpoints: /v1/chat/completions
- kimi-k2.6: 1T / 啟用 32B;256K 上下文;58.6% SWE-bench Pro;300-agent swarm
  chat endpoints: /v1/chat/completions
- kimi-k2.7-code: 專用編碼模型;Thinking 始終開啟;256K 上下文
  chat endpoints: /v1/chat/completions
- kimi-k3: Kimi 當前旗艦模型,始終啟用推理
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: 規劃並實作一個小型 CLI 工具:建立專案骨架、撰寫指令、加入測試,並反覆執行直到通過。
Verify the active model with: hermes model;hermes doctor

公開版本與端點

模型 ID 端點 起始價格 模型目錄
kimi-k2.5
/v1/chat/completions
$0.60 / 百萬 tokens 模型詳情
kimi-k2.6
/v1/chat/completions
$0.95 / 百萬 tokens 模型詳情
kimi-k2.7-code
/v1/chat/completions
$0.57 / 百萬 tokens 模型詳情
kimi-k3
/v1/chat/completions
$3.00 / 百萬 tokens 模型詳情

驗證

輪詢,直到 Task 進入終態

選擇 <model-id> 後產生驗證命令。

設定

指南端點: <endpoint>

選擇 <model-id> 後,依端點的公開輸入契約產生請求。
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    為此 Agent 新增 Provider 設定。

  3. 驗證結果

    執行下方 Agent 狀態與模型選擇命令。

使用 Hermes Agent + Kimi 可以建立甚麼

  • Agent 編碼與推理

    借助模型的推理能力,讓 Agent 規劃、編寫和審查代碼,或處理多步驟問題。

  • 長文件分析與擷取

    總結報告、合約或代碼庫,並從長文件中擷取結構化欄位。

  • 工具調用工作流程

    將模型連接到函數和 API,讓 Agent 在回覆之間查詢數據並執行操作。

為甚麼透過 RunAPI + Hermes Agent 使用 Kimi

  • 4 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 直接返回結果

    同步調用會在同一個回應中返回結果,Agent 無需輪詢任務即可直接使用。

Hermes Agent + Kimi 常見問題

而家嘅 Kimi 旗艦係咩?

kimi-k3。佢嘅推理一直啟用,RunAPI 首版支援基本文字同步同 SSE。

kimi-k2.5 同 kimi-k2.6 有咩分別?

兩者都屬於 K2 架構:總參數 1 兆、每個 token 啟用 32B、每層 384 位專家。kimi-k2.5 提供 256K 上下文同原生多模態輸入;kimi-k2.6 嘅 SWE-bench Pro 係 58.6%。呢啲 K2 資料唔適用於 kimi-k3。

邊啲 SDK 可以透過 RunAPI 呼叫 Kimi?

可以用 OpenAI Chat Completions、OpenAI Responses、Anthropic Messages 或 Gemini native 介面,並傳入所選嘅 Kimi 模型 ID。

Kimi 點樣收費?

請到 RunAPI catalog 各 Kimi 模型嘅模型頁查看目前價格。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

會。此 Model Line 支援面向用戶端的 LLM 協定。

透過 Hermes Agent 開始使用 Kimi

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們