公開バージョンとエンドポイント
検証
Task が終端状態になるまでポーリングします
<model-id> を選択すると検証コマンドが生成されます。
設定
ガイドエンドポイント: <endpoint>
<model-id> を選択すると、公開入力契約に基づくリクエストが生成されます。
3ステップで始める
-
モデル ID を選択
公開モデル ID を選び、エンドポイントと現在の開始価格を確認します。
-
RunAPI を設定
この Agent の Provider 設定を追加します。
-
結果を検証
以下の Agent ステータスおよびモデル選択コマンドを実行します。
Hermes Agent + Kimi で作れるもの
-
エージェントによるコーディングと推論
モデルの推論を使って、エージェントにコードの計画、作成、レビューや複数ステップの問題解決を任せられます。
-
長文ドキュメントの分析と抽出
レポート、契約書、コードベースを要約し、長いドキュメントから構造化された項目を抽出します。
-
ツール呼び出しのワークフロー
モデルを関数や API に接続し、エージェントが応答の合間にデータを参照して処理を実行できるようにします。
Kimi を RunAPI + Hermes Agent で使う理由
-
4 個のバリアントを 1 つの API キーで
RunAPI の 1 つの接続から利用可能なモデルバリアントを選べるため、連携方法を変える必要がありません。
-
わかりやすい利用料金
リクエストを送る前にカタログの現在の料金を確認できます。サブスクリプションや最低利用額はありません。
-
直接のレスポンス
同期呼び出しは同じレスポンスで結果を返すため、エージェントはタスクをポーリングせずにすぐ結果を使えます。
Hermes Agent + Kimi に関するよくある質問
現在のKimiフラッグシップは何ですか?
kimi-k3です。推論が常時有効で、RunAPIでの初期提供は基本的なテキスト同期とSSEです。
kimi-k2.5とkimi-k2.6の違いは何ですか?
どちらもK2アーキテクチャです。K2は総1Tパラメーター、トークンあたりアクティブ32B、レイヤーあたり384エキスパートのMoEです。kimi-k2.5は256Kコンテキストとネイティブマルチモーダル入力を持ち、kimi-k2.6はSWE-bench Proで58.6%を記録します。これらのK2の説明はkimi-k3には当てはまりません。
RunAPI経由でKimiを呼び出せるSDKは?
OpenAI Chat Completions、OpenAI Responses、Anthropic Messages、Gemini nativeのいずれかのインターフェースを使い、選択したKimiモデルIDを渡してください。
Kimiはどのように課金されますか?
各Kimiモデルの現在の価格は、RunAPI catalogの各モデルページでご確認ください。
どのモデル ID を使うべきですか?
バージョン表から公開モデル ID を選択してください。各 ID で利用できるエンドポイントが同じ行に表示されます。
このガイドはチャットモデルを設定しますか?
はい。この Model Line はクライアント向け LLM プロトコルをサポートします。