It looks like you may prefer a different language. Switch anytime.

Text Moonshot AI

Kimi API

RunAPIのモデルスキル、統合認証、従量課金制の料金でKimi APIを利用できます。

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。" }]
});
https://runapi.ai 5 endpoints
概要

Kimi について

Kimiシリーズの現在のフラッグシップはkimi-k3で、推論が常時有効です。RunAPIでの初期提供は基本的なテキスト同期とSSEで、kimi-k2.5とkimi-k2.6も引き続き利用できます。総1Tパラメーター、トークンあたりアクティブ32B、レイヤーあたり384エキスパートのMoEとSWE-bench Pro 58.6%はK2に関する事実で、後者はkimi-k2.6のものです。

プロバイダー
Moonshot AI
モダリティ
Text

Kimi API エンドポイント

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

バリアント

バリアント 請求 料金
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens 見る →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens 見る →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens 見る →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens 見る →
料金

Kimi の料金

Endpoint 解像度 価格
chat_completion Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

kimi-k2.5 の料金を表示しています。他のバリアントはそれぞれの endpoint 料金が適用されます。

エージェント連携

エージェントから Kimi を実行

仕組み

Kimi を始める

  1. モデルを選ぶ

    出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。

  2. 一度だけ認証

    対応するすべてのモデルに RunAPI key を使います。

  3. skill をインストール

    機能実装の前に model skill をコード作業環境へ追加します。

  4. 出力を受け取る

    task ID でポーリングするか、生成完了時の callback を処理します。

背景

Kimi の位置づけ

kimi-k3はKimiの現在のフラッグシップで、推論が常時有効です。RunAPIでの初期提供は基本的なテキスト同期とSSEのみです。kimi-k2.5とkimi-k2.6も引き続き利用できます。256Kコンテキスト、ネイティブマルチモーダル入力、SWE-bench Proなどの説明は、それぞれのK2版にのみ該当します。OpenAI Chat Completions、OpenAI Responses、Anthropic Messages、Gemini nativeの各インターフェースで呼び出せます。

プロバイダー
Moonshot AI
すべて見る →
モダリティ
Text
モデルを見る →

RunAPI 経由で Kimi を使う理由

1つの API key

モデルやプロバイダーをまたいで同じ認証情報を使えます。

Skill-ready

model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。

予測しやすい請求

呼び出し前に従量料金を確認できます。

Kimi に関するよくある質問

現在のKimiフラッグシップは何ですか?

kimi-k3です。推論が常時有効で、RunAPIでの初期提供は基本的なテキスト同期とSSEです。

kimi-k2.5とkimi-k2.6の違いは何ですか?

どちらもK2アーキテクチャです。K2は総1Tパラメーター、トークンあたりアクティブ32B、レイヤーあたり384エキスパートのMoEです。kimi-k2.5は256Kコンテキストとネイティブマルチモーダル入力を持ち、kimi-k2.6はSWE-bench Proで58.6%を記録します。これらのK2の説明はkimi-k3には当てはまりません。

RunAPI経由でKimiを呼び出せるSDKは?

OpenAI Chat Completions、OpenAI Responses、Anthropic Messages、Gemini nativeのいずれかのインターフェースを使い、選択したKimiモデルIDを渡してください。

Kimiはどのように課金されますか?

各Kimiモデルの現在の価格は、RunAPI catalogの各モデルページでご確認ください。

このモデルはどう呼び出しますか?

model skill をインストールし、RunAPI key とセットアップメモに従ってください。

失敗した生成は課金されますか?

失敗した生成は課金されません

類似モデル

Kimi に近いモデル

Kimi で構築を開始。