1つの API key
モデルやプロバイダーをまたいで同じ認証情報を使えます。
It looks like you may prefer a different language. Switch anytime.
RunAPIのモデルスキル、統合認証、従量課金制の料金でKimi APIを利用できます。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "小さなCLIツールを計画して実装してください:プロジェクトをスキャフォールドし、コマンドを書き、テストを追加し、すべてパスするまで実行してください。" }]
});
Kimiシリーズの現在のフラッグシップはkimi-k3で、推論が常時有効です。RunAPIでの初期提供は基本的なテキスト同期とSSEで、kimi-k2.5とkimi-k2.6も引き続き利用できます。総1Tパラメーター、トークンあたりアクティブ32B、レイヤーあたり384エキスパートのMoEとSWE-bench Pro 58.6%はK2に関する事実で、後者はkimi-k2.6のものです。
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| バリアント | 請求 | 料金 | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | 見る → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | 見る → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | 見る → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | 見る → |
| Endpoint | 解像度 | 尺 | 価格 | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens |
kimi-k2.5 の料金を表示しています。他のバリアントはそれぞれの endpoint 料金が適用されます。
出力タイプ、品質基準、レイテンシ目標に合うモデルとバリアントを選びます。
対応するすべてのモデルに RunAPI key を使います。
機能実装の前に model skill をコード作業環境へ追加します。
task ID でポーリングするか、生成完了時の callback を処理します。
モデルやプロバイダーをまたいで同じ認証情報を使えます。
model skill に schema、セットアップメモ、料金コンテキスト、モデル ID が含まれます。
呼び出し前に従量料金を確認できます。
kimi-k3です。推論が常時有効で、RunAPIでの初期提供は基本的なテキスト同期とSSEです。
どちらもK2アーキテクチャです。K2は総1Tパラメーター、トークンあたりアクティブ32B、レイヤーあたり384エキスパートのMoEです。kimi-k2.5は256Kコンテキストとネイティブマルチモーダル入力を持ち、kimi-k2.6はSWE-bench Proで58.6%を記録します。これらのK2の説明はkimi-k3には当てはまりません。
OpenAI Chat Completions、OpenAI Responses、Anthropic Messages、Gemini nativeのいずれかのインターフェースを使い、選択したKimiモデルIDを渡してください。
各Kimiモデルの現在の価格は、RunAPI catalogの各モデルページでご確認ください。
model skill をインストールし、RunAPI key とセットアップメモに従ってください。
失敗した生成は課金されません