Jedno uwierzytelnienie, wszyscy providerzy
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
Korzystaj z API Kimi przez RunAPI z model skillem, wspólnym uwierzytelnianiem i cennikiem pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Zaplanuj i zaimplementuj małe narzędzie CLI, utwórz szkielet projektu, napisz komendy, dodaj testy i uruchamiaj je, aż przejdą."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Zaplanuj i zaimplementuj małe narzędzie CLI, utwórz szkielet projektu, napisz komendy, dodaj testy i uruchamiaj je, aż przejdą."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Zaplanuj i zaimplementuj małe narzędzie CLI, utwórz szkielet projektu, napisz komendy, dodaj testy i uruchamiaj je, aż przejdą." }]
});
Kimi to rodzina modeli językowych Moonshot AI. kimi-k3 jest obecnym modelem flagowym i zawsze korzysta z rozumowania. Pierwsza wersja w RunAPI obsługuje proste żądania tekstowe, synchronicznie lub przez SSE. kimi-k2.5 i kimi-k2.6 pozostają dostępne; architektura 1T MoE i benchmarki dotyczą wyłącznie starszych modeli K2.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Wariant | Rozliczenia | Cennik | |
|---|---|---|---|
| kimi-k2.5 | 1 tys. tokenów | Wejście $0.60 / 1M tokenów | Wyjście $3.00 / 1M tokenów | Zobacz → |
| kimi-k2.6 | 1 tys. tokenów | Wejście $0.95 / 1M tokenów | Wyjście $4.00 / 1M tokenów | Zobacz → |
| kimi-k2.7-code | 1 tys. tokenów | Wejście $0.57 / 1M tokenów | Wyjście $2.40 / 1M tokenów | Zobacz → |
| kimi-k3 | 1 tys. tokenów | Wejście $3.00 / 1M tokenów | Wyjście $15.00 / 1M tokenów | Zobacz → |
| Endpoint | Rozdzielczość | Czas trwania | Cena | |
|---|---|---|---|---|
| chat_completion | — | — | Wejście $0.60 / 1M tokenów | Wyjście $3.00 / 1M tokenów |
Ceny podane dla kimi-k2.5. Pozostałe warianty mają własne cenniki endpointów.
Wybierz model i wariant pasujące do typu wyjścia, progu jakości i celu opóźnienia.
Ustaw klucz RunAPI i zainstaluj model skill w workspace kodu.
Użyj instrukcji skilla, aby dodać funkcję modelu w swojej aplikacji.
Odpytuj po task ID, streamuj gdy wspierane albo obsłuż callback webhook.
kimi-k3 to obecny model flagowy Kimi z zawsze włączonym rozumowaniem. W pierwszej wersji RunAPI jest dostępny dla prostych żądań tekstowych, synchronicznie lub przez SSE. Używaj OpenAI Chat Completions, OpenAI Responses, Anthropic Messages albo Gemini native z tym samym kluczem RunAPI; kimi-k2.5 i kimi-k2.6 również pozostają dostępne.
Jeden klucz RunAPI odblokowuje cały katalog. Bez osobnych kont i rotacji kluczy dla każdej integracji.
Rozliczanie za wywołanie w USD, fakturowane co miesiąc. Nieudane generacje nie są naliczane.
Typowane schematy i notatki setupu są spakowane w model skill, więc implementacja startuje od właściwego kontraktu.
kimi-k3 jest obecnym modelem flagowym i zawsze korzysta z rozumowania. Pierwsza wersja RunAPI skupia się na prostych zadaniach tekstowych, synchronicznie lub przez SSE; kimi-k2.5 i kimi-k2.6 pozostają dostępne.
Ta sama architektura MoE 1T. kimi-k2.5 dodał natywne wejście multimodalne (vision + text). kimi-k2.6 to dopracowanie post-training ze stabilniejszą pracą długohoryzontową, SWE-bench Pro rośnie z 50.7% do 58.6%, a Agent Swarm skaluje się ze 100 do 300 sub-agentów.
Użyj OpenAI Chat Completions, OpenAI Responses, Anthropic Messages albo Gemini native z kluczem RunAPI i identyfikatorem Kimi, w tym kimi-k3.
Aktualne informacje o rozliczeniu znajdziesz na stronie katalogu RunAPI każdego modelu Kimi, w tym kimi-k3.
Wybierz najtańszy wariant, który spełnia Twoje wymagania jakościowe. Większość zespołów zaczyna od szybkiego wariantu, a do produkcji przechodzi na pro.
Utworzenie konta i klucza API jest bezpłatne. Wywołania API są rozliczane według zużycia z przedpłaconego salda; doładuj je przed wysłaniem żądań.