Uma API key
Use as mesmas credenciais entre modelos e provedores.
It looks like you may prefer a different language. Switch anytime.
Use a API do Kimi via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem." }]
});
Kimi é a família de modelos de linguagem da Moonshot AI. kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão no RunAPI aceita solicitações simples de texto, de forma síncrona ou por SSE. kimi-k2.5 e kimi-k2.6 continuam disponíveis; a arquitetura MoE de 1T e os benchmarks associados pertencem especificamente aos modelos K2 anteriores.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Cobrança | Preços | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | Ver → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | Ver → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | Ver → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | Ver → |
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| chat_completion | — | — | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens |
Preços exibidos para kimi-k2.5. Outras variantes mantêm seus próprios preços por endpoint.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
kimi-k3 é o atual modelo principal Kimi com raciocínio sempre ativo. Na primeira versão do RunAPI, ele está disponível para solicitações simples de texto, de forma síncrona ou por SSE. Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com a mesma chave RunAPI; kimi-k2.5 e kimi-k2.6 também continuam disponíveis.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão do RunAPI é voltada a tarefas simples de texto, de forma síncrona ou por SSE; kimi-k2.5 e kimi-k2.6 continuam disponíveis.
Mesma arquitetura MoE 1T. kimi-k2.5 adicionou entrada multimodal nativa (visão + texto). kimi-k2.6 é um refinamento de post-training com estabilidade de longo horizonte mais forte — SWE-bench Pro salta de 50,7% para 58,6%, e Agent Swarm escala de 100 para 300 sub-agentes.
Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com sua chave RunAPI e o id do modelo Kimi, incluindo kimi-k3.
Consulte a página do catálogo RunAPI de cada modelo Kimi, incluindo kimi-k3, para informações atuais de cobrança.
Instale o model skill e siga as notas de setup com sua chave RunAPI.
Gerações com falha não são cobradas