Kimi API
Acesso à API Moonshot AI Kimi via RunAPI, com kimi-k3 como o atual modelo principal com raciocínio sempre ativo.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-k3",
"messages": [
{
"role": "user",
"content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "kimi-k3",
messages: [{ role: "user", content: "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem." }]
});
Kimi é a família de modelos de linguagem da Moonshot AI. kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão no RunAPI aceita solicitações simples de texto, de forma síncrona ou por SSE. kimi-k2.5 e kimi-k2.6 continuam disponíveis; a arquitetura MoE de 1T e os benchmarks associados pertencem especificamente aos modelos K2 anteriores.
- Variantes para diferentes metas de qualidade e latência
- API key unificada
- O model skill inclui documentação, schemas e notas de setup
- Gerações com falha não são cobradas
Variantes
| Variant | Billing | Pricing | |
|---|---|---|---|
| kimi-k2.5 | 1K tokens | Input $0.60 / 1M tokens | Output $3.00 / 1M tokens | Ver → |
| kimi-k2.6 | 1K tokens | Input $2.55 / 1M tokens | Output $10.57 / 1M tokens | Ver → |
| kimi-k2.7-code | 1K tokens | Input $0.57 / 1M tokens | Output $2.40 / 1M tokens | Ver → |
| kimi-k3 | 1K tokens | Input $1.80 / 1M tokens | Output $9.00 / 1M tokens | Ver → |
Endpoints da API Kimi
Use o SDK OpenAI ou Anthropic com sua chave RunAPI. Nenhum SDK extra necessário.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
Como construir com este model skill
Escolha o modelo
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Autentique uma vez
Use sua chave RunAPI para todos os modelos compatíveis.
Instale o skill
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Receba a saída
Consulte por task ID ou trate o callback quando a geração terminar.
Onde Kimi se encaixa
kimi-k3 é o atual modelo principal Kimi com raciocínio sempre ativo. Na primeira versão do RunAPI, ele está disponível para solicitações simples de texto, de forma síncrona ou por SSE. Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com a mesma chave RunAPI; kimi-k2.5 e kimi-k2.6 também continuam disponíveis.
Por que usar Kimi pela RunAPI
Uma API key
Use as mesmas credenciais entre modelos e provedores.
Pronto para skills
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
Cobrança previsível
O preço por uso fica visível antes da chamada.
Perguntas frequentes
Para que o Kimi é otimizado?
kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão do RunAPI é voltada a tarefas simples de texto, de forma síncrona ou por SSE; kimi-k2.5 e kimi-k2.6 continuam disponíveis.
Qual é a diferença entre kimi-k2.5 e kimi-k2.6?
Mesma arquitetura MoE 1T. kimi-k2.5 adicionou entrada multimodal nativa (visão + texto). kimi-k2.6 é um refinamento de post-training com estabilidade de longo horizonte mais forte — SWE-bench Pro salta de 50,7% para 58,6%, e Agent Swarm escala de 100 para 300 sub-agentes.
Quais SDKs podem chamar Kimi pelo RunAPI?
Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com sua chave RunAPI e o id do modelo Kimi, incluindo kimi-k3.
Como o Kimi é cobrado?
Consulte a página do catálogo RunAPI de cada modelo Kimi, incluindo kimi-k3, para informações atuais de cobrança.
Como chamo este modelo?
Instale o model skill e siga as notas de setup com sua chave RunAPI.
Gerações com falha custam dinheiro?
Gerações com falha não são cobradas
Posso chamar a partir da minha aplicação?
Sim. Instale o model skill no workspace de código e use durante a implementação da funcionalidade.