Text · Moonshot AI

Kimi API

Acesso à API Moonshot AI Kimi via RunAPI, com kimi-k3 como o atual modelo principal com raciocínio sempre ativo.

Operacional · 4 variants · a partir de $0.0006
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Kimi é a família de modelos de linguagem da Moonshot AI. kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão no RunAPI aceita solicitações simples de texto, de forma síncrona ou por SSE. kimi-k2.5 e kimi-k2.6 continuam disponíveis; a arquitetura MoE de 1T e os benchmarks associados pertencem especificamente aos modelos K2 anteriores.

  • Variantes para diferentes metas de qualidade e latência
  • API key unificada
  • O model skill inclui documentação, schemas e notas de setup
  • Gerações com falha não são cobradas
VARIANTES

Variantes

Variant Billing Pricing
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Ver →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Ver →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Ver →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Ver →
API

Endpoints da API Kimi

Use o SDK OpenAI ou Anthropic com sua chave RunAPI. Nenhum SDK extra necessário.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
COMO FUNCIONA

Como construir com este model skill

01

Escolha o modelo

Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

02

Autentique uma vez

Use sua chave RunAPI para todos os modelos compatíveis.

03

Instale o skill

Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

04

Receba a saída

Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde Kimi se encaixa

kimi-k3 é o atual modelo principal Kimi com raciocínio sempre ativo. Na primeira versão do RunAPI, ele está disponível para solicitações simples de texto, de forma síncrona ou por SSE. Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com a mesma chave RunAPI; kimi-k2.5 e kimi-k2.6 também continuam disponíveis.

Provider
Moonshot AI
Modality
Text
POR QUE RUNAPI

Por que usar Kimi pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

FAQ

Perguntas frequentes

Para que o Kimi é otimizado?

kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão do RunAPI é voltada a tarefas simples de texto, de forma síncrona ou por SSE; kimi-k2.5 e kimi-k2.6 continuam disponíveis.

Qual é a diferença entre kimi-k2.5 e kimi-k2.6?

Mesma arquitetura MoE 1T. kimi-k2.5 adicionou entrada multimodal nativa (visão + texto). kimi-k2.6 é um refinamento de post-training com estabilidade de longo horizonte mais forte — SWE-bench Pro salta de 50,7% para 58,6%, e Agent Swarm escala de 100 para 300 sub-agentes.

Quais SDKs podem chamar Kimi pelo RunAPI?

Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com sua chave RunAPI e o id do modelo Kimi, incluindo kimi-k3.

Como o Kimi é cobrado?

Consulte a página do catálogo RunAPI de cada modelo Kimi, incluindo kimi-k3, para informações atuais de cobrança.

Como chamo este modelo?

Instale o model skill e siga as notas de setup com sua chave RunAPI.

Gerações com falha custam dinheiro?

Gerações com falha não são cobradas

Posso chamar a partir da minha aplicação?

Sim. Instale o model skill no workspace de código e use durante a implementação da funcionalidade.

COMEÇAR

Comece a construir com Kimi.