It looks like you may prefer a different language. Switch anytime.

Text Moonshot AI

Kimi API

Use a API do Kimi via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.

runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "kimi-k3",
  "messages": [
    {
      "role": "user",
      "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="kimi-k3",
    messages=[{"role": "user", "content": "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "kimi-k3",
  messages: [{ role: "user", content: "Planeje e implemente uma pequena ferramenta CLI, crie o scaffold do projeto, escreva os comandos, adicione testes e rode até passarem." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Sobre Kimi

Kimi é a família de modelos de linguagem da Moonshot AI. kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão no RunAPI aceita solicitações simples de texto, de forma síncrona ou por SSE. kimi-k2.5 e kimi-k2.6 continuam disponíveis; a arquitetura MoE de 1T e os benchmarks associados pertencem especificamente aos modelos K2 anteriores.

Provedor
Moonshot AI
Modalidade
Text

Endpoints da API Kimi

EndpointProtocol
POST /v1/chat/completionsOpenAI compatible
POST /v1/responsesOpenAI Responses
POST /v1/messagesAnthropic compatible
POST /v1beta/models/{model}:generateContentGemini generateContent
POST /v1beta/models/{model}:streamGenerateContentGemini streamGenerateContent

Variantes

Variante Cobrança Preços
kimi-k2.5 1K tokens Input $0.60 / 1M tokens | Output $3.00 / 1M tokens Ver →
kimi-k2.6 1K tokens Input $2.55 / 1M tokens | Output $10.57 / 1M tokens Ver →
kimi-k2.7-code 1K tokens Input $0.57 / 1M tokens | Output $2.40 / 1M tokens Ver →
kimi-k3 1K tokens Input $1.80 / 1M tokens | Output $9.00 / 1M tokens Ver →
PREÇOS

Preços de Kimi

Endpoint Resolução Duração Preço
chat_completion Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

Preços exibidos para kimi-k2.5. Outras variantes mantêm seus próprios preços por endpoint.

Integração com agentes

Execute Kimi a partir de um agente

COMO FUNCIONA

Comece com Kimi

  1. Escolha o modelo

    Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

  2. Autentique uma vez

    Use sua chave RunAPI para todos os modelos compatíveis.

  3. Instale o skill

    Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

  4. Receba a saída

    Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde Kimi se encaixa

kimi-k3 é o atual modelo principal Kimi com raciocínio sempre ativo. Na primeira versão do RunAPI, ele está disponível para solicitações simples de texto, de forma síncrona ou por SSE. Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com a mesma chave RunAPI; kimi-k2.5 e kimi-k2.6 também continuam disponíveis.

Provedor
Moonshot AI
Ver tudo →
Modalidade
Text
Explorar modelos →

Por que usar Kimi pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

Perguntas sobre Kimi

Para que o Kimi é otimizado?

kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão do RunAPI é voltada a tarefas simples de texto, de forma síncrona ou por SSE; kimi-k2.5 e kimi-k2.6 continuam disponíveis.

Qual é a diferença entre kimi-k2.5 e kimi-k2.6?

Mesma arquitetura MoE 1T. kimi-k2.5 adicionou entrada multimodal nativa (visão + texto). kimi-k2.6 é um refinamento de post-training com estabilidade de longo horizonte mais forte — SWE-bench Pro salta de 50,7% para 58,6%, e Agent Swarm escala de 100 para 300 sub-agentes.

Quais SDKs podem chamar Kimi pelo RunAPI?

Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com sua chave RunAPI e o id do modelo Kimi, incluindo kimi-k3.

Como o Kimi é cobrado?

Consulte a página do catálogo RunAPI de cada modelo Kimi, incluindo kimi-k3, para informações atuais de cobrança.

Como chamo este modelo?

Instale o model skill e siga as notas de setup com sua chave RunAPI.

Gerações com falha custam dinheiro?

Gerações com falha não são cobradas

MODELOS SIMILARES

Modelos similares a Kimi

Comece a construir com Kimi.