Versões e endpoints públicos
| ID do modelo | Endpoints | Preço inicial | Catálogo |
|---|---|---|---|
kimi-k2.5
|
/v1/chat/completions
|
$0.60 / 1M de tokens | Detalhes do modelo |
kimi-k2.6
|
/v1/chat/completions
|
$0.95 / 1M de tokens | Detalhes do modelo |
kimi-k2.7-code
|
/v1/chat/completions
|
$0.57 / 1M de tokens | Detalhes do modelo |
kimi-k3
|
/v1/chat/completions
|
$3.00 / 1M de tokens | Detalhes do modelo |
Verificar
Consulte até que a Task alcance um estado final
Selecione <model-id> para gerar os comandos de verificação.
Configuração
Endpoint do guia: <endpoint>
Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Comece em 3 passos
-
Escolha um ID de modelo
Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.
-
Configure o RunAPI
Adicione a configuração do provedor para este agente.
-
Verifique o resultado
Execute os comandos de status e seleção de modelo mostrados abaixo.
O que criar com Hermes Agent + Kimi
-
Programação e raciocínio com agentes
Deixe seu agente planejar, escrever e revisar código ou resolver problemas de várias etapas com o raciocínio do modelo.
-
Análise e extração de documentos longos
Resuma relatórios, contratos ou bases de código e extraia campos estruturados de documentos longos.
-
Fluxos com chamadas de ferramentas
Conecte o modelo a funções e APIs para que seu agente consulte dados e execute ações entre as respostas.
Por que usar Kimi pelo RunAPI + Hermes Agent
-
4 variantes, uma chave de API
Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.
-
Preços de uso claros
Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.
-
Respostas diretas
Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.
Perguntas sobre Hermes Agent + Kimi
Para que o Kimi é otimizado?
kimi-k3 é o atual modelo principal e usa raciocínio sempre ativo. A primeira versão do RunAPI é voltada a tarefas simples de texto, de forma síncrona ou por SSE; kimi-k2.5 e kimi-k2.6 continuam disponíveis.
Qual é a diferença entre kimi-k2.5 e kimi-k2.6?
Mesma arquitetura MoE 1T. kimi-k2.5 adicionou entrada multimodal nativa (visão + texto). kimi-k2.6 é um refinamento de post-training com estabilidade de longo horizonte mais forte — SWE-bench Pro salta de 50,7% para 58,6%, e Agent Swarm escala de 100 para 300 sub-agentes.
Quais SDKs podem chamar Kimi pelo RunAPI?
Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com sua chave RunAPI e o id do modelo Kimi, incluindo kimi-k3.
Como o Kimi é cobrado?
Consulte a página do catálogo RunAPI de cada modelo Kimi, incluindo kimi-k3, para informações atuais de cobrança.
Qual ID de modelo devo usar?
Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.
Este guia configura um modelo de chat?
Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.