Moonshot AI · Text
Hermes Agent x Kimi
kimi-k3 é o atual modelo principal Kimi com raciocínio sempre ativo. Na primeira versão do RunAPI, ele está disponível para solicitações simples de texto, de forma síncrona ou por SSE. Use OpenAI Chat Completions, OpenAI Responses, Anthropic Messages ou Gemini native com a mesma chave RunAPI; kimi-k2.5 e kimi-k2.6 também continuam disponíveis.
Versões e endpoints públicos
| ID do modelo | Versão | Endpoints | Preço inicial | Catálogo |
|---|---|---|---|---|
kimi-k2.5 | 1T / 32B ativos; contexto 256K; entrada multimodal nativa | /v1/chat/completions | $0.0006 | Detalhes do modelo |
kimi-k2.6 | 1T / 32B ativos; contexto 256K; 58,6% SWE-bench Pro; swarm de 300 agentes | /v1/chat/completions | $0.0026 | Detalhes do modelo |
kimi-k2.7-code | Modelo dedicado a código; thinking sempre ativo; contexto de 256K | /v1/chat/completions | $0.0006 | Detalhes do modelo |
kimi-k3 | Modelo flagship atual da Kimi com raciocínio sempre ativo | /v1/chat/completions | $0.0018 | Detalhes do modelo |
Configuração
Endpoint do guia: <endpoint>
Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.Verificar
Selecione <model-id> para gerar os comandos de verificação.Como funciona
- 1. Escolha um ID de modelo
Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.
- 2. Configure o RunAPI
Adicione a configuração do provedor para este agente.
- 3. Verifique o resultado
Execute os comandos de status e seleção de modelo mostrados abaixo.
Perguntas frequentes
Qual ID de modelo devo usar?
Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.
Este guia configura um modelo de chat?
Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.