Moonshot AI · Text

Hermes Agent x Kimi

kimi-k3 è il modello di punta attuale di Kimi con ragionamento sempre attivo. kimi-k2.5 e kimi-k2.6 restano disponibili; la loro architettura K2 precedente ha 1T parametri e 256K di contesto, e il 58,6% su SWE-bench Pro appartiene a kimi-k2.6. Kimi è disponibile tramite OpenAI Chat Completions, OpenAI Responses, Anthropic Messages e Gemini native APIs. La prima versione RunAPI di kimi-k3 supporta richieste di testo di base con risposte sincrone e streaming SSE.

Versioni ed endpoint pubblici

ID modelloVersioneEndpointPrezzo inizialeCatalogo
kimi-k2.51T / 32B attivi, 256K di contesto, input multimodale nativo
/v1/chat/completions
$0.0006Dettagli modello
kimi-k2.61T / 32B attivi, 256K di contesto, 58,6% SWE-bench Pro, swarm da 300 agenti
/v1/chat/completions
$0.0026Dettagli modello
kimi-k2.7-codeModello dedicato al coding, thinking sempre attivo, contesto 256K
/v1/chat/completions
$0.0006Dettagli modello
kimi-k3Modello di punta Kimi con ragionamento sempre attivo
/v1/chat/completions
$0.0018Dettagli modello

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.

Verifica

Seleziona <model-id> per generare i comandi di verifica.

Come funziona

  1. 1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. 2. Configura RunAPI

    Aggiungi la configurazione del provider per questo agente.

  3. 3. Verifica il risultato

    Esegui i comandi di stato e selezione del modello mostrati sotto.

Domande frequenti

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

Sì. Questa linea di modelli supporta un protocollo LLM rivolto al client.