Versioni ed endpoint pubblici
| ID modello | Endpoint | Prezzo iniziale | Catalogo |
|---|---|---|---|
kimi-k2.5
|
/v1/chat/completions
|
$0.60 / 1M di token | Dettagli modello |
kimi-k2.6
|
/v1/chat/completions
|
$0.95 / 1M di token | Dettagli modello |
kimi-k2.7-code
|
/v1/chat/completions
|
$0.57 / 1M di token | Dettagli modello |
kimi-k3
|
/v1/chat/completions
|
$3.00 / 1M di token | Dettagli modello |
Verifica
Esegui il polling finché la Task non raggiunge uno stato terminale
Seleziona <model-id> per generare i comandi di verifica.
Configurazione
Endpoint della guida: <endpoint>
Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.
Inizia in 3 passaggi
-
Scegli un ID modello
Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.
-
Configura RunAPI
Aggiungi la configurazione del provider per questo agente.
-
Verifica il risultato
Esegui i comandi di stato e selezione del modello mostrati sotto.
Cosa puoi creare con Hermes Agent + Kimi
-
Programmazione e ragionamento con agenti
Lascia che il tuo agente pianifichi, scriva e revisioni codice o risolva problemi in più passaggi con il ragionamento del modello.
-
Analisi ed estrazione da documenti lunghi
Riassumi report, contratti o codebase ed estrai campi strutturati da documenti lunghi.
-
Workflow con chiamate a strumenti
Collega il modello a funzioni e API perché il tuo agente possa consultare dati ed eseguire azioni tra una risposta e l'altra.
Perché usare Kimi con RunAPI + Hermes Agent
-
4 varianti, una chiave API
Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.
-
Prezzi d'uso chiari
Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.
-
Risposte dirette
Le chiamate sincrone restituiscono il risultato nella stessa risposta, così il tuo agente può usarlo subito senza interrogare lo stato di un task.
Domande su Hermes Agent + Kimi
Da quale modello Kimi dovrei iniziare?
Inizia con kimi-k3, l'attuale modello di punta con ragionamento sempre attivo. kimi-k2.5 e kimi-k2.6 restano disponibili per i casi d'uso K2 esistenti.
Qual è la differenza tra kimi-k2.5 e kimi-k2.6?
Stessa architettura MoE da 1T. kimi-k2.5 ha aggiunto input multimodale nativo, visione più testo. kimi-k2.6 è un affinamento post-training con maggiore stabilità a lungo orizzonte, SWE-bench Pro sale dal 50,7% al 58,6% e Agent Swarm scala da 100 a 300 sotto-agenti.
Quali API possono chiamare Kimi tramite RunAPI?
Usa OpenAI Chat Completions, OpenAI Responses, Anthropic Messages o le API Gemini native con un model id Kimi. La prima versione di kimi-k3 supporta testo di base con risposte sincrone e streaming SSE.
Come viene fatturato Kimi?
Consulta la pagina del catalogo RunAPI di ciascun modello Kimi per i prezzi attuali.
Quale ID modello devo usare?
Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.
Questa guida configura un modello di chat?
Sì. Questa linea di modelli supporta un protocollo LLM rivolto al client.