Publiczne wersje i endpointy
| ID modelu | Endpointy | Cena początkowa | Katalog |
|---|---|---|---|
kimi-k2.5
|
/v1/chat/completions
|
$0.60 / 1M tokenów | Szczegóły modelu |
kimi-k2.6
|
/v1/chat/completions
|
$0.95 / 1M tokenów | Szczegóły modelu |
kimi-k2.7-code
|
/v1/chat/completions
|
$0.57 / 1M tokenów | Szczegóły modelu |
kimi-k3
|
/v1/chat/completions
|
$3.00 / 1M tokenów | Szczegóły modelu |
Weryfikacja
Odpytywanie do momentu osiągnięcia przez Task stanu końcowego
Wybierz <model-id>, aby wygenerować polecenia weryfikacyjne.
Konfiguracja
Endpoint przewodnika: <endpoint>
Wybierz <model-id>, aby wygenerować żądanie zgodne z publicznym kontraktem wejściowym endpointu.
Zacznij w 3 krokach
-
Wybierz ID modelu
Wybierz publiczny ID modelu z katalogu i sprawdź jego endpoint oraz bieżącą cenę początkową.
-
Skonfiguruj RunAPI
Dodaj konfigurację dostawcy dla tego agenta.
-
Zweryfikuj wynik
Uruchom pokazane poniżej polecenia stanu i wyboru modelu.
Co możesz zbudować za pomocą Hermes Agent + Kimi
-
Programowanie i wnioskowanie z agentem
Pozwól agentowi planować, pisać i przeglądać kod lub rozwiązywać wieloetapowe problemy dzięki wnioskowaniu modelu.
-
Analiza i ekstrakcja z długich dokumentów
Streszczaj raporty, umowy lub bazy kodu i wyodrębniaj ustrukturyzowane pola z długich dokumentów.
-
Przepływy z wywołaniami narzędzi
Połącz model z funkcjami i API, aby agent mógł między odpowiedziami pobierać dane i wykonywać działania.
Dlaczego warto używać Kimi przez RunAPI + Hermes Agent
-
4 wariantów, jeden klucz API
Korzystaj z jednego połączenia RunAPI, aby wybierać spośród dostępnych wariantów modelu bez zmiany integracji.
-
Przejrzyste ceny użycia
Sprawdź aktualne ceny w katalogu przed wysłaniem żądania, bez subskrypcji i minimalnych wydatków.
-
Bezpośrednie odpowiedzi
Wywołania synchroniczne zwracają wynik w tej samej odpowiedzi, więc agent może od razu go użyć bez odpytywania o stan zadania.
Pytania o Hermes Agent + Kimi
Do czego Kimi jest zoptymalizowany?
kimi-k3 jest obecnym modelem flagowym i zawsze korzysta z rozumowania. Pierwsza wersja RunAPI skupia się na prostych zadaniach tekstowych, synchronicznie lub przez SSE; kimi-k2.5 i kimi-k2.6 pozostają dostępne.
Czym różnią się kimi-k2.5 i kimi-k2.6?
Ta sama architektura MoE 1T. kimi-k2.5 dodał natywne wejście multimodalne (vision + text). kimi-k2.6 to dopracowanie post-training ze stabilniejszą pracą długohoryzontową, SWE-bench Pro rośnie z 50.7% do 58.6%, a Agent Swarm skaluje się ze 100 do 300 sub-agentów.
Które SDK mogą wywoływać Kimi przez RunAPI?
Użyj OpenAI Chat Completions, OpenAI Responses, Anthropic Messages albo Gemini native z kluczem RunAPI i identyfikatorem Kimi, w tym kimi-k3.
Jak rozliczany jest Kimi?
Aktualne informacje o rozliczeniu znajdziesz na stronie katalogu RunAPI każdego modelu Kimi, w tym kimi-k3.
Którego ID modelu użyć?
Wybierz publiczny ID modelu z tabeli wersji. Każdy ID udostępnia endpointy pokazane w jego wierszu.
Czy ten przewodnik konfiguruje model czatu?
Tak. Ta linia modeli obsługuje protokół LLM przeznaczony dla klienta.