Moonshot AI · Text

Hermes Agent x Kimi

kimi-k3 ist Kimis aktuelles Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben verfügbar; ihre ältere K2-Architektur hat 1T Parameter und 256K Kontext, und 58,6 % auf SWE-bench Pro gehören zu kimi-k2.6. Kimi ist über OpenAI Chat Completions, OpenAI Responses, Anthropic Messages und Gemini Native APIs verfügbar. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

4 variants ab $0.57 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende kimi-k2.5, wenn es zur Aufgabe passt: 1T / 32B aktiv; 256K Kontext; native multimodale Eingabe.

You have access to RunAPI chat models for Kimi.

Available Kimi models:
- kimi-k2.5: 1T / 32B aktiv; 256K Kontext; native multimodale Eingabe
  chat endpoints: /v1/chat/completions
- kimi-k2.6: 1T / 32B aktiv; 256K Kontext; 58,6 % SWE-bench Pro; 300-Agent-Swarm
  chat endpoints: /v1/chat/completions
- kimi-k2.7-code: Spezielles Coding-Modell; permanentes Thinking; 256K Kontext
  chat endpoints: /v1/chat/completions
- kimi-k3: Aktuelles Kimi-Flaggschiff mit dauerhaft aktiviertem Reasoning
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Plane und implementiere ein kleines CLI-Tool, erstelle das Projektgerüst, schreibe die Commands, füge Tests hinzu und führe sie aus, bis sie bestehen.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
kimi-k2.5
/v1/chat/completions
$0.60 / 1 Mio. Tokens Modelldetails
kimi-k2.6
/v1/chat/completions
$0.95 / 1 Mio. Tokens Modelldetails
kimi-k2.7-code
/v1/chat/completions
$0.57 / 1 Mio. Tokens Modelldetails
kimi-k3
/v1/chat/completions
$3.00 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + Kimi bauen kannst

  • Coding und Reasoning mit Agenten

    Lass deinen Agenten Code planen, schreiben und prüfen oder mehrstufige Probleme mit dem Reasoning des Modells lösen.

  • Analyse und Extraktion langer Dokumente

    Fasse Berichte, Verträge oder Codebasen zusammen und extrahiere strukturierte Felder aus langen Dokumenten.

  • Workflows mit Tool-Aufrufen

    Verbinde das Modell mit Funktionen und APIs, damit dein Agent zwischen Antworten Daten abrufen und Aktionen ausführen kann.

Warum Kimi über RunAPI + Hermes Agent nutzen

  • 4 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Direkte Antworten

    Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.

Fragen zu Hermes Agent + Kimi

Mit welchem Kimi-Modell sollte ich beginnen?

Beginne mit kimi-k3, Kimis aktuellem Flaggschiff mit dauerhaft aktiviertem Reasoning. kimi-k2.5 und kimi-k2.6 bleiben für bestehende K2-Anwendungsfälle verfügbar.

Was ist der Unterschied zwischen kimi-k2.5 und kimi-k2.6?

Beide sind ältere K2-Modelle mit derselben 1T-MoE-Architektur. kimi-k2.5 fügte native multimodale Eingabe hinzu; kimi-k2.6 verbesserte das Post-Training und erreichte 58,6 % auf SWE-bench Pro. kimi-k3 ist das aktuelle Flaggschiff mit dauerhaft aktiviertem Reasoning.

Welche APIs können Kimi über RunAPI aufrufen?

Verwende OpenAI Chat Completions, OpenAI Responses, Anthropic Messages oder Gemini Native APIs mit einer Kimi-Modell-ID. Die erste RunAPI-Version von kimi-k3 unterstützt einfache Textanfragen mit synchronen und SSE-Streaming-Antworten.

Wie wird Kimi abgerechnet?

Aktuelle Preise finden Sie auf der RunAPI-Katalogseite des jeweiligen Kimi-Modells.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

Kimi mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen