Z.ai · Text

Hermes Agent x GLM

GLM-Modelle von Z.ai sind MIT-lizenzierte MoE-LLMs mit 128K–200K Kontext. GLM-5.1 führt Open-Weight-Modelle auf SWE-bench Pro an. Über RunAPI teilen sie einen gemeinsamen API-Key mit nutzungsbasierter Token-Abrechnung und sind über OpenAI Chat Completions, OpenAI Responses und Anthropic Messages aufrufbar.

9 variants ab $0.10 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende glm-4.5, wenn es zur Aufgabe passt: 355B / 32B aktiv; 128K Kontext; Flagship-Open-Weight-MoE-Baseline.

You have access to RunAPI chat models for GLM.

Available GLM models:
- glm-4.5: 355B / 32B aktiv; 128K Kontext; Flagship-Open-Weight-MoE-Baseline
  chat endpoints: /v1/chat/completions
- glm-4.5-air: Leichtere GLM-4.5-Stufe für schnelle, günstigere Alltagsaufgaben
  chat endpoints: /v1/chat/completions
- glm-4.6: 200K Kontext; erstes GLM auf Cambricon-Chips; präzisere Code-Generierung
  chat endpoints: /v1/chat/completions
- glm-4.7: 200K Kontext; 73,8 % SWE-bench; persistentes Denken über Turns hinweg
  chat endpoints: /v1/chat/completions
- glm-5: 744B / 40B aktiv; 200K Kontext; 77,8 % SWE-bench Verified
  chat endpoints: /v1/chat/completions
- glm-5-turbo: Geschwindigkeitsoptimierte GLM-5-Stufe für niedrigere Latenz
  chat endpoints: /v1/chat/completions
- glm-5.1: 754B / 40B aktiv; 58,4 % SWE-bench Pro — höchster Open-Weight-Score
  chat endpoints: /v1/chat/completions
- glm-5.2: Aktuelles Flaggschiff-Basismodell für Textgenerierung
  chat endpoints: /v1/chat/completions
- glm-5.3: Neuestes GLM-Textmodell für OpenAI-kompatible Chat Completions
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
glm-4.5
/v1/chat/completions
$0.41 / 1 Mio. Tokens Modelldetails
glm-4.5-air
/v1/chat/completions
$0.10 / 1 Mio. Tokens Modelldetails
glm-4.6
/v1/chat/completions
$0.60 / 1 Mio. Tokens Modelldetails
glm-4.7
/v1/chat/completions
$0.60 / 1 Mio. Tokens Modelldetails
glm-5
/v1/chat/completions
$1.00 / 1 Mio. Tokens Modelldetails
glm-5-turbo
/v1/chat/completions
$1.20 / 1 Mio. Tokens Modelldetails
glm-5.1
/v1/chat/completions
$1.40 / 1 Mio. Tokens Modelldetails
glm-5.2
/v1/chat/completions
$0.70 / 1 Mio. Tokens Modelldetails
glm-5.3
/v1/chat/completions
$1.40 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + GLM bauen kannst

  • Produktdemo-Videos

    Erzeuge 5- bis 10-sekündige Produktanimationen aus Textbeschreibungen, ideal für E-Commerce und Social Ads.

  • KI-Avatar-Inhalte

    Erstelle Videos mit lippensynchronen Avataren für Schulungen, Kundensupport und Marketing.

  • Videos in Serie produzieren

    Stelle Hunderte von Videogenerierungen in eine Warteschlange und empfange Ergebnisse per Webhook.

Warum GLM über RunAPI + Hermes Agent nutzen

  • 9 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Automatische Task-Workflows

    Sende Tasks, frage ihren Status ab und sammle asynchrone Ergebnisse in einem einheitlichen Ablauf ohne eigenen Polling-Code.

Fragen zu Hermes Agent + GLM

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

GLM mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen