Z.ai

GLM 5 turbo

Text

Geschwindigkeitsoptimierte GLM-5-Stufe für niedrigere Latenz

Eingabe $1.20 / 1 Mio. Tokens | Ausgabe $2.00 / 1 Mio. Tokens GLM 5 turbo Dokumentation lesen →
Modellgesundheit Unzureichende Daten
curl -X POST https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5-turbo",
  "messages": [
    {
      "role": "user",
      "content": "Lies dieses Repository mit mehreren Dateien, finde den fehlschlagenden Integrationstest und schlage einen Patch mit Erklärung der Ursache vor."
    }
  ]
}'
https://runapi.ai 1 endpoint

9 Versionen verfügbar

Playground

GLM 5 turbo ausprobieren

Wähle ein Modell und generiere in Sekunden.

Geschätzt: Eingabe $1.20 / 1 Mio. Tokens | Ausgabe $2.00 / 1 Mio. Tokens

Zum Generieren mit RunAPI einloggen.

Anmelden zum Generieren

Melde dich an, um mit deinen verfügbaren Sprachmodellen zu beginnen.

Specifications

DATENBLATT

Anbieter Z.ai
Modell-ID glm-5-turbo
Modalität Text
Aufgabentypen Synchronous
API-Endpunkt /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/glm-5-turbo:generateContent
/v1beta/models/glm-5-turbo:streamGenerateContent
Abrechnungseinheit 1K-Token
Katalogstatus Betriebsbereit
SO FUNKTIONIERT ES

Dieses Modell in 3 Schritten verwenden

  1. API-Schlüssel erstellen

    Registriere dich kostenlos und erstelle im Dashboard einen API-Schlüssel für glm-5-turbo.

  2. Anfrage senden

    Sende eine POST-Anfrage an /v1/chat/completions mit der Modell-ID glm-5-turbo und deinen Parametern.

  3. Ergebnisse abrufen

    Lies die fertige glm-5-turbo-Antwort direkt vom Endpoint.

Was dieses Modell bietet

Endpoint-Abdeckung

Stellt 1 öffentliche(n) Endpoint(s) bereit: chat_completion.

Nutzungsbasierte Abrechnung

Gemessen nach 1K-Token, ohne Abo-Anforderung.

GLM 5 turbo PREISE

Endpunkt
Auflösung
Dauer
Preis
chat_completion
Nicht verfügbar
1K-Token
Eingabe: $1.20 / 1 Mio. Tokens Ausgabe: $2.00 / 1 Mio. Tokens
  • Cache-Lesen: $0.24 / 1 Mio. Tokens
  • Cache-Schreiben (5 Min.): Kostenlos / 1 Mio. Tokens
  • Cache-Schreiben (1 Std.): Kostenlos / 1 Mio. Tokens
API-REFERENZ

Endpunktspezifikation

Endpunkt
POST /v1/chat/completions
Modell-ID
glm-5-turbo
Aufgabentypen
chat_completion
Maximale Dauer
Nicht verfügbar
Auflösungen
Nicht verfügbar
Seitenverhältnisse
Nicht verfügbar
Ausgabeformat
Nicht verfügbar
Durchschnittliche Generierungszeit
Nicht verfügbar

Anfrageparameter

Für diesen Endpunkt sind keine Anfrageparameter veröffentlicht.

ANWENDUNGSFÄLLE

Chat

Nutze LLMs für Chat und Reasoning.

Code

Generiere und prüfe Implementierungsarbeit.

Automatisierung

Verbinde Modelle mit Backend-Tasks.

FAQ

Häufige Fragen zu GLM 5 turbo

Wie wähle ich glm-5-turbo aus?

Übergib die im Quickstart angezeigte Modell-ID.

Sind die Preise nutzungsbasiert?

Ja. Preise werden pro Aufruf oder Einheit gemessen.

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen