Z.ai

GLM 5 turbo

Testo

Tier GLM-5 ottimizzato per velocità e latenza più bassa

Input $1.20 / 1M di token | Output $2.00 / 1M di token GLM 5 turbo Riferimento API →
Stato del modello Dati insufficienti
curl -X POST https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5-turbo",
  "messages": [
    {
      "role": "user",
      "content": "Leggi questo repository multi-file, trova il test di integrazione che fallisce e proponi una patch spiegando la causa principale."
    }
  ]
}'
https://runapi.ai 1 endpoint

9 versioni disponibili

Playground

Prova GLM 5 turbo

Scegli un modello e genera in pochi secondi.

Stimato: Input $1.20 / 1M di token | Output $2.00 / 1M di token

Accedi per generare con RunAPI.

Accedi per generare

Accedi per iniziare a generare con i modelli linguistici disponibili.

Specifiche

Dettagli tecnici

Provider Z.ai
ID modello glm-5-turbo
Modalità Testo
Tipi di attività Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/glm-5-turbo:generateContent
/v1beta/models/glm-5-turbo:streamGenerateContent
Unità di fatturazione 1K token
Stato del catalogo Operativo
COME FUNZIONA

Usa questo modello in 3 passaggi

  1. Crea la tua chiave

    Registrati gratuitamente e crea una chiave API per glm-5-turbo dalla dashboard.

  2. Invia una richiesta

    Invia una richiesta POST a /v1/chat/completions con l’identificatore del modello glm-5-turbo e i tuoi parametri.

  3. Ottieni i risultati

    Leggi direttamente dall’endpoint la risposta completata di glm-5-turbo.

Cosa offre questo modello

Copertura endpoint

Espone 1 endpoint pubblici: chat_completion.

Fatturazione a consumo

Misurata in base a 1K token, senza requisito di abbonamento.

GLM 5 turbo Prezzi

Endpoint
Risoluzione
Durata
Prezzo
chat_completion
Non disponibile
1K token
Input: $1.20 / 1M di token Output: $2.00 / 1M di token
  • Lettura cache: $0.24 / 1M di token
  • Scrittura cache (5 min): Gratis / 1M di token
  • Scrittura cache (1 h): Gratis / 1M di token
RIFERIMENTO API

Specifiche dell'endpoint

Endpoint
POST /v1/chat/completions
ID modello
glm-5-turbo
Tipi di attività
chat_completion
Durata massima
Non disponibile
Risoluzioni
Non disponibile
Proporzioni
Non disponibile
Formato di output
Non disponibile
Tempo medio di generazione
Non disponibile

Parametri della richiesta

Nessun parametro della richiesta è pubblicato per questo endpoint.

CASI D'USO

Customer support

Rispondi alle domande dei clienti partendo da una knowledge base privata, riducendo il volume dei ticket.

Analisi documentale

Redigi riepiloghi di contratti e segnala le clausole chiave per la revisione dell'avvocato.

Generazione di codice

Genera automaticamente test unitari, code review e suggerimenti di refactoring in CI.

FAQ

Domande frequenti su GLM 5 turbo

Come seleziono glm-5-turbo?

Passa l'ID del modello mostrato nel quickstart.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci