Z.ai

GLM 5 turbo

Tekst

GLM-5 zoptymalizowany pod szybkość i niższe opóźnienia

Wejście $1.20 / 1M tokenów | Wyjście $2.00 / 1M tokenów GLM 5 turbo Dokumentacja API →
Kondycja modelu Niewystarczające dane
curl -X POST https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm-5-turbo",
  "messages": [
    {
      "role": "user",
      "content": "Przeczytaj to repozytorium z wielu plików, znajdź padający test integracyjny i zaproponuj poprawkę wraz z wyjaśnieniem przyczyny."
    }
  ]
}'
https://runapi.ai 1 endpoint

9 dostępnych wariantów

Playground

Wypróbuj GLM 5 turbo

Wybierz dowolny model i generuj w kilka sekund.

Szacunkowo: Wejście $1.20 / 1M tokenów | Wyjście $2.00 / 1M tokenów

Zaloguj się, aby generować przez RunAPI.

Zaloguj się, aby generować

Zaloguj się, aby rozpocząć generowanie z dostępnymi modelami językowymi.

Specyfikacja

Szczegóły techniczne

Dostawca Z.ai
ID modelu glm-5-turbo
Modalność Tekst
Typy zadań Synchronous
Endpoint API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/glm-5-turbo:generateContent
/v1beta/models/glm-5-turbo:streamGenerateContent
Jednostka rozliczeniowa 1 tys. tokenów
Status katalogu Operacyjny
JAK TO DZIAŁA

Użyj tego modelu w 3 krokach

  1. Uzyskaj klucz

    Zarejestruj się bezpłatnie i utwórz klucz API dla glm-5-turbo w panelu.

  2. Wyślij żądanie

    Wyślij żądanie POST do /v1/chat/completions z identyfikatorem modelu glm-5-turbo i parametrami.

  3. Pobierz wyniki

    Odczytaj bezpośrednio z endpointu ukończoną odpowiedź glm-5-turbo.

Co oferuje ten model

Pokrycie endpointów

Udostępnia 1 publiczny(-e) endpoint(-y): chat_completion.

Rozliczenia według użycia

Rozliczane według 1 tys. tokenów bez wymogu subskrypcji.

GLM 5 turbo Cennik

Endpoint
Rozdzielczość
Czas trwania
Cena
chat_completion
Niedostępne
1 tys. tokenów
Wejście: $1.20 / 1M tokenów Wyjście: $2.00 / 1M tokenów
  • Odczyt z cache: $0.24 / 1M tokenów
  • Zapis do cache (5 min): Bezpłatnie / 1M tokenów
  • Zapis do cache (1 godz.): Bezpłatnie / 1M tokenów
ODNIESIENIE API

Specyfikacja endpointu

Endpoint
POST /v1/chat/completions
ID modelu
glm-5-turbo
Typy zadań
chat_completion
Maksymalny czas trwania
Niedostępne
Rozdzielczości
Niedostępne
Proporcje obrazu
Niedostępne
Format wyjściowy
Niedostępne
Średni czas generowania
Niedostępne

Parametry żądania

Dla tego endpointu nie opublikowano parametrów żądania.

PRZYPADKI UŻYCIA

Obsługa klienta

Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.

Analiza dokumentów

Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.

Generowanie kodu

Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.

FAQ

Najczęściej zadawane pytania o GLM 5 turbo

Jak wybrać glm-5-turbo?

Przekaż identyfikator modelu wyświetlony w quickstarcie.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

Budujesz z zespołem?

Pomożemy w konfiguracji dla firm, integracjach i kwestiach technicznych.

Skontaktuj się