glm-5 API
Z.ai / GLM
RunAPI로 GLM 패밀리의 glm-5를 사용하세요. 호출당 요금, 구독 없음, 실패한 생성은 과금되지 않습니다.
운영 중
·
text
·
상업적 사용 지원
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/glm-5:generateContent
POST /v1beta/models/glm-5:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5",
"messages": [
{
"role": "user",
"content": "이 멀티 파일 저장소를 읽고 실패하는 통합 테스트를 찾은 뒤, 근본 원인 설명과 함께 패치를 제안하세요."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="glm-5",
messages=[{"role": "user", "content": "이 멀티 파일 저장소를 읽고 실패하는 통합 테스트를 찾은 뒤, 근본 원인 설명과 함께 패치를 제안하세요."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "glm-5",
messages: [{ role: "user", content: "이 멀티 파일 저장소를 읽고 실패하는 통합 테스트를 찾은 뒤, 근본 원인 설명과 함께 패치를 제안하세요." }]
});
변형 전환
개요
GLM glm-5는 같은 RunAPI 인증, model skill 워크플로, 사용량 기반 가격으로 사용할 수 있습니다.
- 통합 API key
- Model skill 설정
- 모델 ID 참조
- 실패한 생성은 과금되지 않습니다
요금
요금
실패한 생성은 과금되지 않습니다
Chat completion
Input
$1.00
/ 1M tokens
Output
$1.60
/ 1M tokens
Cache read
$0.20
Cache write 5m
Free
Cache write 1h
Free
스펙
스펙
| 모델 ID | glm-5 |
| 제공사 | Z.ai |
| 모달리티 | text |
| 작업 유형 | synchronous |
| 과금 | 1K tokens |
| Endpoint | /v1/chat/completions |
| /v1/responses | |
| /v1/messages | |
| /v1beta/models/glm-5:generateContent | |
| /v1beta/models/glm-5:streamGenerateContent | |
| 상업적 사용 | 예 |
| 카탈로그 상태 | 운영 중 |
MODELS
모델 스킬 — glm-5
스킬을 한 번 설치한 후, 이 페이지의 변형 ID를 사용해 개발을 시작하세요.
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/glm-5:generateContent | Gemini generateContent |
| /v1beta/models/glm-5:streamGenerateContent | Gemini streamGenerateContent |
작동 방식
glm-5 사용 방법
01
모델 선택
앱 워크플로에 맞는 모델과 변형을 고릅니다.
02
모델 ID 전달
요청 본문에 이 변형 ID를 사용합니다.
03
작업 실행
요청을 보내고 반환된 task ID를 저장합니다.
04
출력 수집
작업이 끝나면 조회하거나 callback으로 결과를 받습니다.
차이
glm-5 비교
VS GLM-4.5
744B / 40B 활성, 200K 컨텍스트, 77.8% SWE-bench Verified
355B / 32B 활성, 128K 컨텍스트, 플래그십 오픈웨이트 MoE 기준 모델
VS GLM-4.5-AIR
744B / 40B 활성, 200K 컨텍스트, 77.8% SWE-bench Verified
빠르고 비용이 낮은 일상 작업을 위한 가벼운 GLM-4.5 티어
VS GLM-4.6
744B / 40B 활성, 200K 컨텍스트, 77.8% SWE-bench Verified
200K 컨텍스트, Cambricon 칩 기반 첫 GLM, 더 선명한 코드 생성
사용 사례
이 변형을 쓰는 곳
Chat
LLM을 채팅과 추론에 사용합니다.
코드
구현 작업을 생성하고 리뷰합니다.
자동화
모델을 backend 작업에 연결합니다.
FAQ
glm-5 자주 묻는 질문
glm-5는 어떻게 선택하나요?
quickstart에 표시된 모델 ID를 전달하세요.
가격은 사용량 기반인가요?
네. 호출 또는 단위 기준으로 측정됩니다.
다른 GLM 변형
glm-4.5-air
최저가
4.5-air
Input $0.10 / 1M tokens | Output $0.55 / 1M tokens
glm-4.5
4.5
Input $0.41 / 1M tokens | Output $1.61 / 1M tokens
glm-4.6
4.6
Input $0.60 / 1M tokens | Output $1.22 / 1M tokens
glm-4.7
4.7
Input $0.60 / 1M tokens | Output $1.19 / 1M tokens
glm-5.2
5.2
Input $0.70 / 1M tokens | Output $2.20 / 1M tokens
glm-5-turbo
빠름
5-turbo
Input $1.20 / 1M tokens | Output $2.00 / 1M tokens
glm-5.1
5.1
Input $1.40 / 1M tokens | Output $2.20 / 1M tokens
관련 모델
지금 시작