공개 버전 및 엔드포인트
| 모델 ID | 엔드포인트 | 시작 가격 | 모델 카탈로그 |
|---|---|---|---|
qwen3.5-122b-a10b
|
/v1/chat/completions
|
$0.40 / 100만 토큰 | 모델 상세 |
qwen3.5-27b
|
/v1/chat/completions
|
$0.30 / 100만 토큰 | 모델 상세 |
qwen3.5-35b-a3b
|
/v1/chat/completions
|
$0.25 / 100만 토큰 | 모델 상세 |
qwen3.5-397b-a17b
|
/v1/chat/completions
|
$0.60 / 100만 토큰 | 모델 상세 |
qwen3.6-27b
|
/v1/chat/completions
|
$0.60 / 100만 토큰 | 모델 상세 |
qwen3.6-35b-a3b
|
/v1/chat/completions
|
$0.38 / 100만 토큰 | 모델 상세 |
검증
Task가 최종 상태에 도달할 때까지 폴링합니다
<model-id>를 선택하면 검증 명령을 생성합니다.
설정
가이드 엔드포인트: <endpoint>
<model-id>를 선택하면 엔드포인트의 공개 입력 계약에 맞는 요청을 생성합니다.
3단계로 시작하기
-
모델 ID 선택
공개 모델 ID를 선택하고 엔드포인트와 현재 시작 가격을 확인합니다.
-
RunAPI 설정
이 Agent의 Provider 설정을 추가합니다.
-
결과 검증
아래 Agent 상태 및 모델 선택 명령을 실행합니다.
Hermes Agent + Qwen로 만들 수 있는 것
-
에이전트 코딩과 추론
모델의 추론 능력으로 에이전트가 코드를 계획, 작성, 검토하거나 여러 단계의 문제를 해결하게 할 수 있습니다.
-
긴 문서 분석과 추출
보고서, 계약서, 코드베이스를 요약하고 긴 문서에서 구조화된 필드를 추출합니다.
-
도구 호출 워크플로
모델을 함수와 API에 연결해 에이전트가 응답 사이에 데이터를 조회하고 작업을 실행하도록 합니다.
Qwen을(를) RunAPI + Hermes Agent로 사용하는 이유
-
6개 변형 모델, 하나의 API 키
하나의 RunAPI 연결에서 사용 가능한 모델 변형을 선택할 수 있어 통합 방식을 바꿀 필요가 없습니다.
-
명확한 사용 요금
요청을 보내기 전에 현재 카탈로그 요금을 확인하세요. 구독이나 최소 사용 금액이 없습니다.
-
즉시 응답
동기 호출은 같은 응답 안에 결과를 반환하므로 에이전트가 작업 상태를 폴링하지 않고 바로 결과를 사용할 수 있습니다.
Hermes Agent + Qwen 자주 묻는 질문
어떤 Qwen 모델부터 시작하면 되나요?
채팅, 코딩, 이미지 입력에는 RunAPI에서 가장 새로운 Qwen 모델인 qwen3.6-27b 또는 qwen3.6-35b-a3b로 시작하세요. 가장 큰 Qwen3.5 모델이 필요하면 qwen3.5-397b-a17b를, 사고 단계가 필요 없는 코딩 에이전트에는 qwen3-coder-next를 쓰면 됩니다.
이미지를 받는 Qwen 모델은 무엇인가요?
모든 Qwen3.5와 Qwen3.6 모델, 그리고 Qwen3-VL-235B-A22B의 두 버전이 이미지를 받습니다. Chat Completions 요청에 image_url 파트로 보내세요. qwen3-coder-next는 텍스트 전용입니다.
Qwen 모델의 사고는 어떻게 동작하나요?
Qwen3.5와 Qwen3.6 모델은 하이브리드이며 사고 모드와 비사고 모드가 있습니다. qwen3-vl-235b-a22b-thinking은 항상 사고하고, qwen3-vl-235b-a22b-instruct와 qwen3-coder-next는 사고 단계 없이 답합니다.
RunAPI에서 Qwen을 호출하려면 어떤 API를 쓰나요?
OpenAI 호환 Chat Completions 엔드포인트 https://runapi.ai/v1/chat/completions에 RunAPI API 키와 Qwen 모델 ID를 사용하세요. base URL만 바꾸면 어떤 OpenAI SDK든 쓸 수 있습니다.
Qwen 언어 모델은 오픈 웨이트인가요?
네. Alibaba는 이 Qwen 모델들을 Apache 2.0 라이선스의 오픈 웨이트로 공개합니다. RunAPI는 API 액세스를 제공하므로 직접 GPU에 호스팅할 필요가 없습니다.
Qwen 라인은 Qwen Image와 어떻게 다른가요?
Qwen 라인은 언어 모델로, 텍스트와 이미지를 읽고 텍스트를 반환합니다. Qwen Image, Qwen 2, Qwen 3은 이미지를 생성하고 편집하는 별도의 RunAPI 라인입니다.
어떤 모델 ID를 사용해야 하나요?
버전 표에서 공개 모델 ID를 선택하세요. 각 ID가 제공하는 엔드포인트는 해당 행에 표시됩니다.
이 가이드는 채팅 모델을 설정하나요?
예. 이 Model Line은 클라이언트용 LLM 프로토콜을 지원합니다.