하나의 API key
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
RunAPI를 통해 모델 스킬, 통합 인증, 종량제 요금으로 Qwen API를 사용하세요.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.6-35b-a3b",
"messages": [
{
"role": "user",
"content": "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.6-35b-a3b",
messages=[{"role": "user", "content": "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.6-35b-a3b",
messages: [{ role: "user", content: "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘." }]
});
Qwen은 Alibaba의 오픈 웨이트 언어 모델 패밀리로, Apache 2.0으로 공개됩니다. RunAPI의 Qwen3.5 모델(397B-A17B, 122B-A10B, 27B, 35B-A3B)과 Qwen3.6 모델(27B, 35B-A3B)은 262,144토큰 컨텍스트 윈도우와 하이브리드 사고를 갖춘 네이티브 비전-언어 모델입니다. Qwen3-VL-235B-A22B에는 이미지 이해용 Thinking 버전과 Instruct 버전이 있으며 컨텍스트 윈도우는 131,072토큰입니다. Qwen3-Coder-Next는 활성 파라미터 3B의 텍스트 전용 에이전트용 코딩 모델입니다. 모두 하나의 API 키로 RunAPI의 OpenAI 호환 Chat Completions 엔드포인트에서 호출합니다.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| 변형 | 과금 | 요금 | |
|---|---|---|---|
| qwen3-coder-next | 1K 토큰 | 지원 종료 | 보기 → |
| qwen3-vl-235b-a22b-instruct | 1K 토큰 | 지원 종료 | 보기 → |
| qwen3-vl-235b-a22b-thinking | 1K 토큰 | 지원 종료 | 보기 → |
| qwen3.5-122b-a10b | 1K 토큰 | 입력 $0.40 / 100만 토큰 | 출력 $3.20 / 100만 토큰 | 보기 → |
| qwen3.5-27b | 1K 토큰 | 입력 $0.30 / 100만 토큰 | 출력 $2.40 / 100만 토큰 | 보기 → |
| qwen3.5-35b-a3b | 1K 토큰 | 입력 $0.25 / 100만 토큰 | 출력 $2.00 / 100만 토큰 | 보기 → |
| qwen3.5-397b-a17b | 1K 토큰 | 입력 $0.60 / 100만 토큰 | 출력 $3.60 / 100만 토큰 | 보기 → |
| qwen3.6-27b | 1K 토큰 | 입력 $0.60 / 100만 토큰 | 출력 $3.60 / 100만 토큰 | 보기 → |
| qwen3.6-35b-a3b | 1K 토큰 | 입력 $0.38 / 100만 토큰 | 출력 $2.25 / 100만 토큰 | 보기 → |
| endpoint | 해상도 | 길이 | 가격 | |
|---|---|---|---|---|
| chat_completion | — | — | 입력 $0.40 / 100만 토큰 | 출력 $3.20 / 100만 토큰 |
qwen3.5-122b-a10b 기준 요금입니다. 다른 변형은 각자의 endpoint 요금이 적용됩니다.
출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.
모든 지원 모델에 RunAPI key를 사용합니다.
기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.
task ID로 조회하거나 생성 완료 시 callback을 처리합니다.
모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.
model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.
호출 전에 사용량 기반 가격을 확인할 수 있습니다.
채팅, 코딩, 이미지 입력에는 RunAPI에서 가장 새로운 Qwen 모델인 qwen3.6-27b 또는 qwen3.6-35b-a3b로 시작하세요. 가장 큰 Qwen3.5 모델이 필요하면 qwen3.5-397b-a17b를, 사고 단계가 필요 없는 코딩 에이전트에는 qwen3-coder-next를 쓰면 됩니다.
모든 Qwen3.5와 Qwen3.6 모델, 그리고 Qwen3-VL-235B-A22B의 두 버전이 이미지를 받습니다. Chat Completions 요청에 image_url 파트로 보내세요. qwen3-coder-next는 텍스트 전용입니다.
Qwen3.5와 Qwen3.6 모델은 하이브리드이며 사고 모드와 비사고 모드가 있습니다. qwen3-vl-235b-a22b-thinking은 항상 사고하고, qwen3-vl-235b-a22b-instruct와 qwen3-coder-next는 사고 단계 없이 답합니다.
OpenAI 호환 Chat Completions 엔드포인트 https://runapi.ai/v1/chat/completions에 RunAPI API 키와 Qwen 모델 ID를 사용하세요. base URL만 바꾸면 어떤 OpenAI SDK든 쓸 수 있습니다.
네. Alibaba는 이 Qwen 모델들을 Apache 2.0 라이선스의 오픈 웨이트로 공개합니다. RunAPI는 API 액세스를 제공하므로 직접 GPU에 호스팅할 필요가 없습니다.
Qwen 라인은 언어 모델로, 텍스트와 이미지를 읽고 텍스트를 반환합니다. Qwen Image, Qwen 2, Qwen 3은 이미지를 생성하고 편집하는 별도의 RunAPI 라인입니다.