endpoint 구성
1개의 공개 endpoint를 제공합니다: chat_completion.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-122b-a10b:generateContent
POST /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-122b-a10b",
"messages": [
{
"role": "user",
"content": "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-122b-a10b",
messages=[{"role": "user", "content": "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-122b-a10b",
messages: [{ role: "user", content: "오류가 난 대시보드 스크린샷을 읽고 오류 메시지가 무슨 뜻인지 설명한 뒤, 문제를 고칠 코드 변경을 제안해 줘." }]
});
사용 가능한 버전 9개
Qwen3.5-122B-A10B는 Alibaba Qwen3.5 Medium 시리즈의 네이티브 비전-언어 모델로, 2026년 2월 24일 Apache 2.0 오픈 웨이트로 공개되었습니다. 하이브리드 선형 어텐션을 갖춘 MoE(Mixture-of-Experts) 모델이며, 전체 122B 파라미터 중 토큰당 10B가 활성화됩니다. Alibaba는 이 모델을 Qwen3.5 세대에서 Qwen3.5-397B-A17B 다음인 두 번째로 평가합니다.
Alibaba에 따르면 텍스트 성능은 Qwen3-235B-2507을, 비전 성능은 Qwen3-VL-235B를 넘어섭니다. 사고가 기본으로 켜진 하이브리드 모델이며, 컨텍스트 윈도우는 262,144토큰, 출력은 최대 65,536토큰입니다. 함수 호출과 구조화된 출력을 지원합니다.
RunAPI에서는 OpenAI 호환 Chat Completions 엔드포인트(/v1/chat/completions)로 qwen3.5-122b-a10b를 호출합니다. OpenAI SDK의 연결 주소를 https://runapi.ai/v1로 지정하세요. 이미지는 messages[].content[] 안의 image_url 파트로 보냅니다.
원하는 모델을 선택하고 몇 초 만에 생성해보세요.
| 제공자 | Alibaba |
| 모델 ID | qwen3.5-122b-a10b |
| 모달리티 | 텍스트 |
| 작업 유형 | Synchronous |
| API 엔드포인트 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-122b-a10b:generateContent | |
| /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent | |
| 청구 단위 | 1K 토큰 |
| 카탈로그 상태 | 운영 중 |
무료로 가입하고 대시보드에서 qwen3.5-122b-a10b용 API 키를 만드세요.
/v1/chat/completions로 qwen3.5-122b-a10b 모델 ID와 매개변수를 포함한 POST 요청을 보내세요.
엔드포인트에서 완료된 qwen3.5-122b-a10b 응답을 직접 읽으세요.
1개의 공개 endpoint를 제공합니다: chat_completion.
1K 토큰 기준으로 측정되며 구독 없이 이용 가능합니다.
이 엔드포인트에 게시된 요청 매개변수가 없습니다.
LLM을 채팅과 추론에 사용합니다.
구현 작업을 생성하고 리뷰합니다.
모델을 backend 작업에 연결합니다.
이 모델에 대한 검증된 고객 피드백이 아직 없습니다.
Alibaba는 122B 모델을 397B 대표 모델 바로 다음으로 평가합니다. 토큰당 활성 파라미터는 대표 모델의 17B에 비해 10B입니다. 두 모델 모두 262,144토큰 컨텍스트 윈도우, 이미지 입력, 하이브리드 사고를 갖추고 있습니다.
Alibaba는 Qwen3.5-122B-A10B의 비전 성능이 Qwen3-VL-235B보다 뛰어나다고 밝히며, 컨텍스트 윈도우도 두 배입니다. 프로덕션 워크로드를 옮기기 전에 직접 가진 이미지로 시험해 보세요.
기본적으로 그렇습니다. 사고 모드와 비사고 모드가 있으며, Alibaba API는 요청에서 끄지 않는 한 사고를 켭니다. 사고하면 응답이 길어지므로 동기 요청에서는 대기 시간을 넉넉하게 잡으세요.
RunAPI의 OpenAI 호환 Chat Completions 엔드포인트 https://runapi.ai/v1/chat/completions에 RunAPI API 키를 사용하고 model을 qwen3.5-122b-a10b로 지정하세요. 도구는 표준 OpenAI tools 형식을 사용합니다.
quickstart에 표시된 모델 ID를 전달하세요.
네. 호출 또는 단위 기준으로 측정됩니다.