Endpoint 覆蓋範圍
公開 1 個公共 endpoint:chat_completion。
僅限思考模式的 Qwen3-VL 視覺 MoE 模型;131K 上下文;透過 OpenAI 相容 API 輸入圖片
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "看一下這張出錯的儀表板截圖,說明錯誤訊息代表什麼,並提出能修正問題的程式碼修改。" }]
});
9 個版本可用
Qwen3-VL-235B-A22B-Thinking 是 Alibaba Qwen 團隊旗艦視覺語言模型系列 Qwen3-VL 的推理版本。它採用混合專家(MoE)架構,總參數 235B,每個 token 啟用 22B,於 2025 年 9 月 23 日以 Apache 2.0 授權釋出開放權重。Alibaba 針對多模態推理調校這個模型,重點放在 STEM 與數學題、OCR,以及圖片與影片理解。
這是僅限思考的模型:每次回覆都會先經過推理步驟,而且無法關閉。Alibaba 官方 API 為它提供 131,072 token 的上下文視窗,最多輸出 32,768 token。
在 RunAPI 上,將 OpenAI SDK 的 base URL 指向 https://runapi.ai/v1,即可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)呼叫 qwen3-vl-235b-a22b-thinking。圖片以 image_url 內容區塊的形式,與文字一起放進 messages[].content[]。由於 Qwen3.5 與 Qwen3.6 模型已原生支援讀圖,Alibaba 現已將 Qwen3-VL 歸入舊版模型。
| 提供者 | Alibaba |
| 模型 ID | qwen3-vl-235b-a22b-thinking |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 已下線 |
免費註冊後,從控制台建立 qwen3-vl-235b-a22b-thinking 的 API 金鑰。
向 /v1/chat/completions 傳送 POST 請求,並傳入 qwen3-vl-235b-a22b-thinking 模型 ID 與參數。
直接從端點讀取已完成的 qwen3-vl-235b-a22b-thinking 回應。
公開 1 個公共 endpoint:chat_completion。
依 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答顧客問題,減少工單量。
起草合約摘要,並標示關鍵條款供律師審閱。
在 CI 中自動產生單元測試、程式碼審查與重構建議。
兩者使用同一個 235B MoE 模型,啟用參數都是 22B。Thinking 版每次回答前都會推理,針對 STEM、數學與多模態推理調校;Instruct 版直接回答,主打視覺程式設計、空間感知、長影片理解與 OCR。
使用 Chat Completions 端點,在 messages[].content[] 的文字內容區塊旁加入 image_url 內容區塊,請求結構與 OpenAI SDK 的視覺請求相同。Alibaba 也列出這個模型支援影片輸入,但影片請求尚未在 RunAPI 上驗證。
不行。Alibaba 將它作為僅限思考的模型推出。若需要不經推理步驟的回答,請改用 qwen3-vl-235b-a22b-instruct。
Alibaba 已將 Qwen3-VL 列為舊版模型,並表示 Qwen3.5-122B-A10B 的視覺能力優於 Qwen3-VL-235B。新的圖片工作負載建議先試用 Qwen3.5 或 Qwen3.6 模型,已經以 Qwen3-VL 建立的提示與評估則可以繼續沿用。
傳入 quickstart 顯示的 model ID。
每個金鑰的速率限制會依使用方案而調整。請查看定價頁面以了解目前限制。
可以——variant 只是旗標。只要變更 model 參數即可切換。
只要支援串流,RunAPI 就會端到端串流。
請在公開 GitHub repo 提交 issue,或寄信給支援。