Endpoint 涵蓋範圍
開放 1 個公開 endpoint:chat_completion。
只限思考模式的 Qwen3-VL 視覺 MoE 模型;131K 上下文;透過 OpenAI 相容 API 輸入圖片
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "看看這張出錯的儀表板截圖,解釋錯誤訊息的意思,並提出可以修正問題的程式碼改動。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "看看這張出錯的儀表板截圖,解釋錯誤訊息的意思,並提出可以修正問題的程式碼改動。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "看看這張出錯的儀表板截圖,解釋錯誤訊息的意思,並提出可以修正問題的程式碼改動。" }]
});
9 個版本可用
Qwen3-VL-235B-A22B-Thinking 是 Alibaba Qwen 團隊旗艦視覺語言模型系列 Qwen3-VL 的推理版本。它採用混合專家(MoE)架構,總參數 235B,每個 token 啟用 22B,於 2025 年 9 月 23 日以 Apache 2.0 授權開放權重。Alibaba 針對多模態推理調校此模型,重點包括 STEM 及數學題、OCR,以及圖片和影片理解。
這是只限思考的模型:每次回覆都會先經過推理步驟,而且無法關閉。Alibaba 官方 API 為它提供 131,072 token 的上下文視窗,最多輸出 32,768 token。
在 RunAPI 上,將 OpenAI SDK 的 base URL 指向 https://runapi.ai/v1,即可透過 OpenAI 相容的 Chat Completions 端點(/v1/chat/completions)調用 qwen3-vl-235b-a22b-thinking。圖片以 image_url 內容區塊的形式,與文字一同放入 messages[].content[]。由於 Qwen3.5 及 Qwen3.6 模型已原生支援讀圖,Alibaba 現已將 Qwen3-VL 歸入舊版模型。
| 提供者 | Alibaba |
| 模型 ID | qwen3-vl-235b-a22b-thinking |
| 模態 | 文字 |
| 任務類型 | Synchronous |
| API 端點 | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| 計費單位 | 1K tokens |
| 目錄狀態 | 已下線 |
免費註冊後,在控制台建立 qwen3-vl-235b-a22b-thinking 的 API 金鑰。
向 /v1/chat/completions 發送 POST 請求,並傳入 qwen3-vl-235b-a22b-thinking 模型 ID 和參數。
直接從端點讀取已完成的 qwen3-vl-235b-a22b-thinking 回應。
開放 1 個公開 endpoint:chat_completion。
按 1K tokens 計量,無需訂閱。
此端點尚未發布請求參數。
從私有知識庫回答客戶問題,減少工單數量。
草擬合約摘要,並標示重點條款供律師審閱。
在 CI 自動生成單元測試、程式碼審查同重構建議。
兩者使用同一個 235B MoE 模型,啟用參數同為 22B。Thinking 版每次作答前都會推理,針對 STEM、數學及多模態推理調校;Instruct 版直接作答,主攻視覺編程、空間感知、長影片理解及 OCR。
使用 Chat Completions 端點,在 messages[].content[] 的文字內容區塊旁加入 image_url 內容區塊,請求結構與 OpenAI SDK 的視覺請求相同。Alibaba 亦列出此模型支援影片輸入,但影片請求尚未在 RunAPI 上驗證。
不可以。Alibaba 將它作為只限思考的模型推出。如需不經推理步驟的回答,請改用 qwen3-vl-235b-a22b-instruct。
Alibaba 已將 Qwen3-VL 列為舊版模型,並表示 Qwen3.5-122B-A10B 的視覺能力勝過 Qwen3-VL-235B。新的圖片工作負載建議先試 Qwen3.5 或 Qwen3.6 模型,已經以 Qwen3-VL 建立的提示及評估則可以繼續沿用。
傳入 quickstart 顯示嘅 model ID。
每個 key 的 rate limit 會按使用層級而定。請查看定價頁了解最新限制。
可以——variant 只係一個旗標。只要更改 model 參數就可以切換。
在可用 streaming 的情況下,RunAPI 會端到端串流。
可以在公開 GitHub repo 開 issue,或者電郵支援團隊。