Alibaba

Qwen3-VL-235B-A22B-Thinking

文本
已下线 该模型已于 2026-10-10 下线。

仅思考模式的 Qwen3-VL 视觉 MoE 模型;131K 上下文;通过 OpenAI 兼容 API 输入图像

模型健康状态 数据不足
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3-vl-235b-a22b-thinking",
  "messages": [
    {
      "role": "user",
      "content": "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。"
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3-vl-235b-a22b-thinking",
    messages=[{"role": "user", "content": "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。"}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3-vl-235b-a22b-thinking",
  messages: [{ role: "user", content: "读一下这张出错的仪表盘截图,解释报错信息是什么意思,并给出能修复它的代码改动。" }]
});
https://runapi.ai 5 endpoints
概览

Qwen3-VL-235B-A22B-Thinking 适合做什么

Qwen3-VL-235B-A22B-Thinking 是阿里巴巴 Qwen 团队旗舰视觉语言模型系列 Qwen3-VL 的推理版本。它采用 MoE(混合专家)架构,总参数 235B,每个 token 激活 22B,于 2025 年 9 月 23 日以 Apache 2.0 许可证开放权重。阿里巴巴针对多模态推理对它做了调优,重点是 STEM 与数学题、OCR,以及图像和视频理解。

这是一个仅思考模型:每次回复都会先经过推理步骤,且无法关闭。阿里巴巴官方 API 为它提供 131,072 token 的上下文窗口,最多输出 32,768 token。

在 RunAPI 上,把 OpenAI SDK 的 base URL 指向 https://runapi.ai/v1,即可通过 OpenAI 兼容的 Chat Completions 端点(/v1/chat/completions)调用 qwen3-vl-235b-a22b-thinking。图像以 image_url 内容块的形式与文本一起放进 messages[].content[]。由于 Qwen3.5 和 Qwen3.6 模型已原生支持读图,阿里巴巴现已将 Qwen3-VL 归入旧版模型。

模型 ID
qwen3-vl-235b-a22b-thinking
发布日期
2025 年 9 月 23 日
架构
MoE,总参数 235B / 激活 22B,Apache 2.0 开放权重
上下文窗口
131,072 token
最大输出
32,768 token
思考
始终开启
RunAPI 上的端点
OpenAI Chat Completions,支持文本和图像输入
规格

技术细节

提供商 Alibaba
模型 ID qwen3-vl-235b-a22b-thinking
模态 文本
任务类型 Synchronous
API 端点 /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
/v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
计费单位 1K tokens
目录状态 已下线
工作原理

3 步使用此模型

  1. 获取 API 密钥

    免费注册后,在控制台创建用于 qwen3-vl-235b-a22b-thinking 的 API 密钥。

  2. 发送请求

    向 /v1/chat/completions 发送 POST 请求,并传入 qwen3-vl-235b-a22b-thinking 模型 ID 和参数。

  3. 获取结果

    直接从端点读取已完成的 qwen3-vl-235b-a22b-thinking 响应。

该模型的核心能力

Endpoint 覆盖

提供 1 个公开 endpoint:chat_completion。

按量计费

按 1K tokens 计量,无需订阅。

API 参考

端点规格

端点
POST /v1/chat/completions
模型 ID
qwen3-vl-235b-a22b-thinking
任务类型
chat_completion

请求参数

此端点尚未发布请求参数。

应用场景

客户支持

基于私有知识库回答客户问题,减少工单量。

文档分析

起草合同摘要并标记关键条款供律师审阅。

代码生成

在 CI 中自动生成单元测试、代码审查和重构建议。

常见问题

Qwen3-VL-235B-A22B-Thinking 常见问题

Qwen3-VL-235B-A22B 的 Thinking 版和 Instruct 版有什么区别?

两者基于同一个 235B MoE 模型,激活参数均为 22B。Thinking 版每次作答前都会推理,针对 STEM、数学和多模态推理调优;Instruct 版直接给出回答,侧重视觉编程、空间感知、长视频理解和 OCR。

如何向 qwen3-vl-235b-a22b-thinking 发送图像?

使用 Chat Completions 端点,在 messages[].content[] 的文本内容块旁加入 image_url 内容块,请求结构与 OpenAI SDK 的视觉请求相同。阿里巴巴还列出该模型支持视频输入,但视频请求尚未在 RunAPI 上验证。

这个模型可以关闭思考吗?

不可以。阿里巴巴把它作为仅思考模型发布。如果需要不带推理步骤的回答,请改用 qwen3-vl-235b-a22b-instruct。

图像任务应该用 Qwen3-VL 还是 Qwen3.5 模型?

阿里巴巴已将 Qwen3-VL 列为旧版模型,并表示 Qwen3.5-122B-A10B 的视觉能力超过 Qwen3-VL-235B。新的图像工作负载建议先试用 Qwen3.5 或 Qwen3.6 模型,已经基于 Qwen3-VL 搭建的提示词和评测可以继续使用它。

如何选择 qwen3-vl-235b-a22b-thinking?

传入 quickstart 中显示的模型 ID。

该变体的限流?

Key 级限流随使用层级伸缩。当前限制见定价页。

能切到其它变体吗?

可以——变体只是参数,改 model 字段即可。

支持流式吗?

模型支持流式时,RunAPI 端到端流式。

质量问题在哪里报?

在公共 GitHub 仓库提 issue 或邮件联系 support。

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们