Alibaba

Qwen3-VL-235B-A22B-Thinking

Texto
Descontinuado Descontinuado em 2026-10-10.

MoE de visão Qwen3-VL que sempre raciocina antes; contexto de 131K; imagens via API compatível com OpenAI

Saúde do modelo Dados insuficientes
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "qwen3-vl-235b-a22b-thinking",
  "messages": [
    {
      "role": "user",
      "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="qwen3-vl-235b-a22b-thinking",
    messages=[{"role": "user", "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "qwen3-vl-235b-a22b-thinking",
  messages: [{ role: "user", content: "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema." }]
});
https://runapi.ai 5 endpoints
VISÃO GERAL

Para que serve o Qwen3-VL-235B-A22B-Thinking

O Qwen3-VL-235B-A22B-Thinking é a versão com raciocínio do Qwen3-VL, a principal família de modelos de visão e linguagem da Alibaba Qwen. É um modelo Mixture-of-Experts com 235B de parâmetros no total, dos quais 22B ficam ativos por token. Foi lançado com pesos abertos sob Apache 2.0 em 23 de setembro de 2025. A Alibaba o ajustou para raciocínio multimodal, com foco em problemas de STEM e matemática, OCR e compreensão de imagens e vídeos.

O modelo funciona apenas no modo thinking: toda resposta começa com uma etapa de raciocínio, e essa etapa não pode ser desativada. A API da Alibaba o oferece com janela de contexto de 131.072 tokens e até 32.768 tokens de saída.

No RunAPI, chame o qwen3-vl-235b-a22b-thinking pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions), usando um SDK da OpenAI apontado para https://runapi.ai/v1. Envie as imagens como partes image_url ao lado do texto em messages[].content[]. A Alibaba agora agrupa o Qwen3-VL entre seus modelos legados, porque os modelos Qwen3.5 e Qwen3.6 leem imagens nativamente.

ID do modelo
qwen3-vl-235b-a22b-thinking
Lançamento
23/09/2025
Arquitetura
MoE, 235B no total / 22B ativos, pesos sob Apache 2.0
Janela de contexto
131.072 tokens
Saída máxima
32.768 tokens
Thinking
Sempre ativo
Endpoint no RunAPI
OpenAI Chat Completions, entrada de texto e imagem
Especificações

FICHA TÉCNICA

Provedor Alibaba
ID do modelo qwen3-vl-235b-a22b-thinking
Modalidade Texto
Tipos de tarefa Synchronous
Endpoint da API /v1/chat/completions
/v1/responses
/v1/messages
/v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
/v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
Unidade de cobrança 1K tokens
Status do catálogo Descontinuado
COMO FUNCIONA

Use este modelo em 3 etapas

  1. Crie sua chave

    Cadastre-se gratuitamente e crie uma chave de API para qwen3-vl-235b-a22b-thinking no painel.

  2. Envie uma solicitação

    Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo qwen3-vl-235b-a22b-thinking e seus parâmetros.

  3. Obtenha os resultados

    Leia diretamente do endpoint a resposta concluída de qwen3-vl-235b-a22b-thinking.

O que este modelo oferece

Cobertura de endpoints

Expõe 1 endpoint(s) público(s): chat_completion.

Cobrança por uso

Medido por 1K tokens, sem exigência de assinatura.

REFERÊNCIA DA API

Especificação do endpoint

Endpoint
POST /v1/chat/completions
ID do modelo
qwen3-vl-235b-a22b-thinking
Tipos de tarefa
chat_completion

Parâmetros da solicitação

Nenhum parâmetro de solicitação foi publicado para este endpoint.

CASOS DE USO

Chat

Use LLMs para chat e raciocínio.

Código

Gere e revise trabalho de implementação.

Automação

Conecte modelos a tarefas backend.

FAQ

Perguntas frequentes sobre Qwen3-VL-235B-A22B-Thinking

Qual é a diferença entre as versões Thinking e Instruct do Qwen3-VL-235B-A22B?

As duas usam o mesmo modelo Mixture-of-Experts de 235B com 22B de parâmetros ativos. A versão Thinking sempre raciocina antes de responder e é ajustada para STEM, matemática e raciocínio multimodal. A versão Instruct responde diretamente e é voltada para programação visual, percepção espacial, compreensão de vídeos longos e OCR.

Como envio uma imagem para o qwen3-vl-235b-a22b-thinking?

Use o endpoint Chat Completions e adicione uma parte image_url ao lado da parte de texto em messages[].content[], o mesmo formato de requisição que o SDK da OpenAI usa para visão. A Alibaba também lista entrada de vídeo para este modelo; requisições com vídeo não foram verificadas no RunAPI.

Posso desativar o thinking neste modelo?

Não. A Alibaba distribui este modelo apenas com o modo thinking. Se você quer respostas sem etapa de raciocínio, chame o qwen3-vl-235b-a22b-instruct.

Para tarefas com imagens, devo usar o Qwen3-VL ou um modelo Qwen3.5?

A Alibaba lista o Qwen3-VL entre seus modelos legados e afirma que o Qwen3.5-122B-A10B supera o Qwen3-VL-235B em visão. Em novos trabalhos com imagens, teste primeiro um modelo Qwen3.5 ou Qwen3.6 e mantenha o Qwen3-VL para prompts e avaliações que já foram construídos sobre ele.

Como seleciono qwen3-vl-235b-a22b-thinking?

Envie o ID de modelo mostrado no quickstart.

O preço é por uso?

Sim. O preço é medido por chamada ou unidade.

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco