Cobertura de endpoints
Expõe 1 endpoint(s) público(s): chat_completion.
MoE de visão Qwen3-VL que sempre raciocina antes; contexto de 131K; imagens via API compatível com OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema." }]
});
9 variantes disponíveis
O Qwen3-VL-235B-A22B-Thinking é a versão com raciocínio do Qwen3-VL, a principal família de modelos de visão e linguagem da Alibaba Qwen. É um modelo Mixture-of-Experts com 235B de parâmetros no total, dos quais 22B ficam ativos por token. Foi lançado com pesos abertos sob Apache 2.0 em 23 de setembro de 2025. A Alibaba o ajustou para raciocínio multimodal, com foco em problemas de STEM e matemática, OCR e compreensão de imagens e vídeos.
O modelo funciona apenas no modo thinking: toda resposta começa com uma etapa de raciocínio, e essa etapa não pode ser desativada. A API da Alibaba o oferece com janela de contexto de 131.072 tokens e até 32.768 tokens de saída.
No RunAPI, chame o qwen3-vl-235b-a22b-thinking pelo endpoint Chat Completions compatível com OpenAI (/v1/chat/completions), usando um SDK da OpenAI apontado para https://runapi.ai/v1. Envie as imagens como partes image_url ao lado do texto em messages[].content[]. A Alibaba agora agrupa o Qwen3-VL entre seus modelos legados, porque os modelos Qwen3.5 e Qwen3.6 leem imagens nativamente.
| Provedor | Alibaba |
| ID do modelo | qwen3-vl-235b-a22b-thinking |
| Modalidade | Texto |
| Tipos de tarefa | Synchronous |
| Endpoint da API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| Unidade de cobrança | 1K tokens |
| Status do catálogo | Descontinuado |
Cadastre-se gratuitamente e crie uma chave de API para qwen3-vl-235b-a22b-thinking no painel.
Envie uma solicitação POST para /v1/chat/completions com o identificador do modelo qwen3-vl-235b-a22b-thinking e seus parâmetros.
Leia diretamente do endpoint a resposta concluída de qwen3-vl-235b-a22b-thinking.
Expõe 1 endpoint(s) público(s): chat_completion.
Medido por 1K tokens, sem exigência de assinatura.
Nenhum parâmetro de solicitação foi publicado para este endpoint.
Use LLMs para chat e raciocínio.
Gere e revise trabalho de implementação.
Conecte modelos a tarefas backend.
As duas usam o mesmo modelo Mixture-of-Experts de 235B com 22B de parâmetros ativos. A versão Thinking sempre raciocina antes de responder e é ajustada para STEM, matemática e raciocínio multimodal. A versão Instruct responde diretamente e é voltada para programação visual, percepção espacial, compreensão de vídeos longos e OCR.
Use o endpoint Chat Completions e adicione uma parte image_url ao lado da parte de texto em messages[].content[], o mesmo formato de requisição que o SDK da OpenAI usa para visão. A Alibaba também lista entrada de vídeo para este modelo; requisições com vídeo não foram verificadas no RunAPI.
Não. A Alibaba distribui este modelo apenas com o modo thinking. Se você quer respostas sem etapa de raciocínio, chame o qwen3-vl-235b-a22b-instruct.
A Alibaba lista o Qwen3-VL entre seus modelos legados e afirma que o Qwen3.5-122B-A10B supera o Qwen3-VL-235B em visão. Em novos trabalhos com imagens, teste primeiro um modelo Qwen3.5 ou Qwen3.6 e mantenha o Qwen3-VL para prompts e avaliações que já foram construídos sobre ele.
Envie o ID de modelo mostrado no quickstart.
Sim. O preço é medido por chamada ou unidade.
Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.
Fale conosco