Cobertura de endpoints
Expone 1 endpoint(s) público(s): chat_completion.
MoE de visión Qwen3-VL con thinking permanente; contexto 131K; entrada de imagen con API compatible con OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent
POST /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-vl-235b-a22b-thinking",
"messages": [
{
"role": "user",
"content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3-vl-235b-a22b-thinking",
messages=[{"role": "user", "content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3-vl-235b-a22b-thinking",
messages: [{ role: "user", content: "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría." }]
});
9 versiones disponibles
Qwen3-VL-235B-A22B-Thinking es la versión con razonamiento de Qwen3-VL, la familia insignia de modelos de visión y lenguaje de Alibaba Qwen. Es un modelo Mixture-of-Experts con 235B parámetros totales y 22B activos por token, publicado con pesos abiertos bajo Apache 2.0 el 23 de septiembre de 2025. Alibaba lo ajusta para el razonamiento multimodal, con foco en problemas de ciencias y matemáticas, OCR y comprensión de imágenes y vídeo.
El modelo funciona solo con thinking: cada respuesta empieza con un paso de razonamiento que no se puede desactivar. La API de Alibaba lo ofrece con una ventana de contexto de 131.072 tokens y hasta 32.768 tokens de salida.
En RunAPI, llama a qwen3-vl-235b-a22b-thinking a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions) con un SDK de OpenAI apuntando a https://runapi.ai/v1. Envía las imágenes como partes image_url junto al texto en messages[].content[]. Alibaba agrupa ahora Qwen3-VL entre sus modelos heredados, porque los modelos Qwen3.5 y Qwen3.6 leen imágenes de forma nativa.
| Proveedor | Alibaba |
| ID del modelo | qwen3-vl-235b-a22b-thinking |
| Modalidad | Texto |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:generateContent | |
| /v1beta/models/qwen3-vl-235b-a22b-thinking:streamGenerateContent | |
| Unidad de facturación | 1K tokens |
| Estado del catálogo | Retirado |
Regístrate gratis y crea una clave de API para qwen3-vl-235b-a22b-thinking desde el panel de control.
Envía una solicitud POST a /v1/chat/completions con el identificador del modelo qwen3-vl-235b-a22b-thinking y tus parámetros.
Lee directamente la respuesta completada de qwen3-vl-235b-a22b-thinking desde el endpoint.
Expone 1 endpoint(s) público(s): chat_completion.
Medido por 1K tokens sin requisito de suscripción.
No hay parámetros de solicitud publicados para este endpoint.
Usa LLMs para chat y razonamiento.
Genera y revisa trabajo de implementación.
Conecta modelos a tareas backend.
Ambas usan el mismo modelo Mixture-of-Experts de 235B con 22B parámetros activos. La versión Thinking siempre razona antes de responder y está ajustada para ciencias, matemáticas y razonamiento multimodal. La versión Instruct responde directamente y se orienta a programación a partir de imágenes, percepción espacial, comprensión de vídeos largos y OCR.
Usa el endpoint Chat Completions y añade una parte image_url junto a la parte de texto en messages[].content[], la misma forma de petición que usa el SDK de OpenAI para visión. Alibaba también indica entrada de vídeo para este modelo; las peticiones con vídeo no están verificadas en RunAPI.
No. Alibaba lo distribuye como un modelo que siempre usa thinking. Si quieres respuestas sin paso de razonamiento, llama en su lugar a qwen3-vl-235b-a22b-instruct.
Alibaba incluye Qwen3-VL entre sus modelos heredados y afirma que la capacidad de visión de Qwen3.5-122B-A10B supera a la de Qwen3-VL-235B. Para nuevas cargas con imágenes, prueba primero un modelo Qwen3.5 o Qwen3.6, y reserva Qwen3-VL para los prompts y evaluaciones que ya dependen de él.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros