Cobertura de endpoints
Expone 1 endpoint(s) público(s): chat_completion.
MoE de visión open-weight de Qwen3.5 (10B activos); contexto 256K; API compatible con OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-122b-a10b:generateContent
POST /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-122b-a10b",
"messages": [
{
"role": "user",
"content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-122b-a10b",
messages=[{"role": "user", "content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-122b-a10b",
messages: [{ role: "user", content: "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría." }]
});
9 versiones disponibles
Qwen3.5-122B-A10B es un modelo nativo de visión y lenguaje de la serie Qwen3.5 Medium de Alibaba, publicado con pesos abiertos bajo Apache 2.0 el 24 de febrero de 2026. Es un modelo Mixture-of-Experts con atención lineal híbrida, 122B parámetros totales y 10B activos por token. Alibaba lo sitúa en segundo lugar dentro de la generación Qwen3.5, por detrás de Qwen3.5-397B-A17B.
Alibaba afirma que su capacidad de texto supera a Qwen3-235B-2507 y su capacidad de visión a Qwen3-VL-235B. Es un modelo híbrido con thinking activo por defecto, ventana de contexto de 262.144 tokens y hasta 65.536 tokens de salida. Admite function calling y salidas estructuradas.
En RunAPI, llama a qwen3.5-122b-a10b a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions) con un SDK de OpenAI apuntando a https://runapi.ai/v1. Las imágenes van en partes image_url dentro de messages[].content[].
Elige cualquier modelo y genera en segundos.
| Proveedor | Alibaba |
| ID del modelo | qwen3.5-122b-a10b |
| Modalidad | Texto |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-122b-a10b:generateContent | |
| /v1beta/models/qwen3.5-122b-a10b:streamGenerateContent | |
| Unidad de facturación | 1K tokens |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para qwen3.5-122b-a10b desde el panel de control.
Envía una solicitud POST a /v1/chat/completions con el identificador del modelo qwen3.5-122b-a10b y tus parámetros.
Lee directamente la respuesta completada de qwen3.5-122b-a10b desde el endpoint.
Expone 1 endpoint(s) público(s): chat_completion.
Medido por 1K tokens sin requisito de suscripción.
No hay parámetros de solicitud publicados para este endpoint.
Usa LLMs para chat y razonamiento.
Genera y revisa trabajo de implementación.
Conecta modelos a tareas backend.
Los testimonios de clientes verificados aún no están disponibles para este modelo.
Alibaba sitúa el modelo de 122B justo detrás del insignia de 397B. Activa 10B parámetros por token, frente a 17B del insignia. Ambos tienen ventana de contexto de 262.144 tokens, entrada de imagen y thinking híbrido.
Alibaba afirma que la capacidad de visión de Qwen3.5-122B-A10B supera a la de Qwen3-VL-235B, y además tiene el doble de ventana de contexto. Pruébalo con tus propias imágenes antes de migrar una carga de producción.
Por defecto, sí. Tiene modos con y sin thinking, y la API de Alibaba activa el thinking salvo que la petición lo desactive. El thinking alarga las respuestas, así que reserva más tiempo en las peticiones síncronas.
Usa el endpoint Chat Completions compatible con OpenAI de RunAPI en https://runapi.ai/v1/chat/completions con tu API key de RunAPI y model en qwen3.5-122b-a10b. Las herramientas usan el formato estándar de OpenAI.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros