Cobertura de endpoints
Expone 1 endpoint(s) público(s): chat_completion.
MoE de visión pequeño y open-weight de Qwen3.5 (3B activos); contexto 256K; API compatible con OpenAI
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/qwen3.5-35b-a3b:generateContent
POST /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.5-35b-a3b",
"messages": [
{
"role": "user",
"content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="qwen3.5-35b-a3b",
messages=[{"role": "user", "content": "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "qwen3.5-35b-a3b",
messages: [{ role: "user", content: "Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría." }]
});
9 versiones disponibles
Qwen3.5-35B-A3B es el modelo Mixture-of-Experts pequeño de la serie Qwen3.5 Medium de Alibaba, publicado con pesos abiertos bajo Apache 2.0 el 24 de febrero de 2026. Es un modelo nativo de visión y lenguaje con atención lineal híbrida, 35B parámetros totales y 3B activos por token. Alibaba considera su rendimiento general comparable al de Qwen3.5-27B.
Es un modelo híbrido con thinking activo por defecto, ventana de contexto de 262.144 tokens y hasta 65.536 tokens de salida. Alibaba indica que admite function calling y salidas estructuradas.
En RunAPI, llama a qwen3.5-35b-a3b a través del endpoint Chat Completions compatible con OpenAI (/v1/chat/completions) con un SDK de OpenAI apuntando a https://runapi.ai/v1. Las imágenes van en partes image_url dentro de messages[].content[].
Elige cualquier modelo y genera en segundos.
| Proveedor | Alibaba |
| ID del modelo | qwen3.5-35b-a3b |
| Modalidad | Texto |
| Tipos de tarea | Synchronous |
| Endpoint de API | /v1/chat/completions |
| /v1/responses |
| /v1/messages | |
| /v1beta/models/qwen3.5-35b-a3b:generateContent | |
| /v1beta/models/qwen3.5-35b-a3b:streamGenerateContent | |
| Unidad de facturación | 1K tokens |
| Estado del catálogo | Operativo |
Regístrate gratis y crea una clave de API para qwen3.5-35b-a3b desde el panel de control.
Envía una solicitud POST a /v1/chat/completions con el identificador del modelo qwen3.5-35b-a3b y tus parámetros.
Lee directamente la respuesta completada de qwen3.5-35b-a3b desde el endpoint.
Expone 1 endpoint(s) público(s): chat_completion.
Medido por 1K tokens sin requisito de suscripción.
No hay parámetros de solicitud publicados para este endpoint.
Usa LLMs para chat y razonamiento.
Genera y revisa trabajo de implementación.
Conecta modelos a tareas backend.
Los testimonios de clientes verificados aún no están disponibles para este modelo.
Significa 3B parámetros activos. El modelo tiene 35B parámetros en total, y su router Mixture-of-Experts usa 3B de ellos en cada token.
Qwen3.6-35B-A3B sucede directamente a este modelo con el mismo tamaño de 35B totales y 3B activos. Alibaba reporta para el modelo 3.6 grandes mejoras en programación agéntica, razonamiento matemático y de código, inteligencia espacial y detección de objetos.
Sí. Alibaba indica que admite function calling y salidas estructuradas. En RunAPI, envía herramientas en formato OpenAI con Chat Completions y lee tool_calls en la respuesta.
Sí. Es un modelo nativo de visión y lenguaje. Envía partes image_url con el texto en una petición Chat Completions. Alibaba también indica entrada de vídeo; las peticiones con vídeo no están verificadas en RunAPI.
Pasa el ID de modelo que aparece en el quickstart.
Sí. El precio se mide por llamada o unidad.
Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.
Contacta con nosotros