Versiones y endpoints públicos
| ID del modelo | Endpoints | Precio inicial | Catálogo |
|---|---|---|---|
qwen3.5-122b-a10b
|
/v1/chat/completions
|
$0.40 / 1M de tokens | Detalle del modelo |
qwen3.5-27b
|
/v1/chat/completions
|
$0.30 / 1M de tokens | Detalle del modelo |
qwen3.5-35b-a3b
|
/v1/chat/completions
|
$0.25 / 1M de tokens | Detalle del modelo |
qwen3.5-397b-a17b
|
/v1/chat/completions
|
$0.60 / 1M de tokens | Detalle del modelo |
qwen3.6-27b
|
/v1/chat/completions
|
$0.60 / 1M de tokens | Detalle del modelo |
qwen3.6-35b-a3b
|
/v1/chat/completions
|
$0.38 / 1M de tokens | Detalle del modelo |
Verificar
Consulta hasta que la tarea alcance un estado final
Selecciona <model-id> para generar los comandos de verificación.
Configuración
Endpoint de la guía: <endpoint>
Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Empieza en 3 pasos
-
Elige un ID de modelo
Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.
-
Configura RunAPI
Añade la configuración del proveedor para este agente.
-
Verifica el resultado
Ejecuta los comandos de estado y selección de modelo mostrados abajo.
Qué puedes crear con Hermes Agent + Qwen
-
Programación y razonamiento con agentes
Deja que tu agente planifique, escriba y revise código o resuelva problemas de varios pasos con el razonamiento del modelo.
-
Análisis y extracción de documentos largos
Resume informes, contratos o bases de código y extrae campos estructurados de documentos extensos.
-
Flujos con llamadas a herramientas
Conecta el modelo a funciones y API para que tu agente consulte datos y ejecute acciones entre respuestas.
Por qué usar Qwen con RunAPI + Hermes Agent
-
6 variantes, una clave de API
Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.
-
Precios de uso claros
Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.
-
Respuestas directas
Las llamadas síncronas devuelven el resultado en la misma respuesta, así tu agente puede usarlo de inmediato sin consultar el estado de una tarea.
Preguntas sobre Hermes Agent + Qwen
¿Con qué modelo Qwen debería empezar?
Empieza con qwen3.6-27b o qwen3.6-35b-a3b, los modelos Qwen más recientes en RunAPI, para chat, programación y entrada de imagen. Usa qwen3.5-397b-a17b si quieres el modelo Qwen3.5 más grande, y qwen3-coder-next para agentes de programación que no necesitan paso de thinking.
¿Qué modelos Qwen aceptan imágenes?
Todos los modelos Qwen3.5 y Qwen3.6 y las dos versiones de Qwen3-VL-235B-A22B aceptan imágenes. Envíalas como partes image_url en una petición Chat Completions. qwen3-coder-next solo admite texto.
¿Cómo funciona el thinking en los modelos Qwen?
Los modelos Qwen3.5 y Qwen3.6 son híbridos y tienen modos con y sin thinking. qwen3-vl-235b-a22b-thinking siempre piensa, mientras que qwen3-vl-235b-a22b-instruct y qwen3-coder-next responden sin paso de thinking.
¿Qué API uso para llamar a Qwen en RunAPI?
Usa el endpoint Chat Completions compatible con OpenAI en https://runapi.ai/v1/chat/completions con tu API key de RunAPI y un ID de modelo Qwen. Cualquier SDK de OpenAI funciona en cuanto cambias la base URL.
¿Los modelos de lenguaje Qwen son open-weight?
Sí. Alibaba publica estos modelos Qwen con pesos abiertos bajo la licencia Apache 2.0. RunAPI te da acceso por API, así que no tienes que alojarlos en tus propias GPU.
¿En qué se diferencia la línea Qwen de Qwen Image?
La línea Qwen agrupa los modelos de lenguaje, que leen texto e imágenes y devuelven texto. Qwen Image, Qwen 2 y Qwen 3 son líneas separadas de RunAPI que generan y editan imágenes.
¿Qué ID de modelo debo usar?
Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.
¿Esta guía configura un modelo de chat?
Sí. Esta línea de modelos admite un protocolo LLM para clientes.