Alibaba · Texto

Hermes Agent x Qwen

Los modelos de lenguaje Qwen de Alibaba son LLMs open-weight, Mixture-of-Experts o densos, con contexto de 131K a 256K. La mayoría acepta imágenes y ofrece modo thinking. A través de RunAPI comparten una única API key y facturación por token, y cualquier SDK de OpenAI puede llamarlos en https://runapi.ai/v1. Son los modelos de lenguaje de Qwen, distintos de los modelos de generación de imágenes Qwen Image, Qwen 2 y Qwen 3.

6 variants desde $0.25 / 1M de tokens Uso comercial compatible

Prerequisite: npx runapi mcp install

Prompt

Modelos del prompt

Usa qwen3.5-122b-a10b cuando encaje con la tarea: MoE de visión open-weight de Qwen3.5 (10B activos); contexto 256K; API compatible con OpenAI.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: MoE de visión open-weight de Qwen3.5 (10B activos); contexto 256K; API compatible con OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Modelo de visión denso open-weight de Qwen3.5; contexto 256K, thinking híbrido; API compatible con OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: MoE de visión pequeño y open-weight de Qwen3.5 (3B activos); contexto 256K; API compatible con OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: MoE de visión insignia open-weight de Qwen3.5 (17B activos); contexto 256K; API compatible con OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Modelo de visión denso open-weight de Qwen3.6 para programación agéntica; contexto 256K; API compatible con OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Primer modelo open-weight de Qwen3.6, MoE de visión con 3B activos; contexto 256K; API compatible con OpenAI
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Lee esta captura de pantalla de un panel con errores, explica qué significa el mensaje de error y sugiere el cambio de código que lo solucionaría.
Verify the active model with: hermes model;hermes doctor

Versiones y endpoints públicos

ID del modelo Endpoints Precio inicial Catálogo
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M de tokens Detalle del modelo
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M de tokens Detalle del modelo
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M de tokens Detalle del modelo
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M de tokens Detalle del modelo
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M de tokens Detalle del modelo
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M de tokens Detalle del modelo

Verificar

Consulta hasta que la tarea alcance un estado final

Selecciona <model-id> para generar los comandos de verificación.

Configuración

Endpoint de la guía: <endpoint>

Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Cómo funciona

Empieza en 3 pasos

  1. Elige un ID de modelo

    Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.

  2. Configura RunAPI

    Añade la configuración del proveedor para este agente.

  3. Verifica el resultado

    Ejecuta los comandos de estado y selección de modelo mostrados abajo.

Qué puedes crear con Hermes Agent + Qwen

  • Programación y razonamiento con agentes

    Deja que tu agente planifique, escriba y revise código o resuelva problemas de varios pasos con el razonamiento del modelo.

  • Análisis y extracción de documentos largos

    Resume informes, contratos o bases de código y extrae campos estructurados de documentos extensos.

  • Flujos con llamadas a herramientas

    Conecta el modelo a funciones y API para que tu agente consulte datos y ejecute acciones entre respuestas.

Por qué usar Qwen con RunAPI + Hermes Agent

  • 6 variantes, una clave de API

    Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.

  • Precios de uso claros

    Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.

  • Respuestas directas

    Las llamadas síncronas devuelven el resultado en la misma respuesta, así tu agente puede usarlo de inmediato sin consultar el estado de una tarea.

Preguntas sobre Hermes Agent + Qwen

¿Con qué modelo Qwen debería empezar?

Empieza con qwen3.6-27b o qwen3.6-35b-a3b, los modelos Qwen más recientes en RunAPI, para chat, programación y entrada de imagen. Usa qwen3.5-397b-a17b si quieres el modelo Qwen3.5 más grande, y qwen3-coder-next para agentes de programación que no necesitan paso de thinking.

¿Qué modelos Qwen aceptan imágenes?

Todos los modelos Qwen3.5 y Qwen3.6 y las dos versiones de Qwen3-VL-235B-A22B aceptan imágenes. Envíalas como partes image_url en una petición Chat Completions. qwen3-coder-next solo admite texto.

¿Cómo funciona el thinking en los modelos Qwen?

Los modelos Qwen3.5 y Qwen3.6 son híbridos y tienen modos con y sin thinking. qwen3-vl-235b-a22b-thinking siempre piensa, mientras que qwen3-vl-235b-a22b-instruct y qwen3-coder-next responden sin paso de thinking.

¿Qué API uso para llamar a Qwen en RunAPI?

Usa el endpoint Chat Completions compatible con OpenAI en https://runapi.ai/v1/chat/completions con tu API key de RunAPI y un ID de modelo Qwen. Cualquier SDK de OpenAI funciona en cuanto cambias la base URL.

¿Los modelos de lenguaje Qwen son open-weight?

Sí. Alibaba publica estos modelos Qwen con pesos abiertos bajo la licencia Apache 2.0. RunAPI te da acceso por API, así que no tienes que alojarlos en tus propias GPU.

¿En qué se diferencia la línea Qwen de Qwen Image?

La línea Qwen agrupa los modelos de lenguaje, que leen texto e imágenes y devuelven texto. Qwen Image, Qwen 2 y Qwen 3 son líneas separadas de RunAPI que generan y editan imágenes.

¿Qué ID de modelo debo usar?

Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.

¿Esta guía configura un modelo de chat?

Sí. Esta línea de modelos admite un protocolo LLM para clientes.

Empieza a usar Qwen con Hermes Agent

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros