Alibaba · Texto

Hermes Agent x Qwen

Os modelos de linguagem Qwen da Alibaba são LLMs com pesos abertos, tanto Mixture-of-Experts quanto densos, com contexto de 131K a 256K. A maioria aceita entrada de imagem e oferece um modo thinking. Pelo RunAPI, eles compartilham uma única chave de API e cobrança por token, e qualquer SDK da OpenAI pode chamá-los em https://runapi.ai/v1. Estes são os modelos de linguagem da Qwen, separados dos modelos de geração de imagem Qwen Image, Qwen 2 e Qwen 3.

6 variants a partir de $0.25 / 1M de tokens Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use qwen3.5-122b-a10b quando ele corresponder à tarefa: MoE de visão Qwen3.5 com pesos abertos (10B ativos); contexto de 256K; API compatível com OpenAI.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: MoE de visão Qwen3.5 com pesos abertos (10B ativos); contexto de 256K; API compatível com OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Modelo de visão denso Qwen3.5 com pesos abertos; contexto de 256K, thinking híbrido; API compatível com OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: MoE de visão Qwen3.5 compacto com pesos abertos (3B ativos); contexto de 256K; API compatível com OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: Principal MoE de visão Qwen3.5 com pesos abertos (17B ativos); contexto de 256K; API compatível com OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Modelo de visão denso Qwen3.6 com pesos abertos para programação agêntica; contexto de 256K; API compatível com OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Primeiro modelo Qwen3.6 com pesos abertos, um MoE de visão com 3B ativos; contexto de 256K; API compatível com OpenAI
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Leia esta captura de tela de um dashboard com erro, explique o que a mensagem de erro significa e sugira a mudança no código que resolveria o problema.
Verify the active model with: hermes model;hermes doctor

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M de tokens Detalhes do modelo
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M de tokens Detalhes do modelo
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M de tokens Detalhes do modelo
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M de tokens Detalhes do modelo
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M de tokens Detalhes do modelo
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M de tokens Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Adicione a configuração do provedor para este agente.

  3. Verifique o resultado

    Execute os comandos de status e seleção de modelo mostrados abaixo.

O que criar com Hermes Agent + Qwen

  • Programação e raciocínio com agentes

    Deixe seu agente planejar, escrever e revisar código ou resolver problemas de várias etapas com o raciocínio do modelo.

  • Análise e extração de documentos longos

    Resuma relatórios, contratos ou bases de código e extraia campos estruturados de documentos longos.

  • Fluxos com chamadas de ferramentas

    Conecte o modelo a funções e APIs para que seu agente consulte dados e execute ações entre as respostas.

Por que usar Qwen pelo RunAPI + Hermes Agent

  • 6 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Respostas diretas

    Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.

Perguntas sobre Hermes Agent + Qwen

Com qual modelo Qwen devo começar?

Comece com o qwen3.6-27b ou o qwen3.6-35b-a3b, os modelos Qwen mais recentes no RunAPI, para chat, programação e entrada de imagem. Use o qwen3.5-397b-a17b quando quiser o maior modelo Qwen3.5, e o qwen3-coder-next para agentes de programação que não precisam de etapa de thinking.

Quais modelos Qwen aceitam imagens?

Todos os modelos Qwen3.5 e Qwen3.6 e as duas versões do Qwen3-VL-235B-A22B aceitam imagens. Envie-as como partes image_url em uma requisição Chat Completions. O qwen3-coder-next trabalha só com texto.

Como funciona o thinking nos modelos Qwen?

Os modelos Qwen3.5 e Qwen3.6 são híbridos e têm modos thinking e non-thinking. O qwen3-vl-235b-a22b-thinking sempre raciocina, enquanto o qwen3-vl-235b-a22b-instruct e o qwen3-coder-next respondem sem etapa de thinking.

Qual API uso para chamar o Qwen no RunAPI?

Use o endpoint Chat Completions compatível com OpenAI em https://runapi.ai/v1/chat/completions, com sua chave de API do RunAPI e um ID de modelo Qwen. Qualquer SDK da OpenAI funciona depois que você troca a base URL.

Os modelos de linguagem Qwen têm pesos abertos?

Sim. A Alibaba lança esses modelos Qwen com pesos abertos sob a licença Apache 2.0. O RunAPI dá acesso por API, para que você não precise hospedá-los nas suas próprias GPUs.

Qual é a diferença entre a linha Qwen e o Qwen Image?

A linha Qwen reúne os modelos de linguagem, que leem texto e imagens e retornam texto. Qwen Image, Qwen 2 e Qwen 3 são linhas separadas do RunAPI que geram e editam imagens.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.

Comece a usar Qwen com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco