Alibaba · Testo

Hermes Agent x Qwen

I modelli linguistici Qwen di Alibaba sono LLM open-weight, Mixture-of-Experts o densi, con contesto da 131K a 256K. La maggior parte accetta immagini e offre una modalità thinking. Tramite RunAPI condividono una sola chiave API e la fatturazione per token, e qualsiasi SDK OpenAI può chiamarli su https://runapi.ai/v1. Sono i modelli linguistici di Qwen, distinti dai modelli di generazione di immagini Qwen Image, Qwen 2 e Qwen 3.

6 variants da $0.25 / 1M di token Uso commerciale consentito

Prerequisite: npx runapi mcp install

Prompt

Modelli del prompt

Usa qwen3.5-122b-a10b quando è adatto all'attività: MoE di visione open-weight di Qwen3.5 (10B attivi); contesto 256K; API compatibile OpenAI.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: MoE di visione open-weight di Qwen3.5 (10B attivi); contesto 256K; API compatibile OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Modello di visione denso open-weight di Qwen3.5; contesto 256K, thinking ibrido; API compatibile OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: Piccolo MoE di visione open-weight di Qwen3.5 (3B attivi); contesto 256K; API compatibile OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: MoE di visione open-weight di punta di Qwen3.5 (17B attivi); contesto 256K; API compatibile OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Modello di visione denso open-weight di Qwen3.6 per il coding agentico; contesto 256K; API compatibile OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Primo modello open-weight di Qwen3.6, MoE di visione con 3B attivi; contesto 256K; API compatibile OpenAI
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Leggi questo screenshot di una dashboard in errore, spiega cosa significa il messaggio di errore e suggerisci la modifica al codice che risolverebbe il problema.
Verify the active model with: hermes model;hermes doctor

Versioni ed endpoint pubblici

ID modello Endpoint Prezzo iniziale Catalogo
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M di token Dettagli modello
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M di token Dettagli modello
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M di token Dettagli modello
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M di token Dettagli modello
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M di token Dettagli modello
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M di token Dettagli modello

Verifica

Esegui il polling finché la Task non raggiunge uno stato terminale

Seleziona <model-id> per generare i comandi di verifica.

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.
Come funziona

Inizia in 3 passaggi

  1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. Configura RunAPI

    Aggiungi la configurazione del provider per questo agente.

  3. Verifica il risultato

    Esegui i comandi di stato e selezione del modello mostrati sotto.

Cosa puoi creare con Hermes Agent + Qwen

  • Programmazione e ragionamento con agenti

    Lascia che il tuo agente pianifichi, scriva e revisioni codice o risolva problemi in più passaggi con il ragionamento del modello.

  • Analisi ed estrazione da documenti lunghi

    Riassumi report, contratti o codebase ed estrai campi strutturati da documenti lunghi.

  • Workflow con chiamate a strumenti

    Collega il modello a funzioni e API perché il tuo agente possa consultare dati ed eseguire azioni tra una risposta e l'altra.

Perché usare Qwen con RunAPI + Hermes Agent

  • 6 varianti, una chiave API

    Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.

  • Prezzi d'uso chiari

    Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.

  • Risposte dirette

    Le chiamate sincrone restituiscono il risultato nella stessa risposta, così il tuo agente può usarlo subito senza interrogare lo stato di un task.

Domande su Hermes Agent + Qwen

Da quale modello Qwen dovrei iniziare?

Inizia con qwen3.6-27b o qwen3.6-35b-a3b, i modelli Qwen più recenti su RunAPI, per chat, coding e input immagini. Usa qwen3.5-397b-a17b se vuoi il modello Qwen3.5 più grande, e qwen3-coder-next per agenti di coding che non hanno bisogno di un passaggio di thinking.

Quali modelli Qwen accettano immagini?

Tutti i modelli Qwen3.5 e Qwen3.6 ed entrambe le versioni di Qwen3-VL-235B-A22B accettano immagini. Inviale come parti image_url in una richiesta Chat Completions. qwen3-coder-next gestisce solo testo.

Come funziona il thinking sui modelli Qwen?

I modelli Qwen3.5 e Qwen3.6 sono ibridi e hanno modalità con e senza thinking. qwen3-vl-235b-a22b-thinking ragiona sempre, mentre qwen3-vl-235b-a22b-instruct e qwen3-coder-next rispondono senza passaggio di thinking.

Quale API uso per chiamare Qwen su RunAPI?

Usa l'endpoint Chat Completions compatibile OpenAI su https://runapi.ai/v1/chat/completions con la tua chiave API RunAPI e un ID di modello Qwen. Qualsiasi SDK OpenAI funziona dopo aver cambiato la base URL.

I modelli linguistici Qwen sono open-weight?

Sì. Alibaba rilascia questi modelli Qwen con pesi aperti sotto la licenza Apache 2.0. RunAPI ti dà accesso via API, così non devi ospitarli sulle tue GPU.

In cosa la linea Qwen è diversa da Qwen Image?

La linea Qwen raccoglie i modelli linguistici, che leggono testo e immagini e restituiscono testo. Qwen Image, Qwen 2 e Qwen 3 sono linee RunAPI separate che generano e modificano immagini.

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

Sì. Questa linea di modelli supporta un protocollo LLM rivolto al client.

Inizia a usare Qwen con Hermes Agent

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci