Alibaba · Tekst

Hermes Agent x Qwen

De Qwen-taalmodellen van Alibaba zijn open-weight Mixture-of-Experts- en dense LLM's met 131K tot 256K context. De meeste accepteren beeldinvoer en hebben een thinking-modus. Via RunAPI delen ze één API-key en facturatie per token, en elke OpenAI-SDK kan ze aanroepen op https://runapi.ai/v1. Dit zijn de taalmodellen van Qwen, los van de beeldgeneratiemodellen Qwen Image, Qwen 2 en Qwen 3.

6 variants vanaf $0.25 / 1M tokens Commercieel toegestaan

Prerequisite: npx runapi mcp install

Prompt

Promptmodellen

Gebruik qwen3.5-122b-a10b wanneer het bij de taak past: Open-weight Qwen3.5-vision-MoE (10B actief); 256K context; OpenAI-compatibele API.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: Open-weight Qwen3.5-vision-MoE (10B actief); 256K context; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Dicht open-weight Qwen3.5-visiemodel; 256K context, hybride thinking; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: Kleine open-weight Qwen3.5-vision-MoE (3B actief); 256K context; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: Open-weight vlaggenschip van Qwen3.5, vision-MoE (17B actief); 256K context; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Dicht open-weight Qwen3.6-visiemodel voor agentic coding; 256K context; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Eerste open-weight Qwen3.6-model, een vision-MoE met 3B actief; 256K context; OpenAI-compatibele API
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Lees deze screenshot van een dashboard met een fout, leg uit wat de foutmelding betekent en stel de codewijziging voor die het probleem oplost.
Verify the active model with: hermes model;hermes doctor

Openbare versies en endpoints

Model-ID Endpoints Vanafprijs Catalogus
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M tokens Modeldetails
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M tokens Modeldetails
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M tokens Modeldetails
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M tokens Modeldetails
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M tokens Modeldetails
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M tokens Modeldetails

Verifiëren

Poll totdat de Task een eindstatus bereikt

Selecteer <model-id> om verificatieopdrachten te genereren.

Configuratie

Handleiding-endpoint: <endpoint>

Selecteer <model-id> om een aanvraag te genereren met het openbare invoercontract van het endpoint.
Zo werkt het

Start in 3 stappen

  1. Kies een model-ID

    Selecteer een openbare model-ID uit de catalogus en bekijk het endpoint en de actuele vanafprijs.

  2. Configureer RunAPI

    Voeg de providerconfiguratie voor deze agent toe.

  3. Verifieer het resultaat

    Voer de onderstaande status- en modelselectieopdrachten uit.

Wat je kunt bouwen met Hermes Agent + Qwen

  • Programmeren en redeneren met agents

    Laat je agent code plannen, schrijven en reviewen of meerstapsproblemen oplossen met het redeneervermogen van het model.

  • Analyse en extractie van lange documenten

    Vat rapporten, contracten of codebases samen en haal gestructureerde velden uit lange documenten.

  • Workflows met toolaanroepen

    Koppel het model aan functies en API's zodat je agent tussen antwoorden door gegevens kan opzoeken en acties kan uitvoeren.

Waarom Qwen gebruiken via RunAPI + Hermes Agent

  • 6 varianten, één API-sleutel

    Gebruik één RunAPI-verbinding om beschikbare modelvarianten te kiezen zonder je integratie aan te passen.

  • Duidelijke gebruiksprijzen

    Bekijk de actuele catalogusprijzen voordat je een aanvraag verstuurt, zonder abonnement of minimale besteding.

  • Directe antwoorden

    Synchrone aanroepen geven het resultaat in hetzelfde antwoord terug, zodat je agent het direct kan gebruiken zonder de taakstatus op te vragen.

Vragen over Hermes Agent + Qwen

Met welk Qwen-model begin ik?

Begin met qwen3.6-27b of qwen3.6-35b-a3b, de nieuwste Qwen-modellen op RunAPI, voor chat, programmeren en beeldinvoer. Gebruik qwen3.5-397b-a17b als je het grootste Qwen3.5-model wilt, en qwen3-coder-next voor coding-agents die geen thinking-stap nodig hebben.

Welke Qwen-modellen accepteren afbeeldingen?

Alle Qwen3.5- en Qwen3.6-modellen en beide versies van Qwen3-VL-235B-A22B accepteren afbeeldingen. Stuur ze als image_url-onderdelen in een Chat Completions-request. qwen3-coder-next verwerkt alleen tekst.

Hoe werkt thinking bij Qwen-modellen?

De Qwen3.5- en Qwen3.6-modellen zijn hybride en hebben een thinking- en een non-thinking-modus. qwen3-vl-235b-a22b-thinking denkt altijd na, terwijl qwen3-vl-235b-a22b-instruct en qwen3-coder-next antwoorden zonder thinking-stap.

Met welke API roep ik Qwen aan op RunAPI?

Gebruik het OpenAI-compatibele Chat Completions-endpoint op https://runapi.ai/v1/chat/completions met je RunAPI-API-key en een Qwen-model-ID. Elke OpenAI-SDK werkt zodra je de base URL aanpast.

Zijn de Qwen-taalmodellen open-weight?

Ja. Alibaba brengt deze Qwen-modellen uit met open weights onder de Apache 2.0-licentie. RunAPI geeft je API-toegang, zodat je ze niet op je eigen GPU's hoeft te hosten.

Wat is het verschil tussen de Qwen-lijn en Qwen Image?

De Qwen-lijn bevat de taalmodellen, die tekst en afbeeldingen lezen en tekst teruggeven. Qwen Image, Qwen 2 en Qwen 3 zijn aparte RunAPI-lijnen die afbeeldingen genereren en bewerken.

Welke model-ID moet ik gebruiken?

Kies een openbare model-ID uit de versietabel. Elke ID biedt de endpoints die in de betreffende rij staan.

Configureert deze handleiding een chatmodel?

Ja. Deze modellijn ondersteunt een clientgericht LLM-protocol.

Aan de slag met Qwen en Hermes Agent

Bouw je met een team?

We helpen je met enterprise-inrichting, integraties en technische vragen.

Neem contact op