Alibaba · Text

Hermes Agent x Qwen

Die Qwen-Sprachmodelle von Alibaba sind Open-Weight-LLMs, als Mixture-of-Experts oder dicht, mit 131K bis 256K Kontext. Die meisten nehmen Bilder an und bieten einen Thinking-Modus. Über RunAPI teilen sie einen API-Key und tokenbasierte Abrechnung, und jedes OpenAI SDK kann sie unter https://runapi.ai/v1 aufrufen. Es handelt sich um Qwens Sprachmodelle, getrennt von den Bildgenerierungsmodellen Qwen Image, Qwen 2 und Qwen 3.

6 variants ab $0.25 / 1 Mio. Tokens Kommerzielle Nutzung unterstützt

Prerequisite: npx runapi mcp install

Prompt

Prompt-Modelle

Verwende qwen3.5-122b-a10b, wenn es zur Aufgabe passt: Open-Weight-Vision-MoE aus Qwen3.5 (10B aktiv); 256K Kontext; OpenAI-kompatible API.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: Open-Weight-Vision-MoE aus Qwen3.5 (10B aktiv); 256K Kontext; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Dichtes Open-Weight-Vision-Modell aus Qwen3.5; 256K Kontext, hybrides Thinking; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: Kleines Open-Weight-Vision-MoE aus Qwen3.5 (3B aktiv); 256K Kontext; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: Open-Weight-Flaggschiff von Qwen3.5, Vision-MoE (17B aktiv); 256K Kontext; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Dichtes Open-Weight-Vision-Modell aus Qwen3.6 für agentisches Coding; 256K Kontext; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Erstes Open-Weight-Modell von Qwen3.6, Vision-MoE mit 3B aktiv; 256K Kontext; OpenAI-kompatible API
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Lies diesen Screenshot eines fehlerhaften Dashboards, erkläre, was die Fehlermeldung bedeutet, und schlage die Codeänderung vor, die das Problem behebt.
Verify the active model with: hermes model;hermes doctor

Öffentliche Versionen und Endpunkte

Modell-ID Endpunkte Startpreis Katalog
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1 Mio. Tokens Modelldetails
qwen3.5-27b
/v1/chat/completions
$0.30 / 1 Mio. Tokens Modelldetails
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1 Mio. Tokens Modelldetails
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1 Mio. Tokens Modelldetails
qwen3.6-27b
/v1/chat/completions
$0.60 / 1 Mio. Tokens Modelldetails
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1 Mio. Tokens Modelldetails

Überprüfen

Frage den Status ab, bis die Task einen Endstatus erreicht

Wähle <model-id>, um Prüfkommandos zu erzeugen.

Konfiguration

Guide-Endpunkt: <endpoint>

Wähle <model-id>, um eine Anfrage mit dem öffentlichen Eingabevertrag des Endpunkts zu erzeugen.
So funktioniert es

In 3 Schritten loslegen

  1. Modell-ID auswählen

    Wähle eine öffentliche Katalog-Modell-ID und prüfe ihren Endpunkt und aktuellen Startpreis.

  2. RunAPI konfigurieren

    Füge die Provider-Konfiguration für diesen Agenten hinzu.

  3. Ergebnis überprüfen

    Führe die unten gezeigten Status- und Modellauswahlbefehle aus.

Was du mit Hermes Agent + Qwen bauen kannst

  • Coding und Reasoning mit Agenten

    Lass deinen Agenten Code planen, schreiben und prüfen oder mehrstufige Probleme mit dem Reasoning des Modells lösen.

  • Analyse und Extraktion langer Dokumente

    Fasse Berichte, Verträge oder Codebasen zusammen und extrahiere strukturierte Felder aus langen Dokumenten.

  • Workflows mit Tool-Aufrufen

    Verbinde das Modell mit Funktionen und APIs, damit dein Agent zwischen Antworten Daten abrufen und Aktionen ausführen kann.

Warum Qwen über RunAPI + Hermes Agent nutzen

  • 6 Varianten, ein API-Schlüssel

    Nutze eine RunAPI-Verbindung, um zwischen den verfügbaren Modellvarianten zu wählen, ohne deine Integration zu ändern.

  • Klare Nutzungspreise

    Sieh die aktuellen Katalogpreise vor jeder Anfrage ein, ohne Abonnement oder Mindestumsatz.

  • Direkte Antworten

    Synchrone Aufrufe liefern das Ergebnis in derselben Antwort, sodass dein Agent es sofort nutzen kann, ohne den Task-Status abzufragen.

Fragen zu Hermes Agent + Qwen

Mit welchem Qwen-Modell sollte ich anfangen?

Beginnen Sie mit qwen3.6-27b oder qwen3.6-35b-a3b, den neuesten Qwen-Modellen bei RunAPI, für Chat, Coding und Bildeingabe. Nehmen Sie qwen3.5-397b-a17b, wenn Sie das größte Qwen3.5-Modell wollen, und qwen3-coder-next für Coding-Agenten, die keinen Thinking-Schritt brauchen.

Welche Qwen-Modelle nehmen Bilder an?

Alle Qwen3.5- und Qwen3.6-Modelle sowie beide Versionen von Qwen3-VL-235B-A22B nehmen Bilder an. Senden Sie sie als image_url-Teile in einem Chat-Completions-Request. qwen3-coder-next verarbeitet nur Text.

Wie funktioniert Thinking bei den Qwen-Modellen?

Die Qwen3.5- und Qwen3.6-Modelle sind hybrid und haben einen Thinking- und einen Non-Thinking-Modus. qwen3-vl-235b-a22b-thinking denkt immer nach, während qwen3-vl-235b-a22b-instruct und qwen3-coder-next ohne Thinking-Schritt antworten.

Über welche API rufe ich Qwen bei RunAPI auf?

Nutzen Sie den OpenAI-kompatiblen Chat-Completions-Endpunkt unter https://runapi.ai/v1/chat/completions mit Ihrem RunAPI-API-Key und einer Qwen-Modell-ID. Jedes OpenAI SDK funktioniert, sobald Sie die Base URL ändern.

Sind die Qwen-Sprachmodelle Open-Weight?

Ja. Alibaba veröffentlicht diese Qwen-Modelle mit offenen Gewichten unter der Apache-2.0-Lizenz. RunAPI bietet Ihnen API-Zugang, sodass Sie sie nicht auf eigenen GPUs betreiben müssen.

Wie unterscheidet sich die Qwen-Linie von Qwen Image?

Die Qwen-Linie umfasst die Sprachmodelle, die Text und Bilder lesen und Text zurückgeben. Qwen Image, Qwen 2 und Qwen 3 sind eigene RunAPI-Linien, die Bilder generieren und bearbeiten.

Welche Modell-ID soll ich verwenden?

Wähle eine öffentliche Modell-ID aus der Versionstabelle. Jede ID stellt die in ihrer Zeile gezeigten Endpunkte bereit.

Konfiguriert diese Anleitung ein Chatmodell?

Ja. Diese Modelllinie unterstützt ein clientseitiges LLM-Protokoll.

Qwen mit Hermes Agent nutzen

Bauen Sie mit einem Team?

Wir helfen bei Enterprise-Setup, Integrationen und technischen Fragen.

Kontakt aufnehmen