Alibaba · Texte

Hermes Agent x Qwen

Les modèles de langage Qwen d'Alibaba sont des LLM open-weight, Mixture-of-Experts ou denses, avec un contexte de 131K à 256K. La plupart acceptent les images et proposent un mode thinking. Via RunAPI, ils partagent une seule clé API et une facturation au token, et n'importe quel SDK OpenAI peut les appeler sur https://runapi.ai/v1. Il s'agit des modèles de langage de Qwen, distincts des modèles de génération d'images Qwen Image, Qwen 2 et Qwen 3.

6 variants à partir de $0.25 / 1M de tokens Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez qwen3.5-122b-a10b lorsqu'il correspond à la tâche : MoE vision open-weight Qwen3.5 (10B actifs) ; contexte 256K ; API compatible OpenAI.

You have access to RunAPI chat models for Qwen.

Available Qwen models:
- qwen3.5-122b-a10b: MoE vision open-weight Qwen3.5 (10B actifs) ; contexte 256K ; API compatible OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-27b: Modèle de vision dense open-weight Qwen3.5 ; contexte 256K, thinking hybride ; API compatible OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-35b-a3b: Petit MoE vision open-weight Qwen3.5 (3B actifs) ; contexte 256K ; API compatible OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.5-397b-a17b: MoE vision open-weight phare de Qwen3.5 (17B actifs) ; contexte 256K ; API compatible OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-27b: Modèle de vision dense open-weight Qwen3.6 pour le code agentique ; contexte 256K ; API compatible OpenAI
  chat endpoints: /v1/chat/completions
- qwen3.6-35b-a3b: Premier modèle open-weight Qwen3.6, MoE vision à 3B actifs ; contexte 256K ; API compatible OpenAI
  chat endpoints: /v1/chat/completions

Use the model ID and chat endpoint that match the user's request.
Example request: Lisez cette capture d'écran d'un tableau de bord en erreur, expliquez ce que signifie le message d'erreur et proposez la modification de code qui corrigerait le problème.
Verify the active model with: hermes model;hermes doctor

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
qwen3.5-122b-a10b
/v1/chat/completions
$0.40 / 1M de tokens Détail du modèle
qwen3.5-27b
/v1/chat/completions
$0.30 / 1M de tokens Détail du modèle
qwen3.5-35b-a3b
/v1/chat/completions
$0.25 / 1M de tokens Détail du modèle
qwen3.5-397b-a17b
/v1/chat/completions
$0.60 / 1M de tokens Détail du modèle
qwen3.6-27b
/v1/chat/completions
$0.60 / 1M de tokens Détail du modèle
qwen3.6-35b-a3b
/v1/chat/completions
$0.38 / 1M de tokens Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Ajoutez la configuration du fournisseur pour cet agent.

  3. Vérifier le résultat

    Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.

Ce que vous pouvez créer avec Hermes Agent + Qwen

  • Code et raisonnement avec un agent

    Laissez votre agent planifier, écrire et relire du code, ou résoudre des problèmes en plusieurs étapes grâce au raisonnement du modèle.

  • Analyse et extraction de longs documents

    Résumez des rapports, des contrats ou des bases de code et extrayez des champs structurés de longs documents.

  • Workflows avec appels d'outils

    Reliez le modèle à des fonctions et des API pour que votre agent consulte des données et agisse entre deux réponses.

Pourquoi utiliser Qwen avec RunAPI + Hermes Agent

  • 6 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur Hermes Agent + Qwen

Par quel modèle Qwen commencer ?

Commencez par qwen3.6-27b ou qwen3.6-35b-a3b, les modèles Qwen les plus récents sur RunAPI, pour le chat, le code et l'entrée image. Prenez qwen3.5-397b-a17b si vous voulez le plus grand modèle Qwen3.5, et qwen3-coder-next pour les agents de code qui n'ont pas besoin d'étape de thinking.

Quels modèles Qwen acceptent les images ?

Tous les modèles Qwen3.5 et Qwen3.6, ainsi que les deux versions de Qwen3-VL-235B-A22B, acceptent les images. Envoyez-les sous forme de parties image_url dans une requête Chat Completions. qwen3-coder-next traite uniquement le texte.

Comment fonctionne le thinking sur les modèles Qwen ?

Les modèles Qwen3.5 et Qwen3.6 sont hybrides et disposent de modes avec et sans thinking. qwen3-vl-235b-a22b-thinking raisonne toujours, tandis que qwen3-vl-235b-a22b-instruct et qwen3-coder-next répondent sans étape de thinking.

Quelle API utiliser pour appeler Qwen sur RunAPI ?

Utilisez le point d'accès Chat Completions compatible OpenAI à l'adresse https://runapi.ai/v1/chat/completions, avec votre clé API RunAPI et un ID de modèle Qwen. N'importe quel SDK OpenAI fonctionne une fois l'URL de base modifiée.

Les modèles de langage Qwen sont-ils open-weight ?

Oui. Alibaba publie ces modèles Qwen avec des poids ouverts sous licence Apache 2.0. RunAPI vous donne un accès API, vous n'avez donc pas à les héberger sur vos propres GPU.

Quelle différence entre la ligne Qwen et Qwen Image ?

La ligne Qwen regroupe les modèles de langage, qui lisent du texte et des images et renvoient du texte. Qwen Image, Qwen 2 et Qwen 3 sont des lignes RunAPI distinctes qui génèrent et modifient des images.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.

Commencer à utiliser Qwen avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter