OpenAI · Texte

Hermes Agent x GPT

GPT est la famille de LLM frontier d'OpenAI, couvrant les variantes standard et mini pour différents compromis coût-performance. Via RunAPI, tous les modèles GPT partagent la même forme d'API et la même facturation.

15 variants à partir de $0.06 / 1M de tokens Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez codex-auto-review lorsqu'il correspond à la tâche : codex-auto-review.

You have access to RunAPI chat models for GPT.

Available GPT models:
- codex-auto-review: codex-auto-review
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-4o-mini: Modèle GPT-4o rapide et économique pour les tâches textuelles quotidiennes
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5-pro: GPT-5 Pro pour l’analyse et la programmation via l’API Responses
  chat endpoints: /v1/responses
- gpt-5.2: Travail de connaissance professionnel ; Thinking mode pour les tâches approfondies
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4: Meilleur code + workflows agentiques ; benchmark de code leader du marché
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4-mini: Alternative économique pour gpt-5.4 ; disponible pour le niveau gratuit
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.4-nano: gpt-5.4-nano
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.5: Conçu pour les tâches agentiques longue durée ; meilleure récupération d'erreurs
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-luna: Niveau GPT-5.6 le plus rapide et le plus léger pour résumés, brouillons et automatisation quotidienne
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.6-sol: Modèle phare pour les tâches les plus difficiles : codage complexe, recherche approfondie, agents longue durée
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-terra: Cheval de bataille équilibré pour les tâches à fort volume ; qualité quasi phare, rentable
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-6-astra: Modèle le plus performant : raisonnement avancé, contexte 1M, génération de code et tâches agentiques
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-luna: Niveau GPT-6 le plus rapide et léger : contexte 1M pour résumés, brouillons et automatisation courante
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-sol: Niveau GPT-6 économique : raisonnement solide, contexte 1M, code et tâches agentiques
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6.1-sol: Niveau GPT-6 économique : raisonnement solide, contexte 1M, code et tâches agentiques
  chat endpoints: /v1/chat/completions, /v1/responses

Use the model ID and chat endpoint that match the user's request.
Example request: Analysez ces données de revenus trimestriels et produisez un résumé avec les tendances clés, les anomalies et trois recommandations.
Verify the active model with: hermes model;hermes doctor

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
codex-auto-review
/v1/chat/completions /v1/responses
$0.20 / 1M de tokens Détail du modèle
gpt-4o-mini
/v1/chat/completions /v1/responses
$0.15 / 1M de tokens Détail du modèle
gpt-5-pro
/v1/responses
$7.50 / 1M de tokens Détail du modèle
gpt-5.2
/v1/responses /v1/chat/completions
$1.75 / 1M de tokens Détail du modèle
gpt-5.4
/v1/responses /v1/chat/completions
$2.50 / 1M de tokens Détail du modèle
gpt-5.4-mini
/v1/chat/completions /v1/responses
$0.75 / 1M de tokens Détail du modèle
gpt-5.4-nano
/v1/responses /v1/chat/completions
$0.20 / 1M de tokens Détail du modèle
gpt-5.5
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Détail du modèle
gpt-5.6-luna
/v1/responses /v1/chat/completions
$0.20 / 1M de tokens Détail du modèle
gpt-5.6-sol
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Détail du modèle
gpt-5.6-terra
/v1/responses /v1/chat/completions
$2.00 / 1M de tokens Détail du modèle
gpt-6-astra
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Détail du modèle
gpt-6-luna
/v1/chat/completions /v1/responses
$0.06 / 1M de tokens Détail du modèle
gpt-6-sol
/v1/chat/completions /v1/responses
$1.20 / 1M de tokens Détail du modèle
gpt-6.1-sol
/v1/chat/completions /v1/responses
$1.00 / 1M de tokens Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Ajoutez la configuration du fournisseur pour cet agent.

  3. Vérifier le résultat

    Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.

Ce que vous pouvez créer avec Hermes Agent + GPT

  • Raisonnement complexe et tâches en plusieurs étapes

    Utilisez GPT via Hermes Agent pour le raisonnement complexe, le refactoring et les workflows automatisés en plusieurs étapes.

  • Traitement par lots avec sorties structurées

    Traitez de grands ensembles de documents avec un JSON contraint par schéma pour des pipelines RAG, la lecture de factures ou la classification de contenu.

  • Routage des modèles selon la complexité

    Envoyez les requêtes simples à une version de GPT plus petite et le raisonnement difficile à une version plus grande, via le même fournisseur et la même clé RunAPI.

Pourquoi utiliser GPT avec RunAPI + Hermes Agent

  • 15 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur Hermes Agent + GPT

Puis-je utiliser GPT dans Hermes Agent via RunAPI ?

Oui. Hermes Agent prend en charge les fournisseurs personnalisés compatibles OpenAI. Ajoutez RunAPI avec la configuration indiquée sur cette page et définissez comme modèle une version de GPT de la liste des versions.

L'API Responses fonctionne-t-elle via RunAPI dans Hermes Agent ?

RunAPI prend en charge pour GPT l'API Chat Completions et l'API Responses. Hermes Agent peut utiliser l'une ou l'autre avec la même clé API.

Hermes Agent peut-il changer de version de GPT à chaque requête ?

Oui. Modifiez uniquement le champ du modèle. Le fournisseur, l'URL de base et la clé API restent identiques.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.

Commencer à utiliser GPT avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter