Google · Texte

Hermes Agent x Gemini

Gemini est le LLM multimodal flagship de Google, disponible en variantes Flash (rapide) et Pro (raisonnement frontier). Via RunAPI, tous les modèles Gemini partagent la même forme d'API et la même facturation.

11 variants à partir de $0.10 / 1M de tokens Usage commercial pris en charge

Prerequisite: npx runapi mcp install

Prompt

Modèles de prompt

Utilisez gemini-2.5-flash lorsqu'il correspond à la tâche : Optimisé vitesse/coût ; contexte 1M ; référence de l'ancienne génération.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Optimisé vitesse/coût ; contexte 1M ; référence de l'ancienne génération
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite ; contexte 1M, thinking désactivé par défaut ; Chat Completions compatible OpenAI
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Meilleur raisonnement de la génération 2.5 ; contexte 1M
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite ; contexte 1M, thinking réglable ; requêtes texte via Chat Completions compatible OpenAI
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Streaming multimodal rapide pour les charges de production à haut volume
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Gemini léger pour générer du texte via Chat Completions ou le streaming de contenu natif
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Chat, outils et streaming multimodaux rapides pour la production
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Chat en streaming rapide et sortie de contenu native avec rapports d'utilisation
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Chat textuel avec appel de fonctions et streaming de contenu natif pour les charges d'agents
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analysez cette base de code et suggérez trois améliorations de performance avec des exemples avant/après.
Verify the active model with: hermes model;hermes doctor

Versions et endpoints publics

ID du modèle Endpoints Prix de départ Catalogue
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1M de tokens Détail du modèle
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1M de tokens Détail du modèle
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1M de tokens Détail du modèle
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1M de tokens Détail du modèle
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1M de tokens Détail du modèle
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1M de tokens Détail du modèle
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1M de tokens Détail du modèle
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1M de tokens Détail du modèle
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1M de tokens Détail du modèle
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1M de tokens Détail du modèle
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1M de tokens Détail du modèle

Vérification

Interrogez jusqu’à ce que la tâche atteigne un état final

Sélectionnez <model-id> pour générer les commandes de vérification.

Configuration

Endpoint du guide: <endpoint>

Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Fonctionnement

Démarrer en 3 étapes

  1. Choisir un ID de modèle

    Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.

  2. Configurer RunAPI

    Ajoutez la configuration du fournisseur pour cet agent.

  3. Vérifier le résultat

    Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.

Ce que vous pouvez créer avec Hermes Agent + Gemini

  • Agents multimodaux

    Tirez parti des entrées multimodales de Gemini pour créer des workflows Hermes Agent qui raisonnent à la fois sur du texte, des images, de l'audio et de la vidéo.

  • Analyse de longs documents

    Confiez à Gemini de grandes bases de code, des contrats ou des collections de recherche en une seule requête, puis laissez Hermes Agent poser des questions de suivi sur le même contenu.

  • Chaînes d'appels d'outils économiques

    Utilisez une version Flash de Gemini pour des boucles d'outils rapides et peu coûteuses où l'agent enchaîne de nombreux appels.

Pourquoi utiliser Gemini avec RunAPI + Hermes Agent

  • 11 variantes, une clé API

    Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.

  • Des tarifs d'utilisation clairs

    Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.

  • Réponses directes

    Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.

Questions sur Hermes Agent + Gemini

Puis-je utiliser Gemini dans Hermes Agent sans identifiants Google Cloud ?

Oui. RunAPI sert Gemini via son endpoint compatible OpenAI. Configurez RunAPI comme fournisseur dans Hermes Agent avec votre clé API RunAPI ; aucun projet Google Cloud ni configuration Vertex AI n'est requis.

Comment la mise en cache du contexte aide-t-elle avec de longs documents ?

Quand le même grand contexte est envoyé dans de nombreuses requêtes, la mise en cache réduit le coût d'entrée des appels suivants. Cela aide les boucles d'agent où instructions et documents de référence se répètent.

Hermes Agent peut-il passer de Gemini à d'autres modèles en cours de session ?

Oui. Tous les modèles de langage RunAPI partagent le même fournisseur et la même clé API, vous pouvez donc changer de modèle en cours de session sans modifier la configuration du fournisseur.

Quel ID de modèle utiliser ?

Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.

Ce guide configure-t-il un modèle de chat ?

Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.

Commencer à utiliser Gemini avec Hermes Agent

Vous construisez avec une équipe ?

Nous vous aidons pour la mise en place entreprise, les intégrations et les questions techniques.

Nous contacter