Versions et endpoints publics
| ID du modèle | Endpoints | Prix de départ | Catalogue |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1M de tokens | Détail du modèle |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1M de tokens | Détail du modèle |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1M de tokens | Détail du modèle |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1M de tokens | Détail du modèle |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1M de tokens | Détail du modèle |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1M de tokens | Détail du modèle |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1M de tokens | Détail du modèle |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1M de tokens | Détail du modèle |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1M de tokens | Détail du modèle |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Détail du modèle |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Détail du modèle |
Vérification
Interrogez jusqu’à ce que la tâche atteigne un état final
Sélectionnez <model-id> pour générer les commandes de vérification.
Configuration
Endpoint du guide: <endpoint>
Sélectionnez <model-id> pour générer une requête conforme au contrat d’entrée public de l’endpoint.
Démarrer en 3 étapes
-
Choisir un ID de modèle
Sélectionnez un ID public du catalogue et consultez son endpoint et son prix de départ actuel.
-
Configurer RunAPI
Ajoutez la configuration du fournisseur pour cet agent.
-
Vérifier le résultat
Exécutez les commandes d’état et de sélection du modèle affichées ci-dessous.
Ce que vous pouvez créer avec Hermes Agent + Gemini
-
Agents multimodaux
Tirez parti des entrées multimodales de Gemini pour créer des workflows Hermes Agent qui raisonnent à la fois sur du texte, des images, de l'audio et de la vidéo.
-
Analyse de longs documents
Confiez à Gemini de grandes bases de code, des contrats ou des collections de recherche en une seule requête, puis laissez Hermes Agent poser des questions de suivi sur le même contenu.
-
Chaînes d'appels d'outils économiques
Utilisez une version Flash de Gemini pour des boucles d'outils rapides et peu coûteuses où l'agent enchaîne de nombreux appels.
Pourquoi utiliser Gemini avec RunAPI + Hermes Agent
-
11 variantes, une clé API
Utilisez une seule connexion RunAPI pour choisir parmi les variantes de modèle disponibles sans modifier votre intégration.
-
Des tarifs d'utilisation clairs
Consultez les tarifs actuels du catalogue avant d'envoyer une requête, sans abonnement ni dépense minimale.
-
Réponses directes
Les appels synchrones renvoient le résultat dans la même réponse : votre agent peut l'utiliser immédiatement, sans interroger l'état d'une tâche.
Questions sur Hermes Agent + Gemini
Puis-je utiliser Gemini dans Hermes Agent sans identifiants Google Cloud ?
Oui. RunAPI sert Gemini via son endpoint compatible OpenAI. Configurez RunAPI comme fournisseur dans Hermes Agent avec votre clé API RunAPI ; aucun projet Google Cloud ni configuration Vertex AI n'est requis.
Comment la mise en cache du contexte aide-t-elle avec de longs documents ?
Quand le même grand contexte est envoyé dans de nombreuses requêtes, la mise en cache réduit le coût d'entrée des appels suivants. Cela aide les boucles d'agent où instructions et documents de référence se répètent.
Hermes Agent peut-il passer de Gemini à d'autres modèles en cours de session ?
Oui. Tous les modèles de langage RunAPI partagent le même fournisseur et la même clé API, vous pouvez donc changer de modèle en cours de session sans modifier la configuration du fournisseur.
Quel ID de modèle utiliser ?
Choisissez un ID public dans le tableau des versions. Chaque ID expose les endpoints affichés sur sa ligne.
Ce guide configure-t-il un modèle de chat ?
Oui. Cette ligne de modèles prend en charge un protocole LLM côté client.