Google · Texto

Hermes Agent x Gemini

Gemini es el LLM multimodal insignia de Google, disponible en variantes Flash (rápido) y Pro (razonamiento frontera). A través de RunAPI, todos los modelos Gemini comparten la misma forma de API y facturación.

11 variants desde $0.10 / 1M de tokens Uso comercial compatible

Prerequisite: npx runapi mcp install

Prompt

Modelos del prompt

Usa gemini-2.5-flash cuando encaje con la tarea: Optimizado en velocidad/coste; contexto 1M; baseline de generación anterior.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Optimizado en velocidad/coste; contexto 1M; baseline de generación anterior
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; contexto 1M, thinking desactivado por defecto; Chat Completions compatible con OpenAI
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Mejor razonamiento de la generación 2.5; contexto 1M
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; contexto 1M, thinking ajustable; peticiones de texto con Chat Completions compatible con OpenAI
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Streaming multimodal rápido para cargas de trabajo de producción de alto volumen
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Gemini ligero para generar texto mediante Chat Completions o streaming de contenido nativo
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Chat, herramientas y streaming multimodal rápidos para producción
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Chat con streaming rápido y salida de contenido nativa con informes de uso
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Chat de texto con llamadas a funciones y streaming de contenido nativo para cargas de agentes
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analiza esta base de código y sugiere tres mejoras de rendimiento con ejemplos antes/después.
Verify the active model with: hermes model;hermes doctor

Versiones y endpoints públicos

ID del modelo Endpoints Precio inicial Catálogo
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1M de tokens Detalle del modelo
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1M de tokens Detalle del modelo
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1M de tokens Detalle del modelo
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1M de tokens Detalle del modelo
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1M de tokens Detalle del modelo
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1M de tokens Detalle del modelo
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1M de tokens Detalle del modelo
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1M de tokens Detalle del modelo
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1M de tokens Detalle del modelo
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1M de tokens Detalle del modelo
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1M de tokens Detalle del modelo

Verificar

Consulta hasta que la tarea alcance un estado final

Selecciona <model-id> para generar los comandos de verificación.

Configuración

Endpoint de la guía: <endpoint>

Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Cómo funciona

Empieza en 3 pasos

  1. Elige un ID de modelo

    Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.

  2. Configura RunAPI

    Añade la configuración del proveedor para este agente.

  3. Verifica el resultado

    Ejecuta los comandos de estado y selección de modelo mostrados abajo.

Qué puedes crear con Hermes Agent + Gemini

  • Agentes multimodales

    Aprovecha la entrada multimodal de Gemini para crear flujos de Hermes Agent que razonan sobre texto, imágenes, audio y vídeo a la vez.

  • Análisis de documentos largos

    Da a Gemini grandes bases de código, contratos o colecciones de investigación en una sola petición y deja que Hermes Agent haga preguntas de seguimiento sobre el mismo material.

  • Cadenas de llamadas a herramientas eficientes en coste

    Ejecuta una versión Flash de Gemini en bucles de herramientas rápidos y económicos donde el agente hace muchas llamadas seguidas.

Por qué usar Gemini con RunAPI + Hermes Agent

  • 11 variantes, una clave de API

    Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.

  • Precios de uso claros

    Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.

  • Respuestas directas

    Las llamadas síncronas devuelven el resultado en la misma respuesta, así tu agente puede usarlo de inmediato sin consultar el estado de una tarea.

Preguntas sobre Hermes Agent + Gemini

¿Puedo usar Gemini en Hermes Agent sin credenciales de Google Cloud?

Sí. RunAPI sirve Gemini a través de su endpoint compatible con OpenAI. Configura RunAPI como proveedor en Hermes Agent con tu clave de API de RunAPI; no necesitas un proyecto de Google Cloud ni configurar Vertex AI.

¿Cómo ayuda la caché de contexto con documentos largos?

Cuando el mismo contexto grande se envía en muchas peticiones, la caché reduce el coste de entrada de las llamadas posteriores. Esto ayuda en bucles de agente donde se repiten instrucciones y material de referencia.

¿Hermes Agent puede cambiar entre Gemini y otros modelos en mitad de una sesión?

Sí. Todos los modelos de lenguaje de RunAPI comparten el mismo proveedor y la misma clave de API, así que puedes cambiar de modelo durante una sesión sin tocar la configuración del proveedor.

¿Qué ID de modelo debo usar?

Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.

¿Esta guía configura un modelo de chat?

Sí. Esta línea de modelos admite un protocolo LLM para clientes.

Empieza a usar Gemini con Hermes Agent

¿Construyes con un equipo?

Te ayudamos con la configuración empresarial, las integraciones y las preguntas técnicas.

Contacta con nosotros