Versiones y endpoints públicos
| ID del modelo | Endpoints | Precio inicial | Catálogo |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1M de tokens | Detalle del modelo |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1M de tokens | Detalle del modelo |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1M de tokens | Detalle del modelo |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1M de tokens | Detalle del modelo |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1M de tokens | Detalle del modelo |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1M de tokens | Detalle del modelo |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1M de tokens | Detalle del modelo |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1M de tokens | Detalle del modelo |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1M de tokens | Detalle del modelo |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Detalle del modelo |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Detalle del modelo |
Verificar
Consulta hasta que la tarea alcance un estado final
Selecciona <model-id> para generar los comandos de verificación.
Configuración
Endpoint de la guía: <endpoint>
Selecciona <model-id> para generar una solicitud con el contrato de entrada público del endpoint.
Empieza en 3 pasos
-
Elige un ID de modelo
Selecciona un ID público del catálogo y revisa su endpoint y precio inicial actual.
-
Configura RunAPI
Añade la configuración del proveedor para este agente.
-
Verifica el resultado
Ejecuta los comandos de estado y selección de modelo mostrados abajo.
Qué puedes crear con Hermes Agent + Gemini
-
Agentes multimodales
Aprovecha la entrada multimodal de Gemini para crear flujos de Hermes Agent que razonan sobre texto, imágenes, audio y vídeo a la vez.
-
Análisis de documentos largos
Da a Gemini grandes bases de código, contratos o colecciones de investigación en una sola petición y deja que Hermes Agent haga preguntas de seguimiento sobre el mismo material.
-
Cadenas de llamadas a herramientas eficientes en coste
Ejecuta una versión Flash de Gemini en bucles de herramientas rápidos y económicos donde el agente hace muchas llamadas seguidas.
Por qué usar Gemini con RunAPI + Hermes Agent
-
11 variantes, una clave de API
Usa una sola conexión de RunAPI para elegir entre las variantes de modelo disponibles sin cambiar tu integración.
-
Precios de uso claros
Consulta los precios actuales del catálogo antes de enviar una solicitud, sin suscripción ni gasto mínimo.
-
Respuestas directas
Las llamadas síncronas devuelven el resultado en la misma respuesta, así tu agente puede usarlo de inmediato sin consultar el estado de una tarea.
Preguntas sobre Hermes Agent + Gemini
¿Puedo usar Gemini en Hermes Agent sin credenciales de Google Cloud?
Sí. RunAPI sirve Gemini a través de su endpoint compatible con OpenAI. Configura RunAPI como proveedor en Hermes Agent con tu clave de API de RunAPI; no necesitas un proyecto de Google Cloud ni configurar Vertex AI.
¿Cómo ayuda la caché de contexto con documentos largos?
Cuando el mismo contexto grande se envía en muchas peticiones, la caché reduce el coste de entrada de las llamadas posteriores. Esto ayuda en bucles de agente donde se repiten instrucciones y material de referencia.
¿Hermes Agent puede cambiar entre Gemini y otros modelos en mitad de una sesión?
Sí. Todos los modelos de lenguaje de RunAPI comparten el mismo proveedor y la misma clave de API, así que puedes cambiar de modelo durante una sesión sin tocar la configuración del proveedor.
¿Qué ID de modelo debo usar?
Elige un ID público en la tabla de versiones. Cada ID expone los endpoints mostrados en su fila.
¿Esta guía configura un modelo de chat?
Sí. Esta línea de modelos admite un protocolo LLM para clientes.