Google · Texto

Hermes Agent x Gemini

Gemini é o LLM multimodal flagship do Google, disponível em variants Flash (rápido) e Pro (raciocínio frontier). Pelo RunAPI, todos os modelos Gemini compartilham o mesmo formato de API e cobrança.

11 variants a partir de $0.10 / 1M de tokens Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use gemini-2.5-flash quando ele corresponder à tarefa: Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Otimizado para velocidade/custo; 1M contexto; baseline da geração anterior
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; contexto de 1M, thinking desativado por padrão; Chat Completions compatível com OpenAI
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Melhor raciocínio na geração 2.5; 1M contexto
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; contexto de 1M, thinking ajustável; requisições de texto pelo Chat Completions compatível com OpenAI
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Streaming multimodal rápido para workloads de produção em alto volume
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Gemini leve para geração de texto via Chat Completions ou streaming de conteúdo nativo
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Chat, ferramentas e streaming multimodal rápidos para produção
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Chat com streaming rápido e saída de conteúdo nativa com relatórios de uso
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Chat de texto com chamada de funções e streaming de conteúdo nativo para cargas de agentes
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analise esta base de código e sugira três melhorias de performance com exemplos antes/depois.
Verify the active model with: hermes model;hermes doctor

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1M de tokens Detalhes do modelo
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1M de tokens Detalhes do modelo
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1M de tokens Detalhes do modelo
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1M de tokens Detalhes do modelo
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1M de tokens Detalhes do modelo
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1M de tokens Detalhes do modelo
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1M de tokens Detalhes do modelo
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1M de tokens Detalhes do modelo
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1M de tokens Detalhes do modelo
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1M de tokens Detalhes do modelo
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1M de tokens Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Adicione a configuração do provedor para este agente.

  3. Verifique o resultado

    Execute os comandos de status e seleção de modelo mostrados abaixo.

O que criar com Hermes Agent + Gemini

  • Agentes multimodais

    Aproveite a entrada multimodal do Gemini para criar fluxos do Hermes Agent que raciocinam sobre texto, imagens, áudio e vídeo ao mesmo tempo.

  • Análise de documentos longos

    Envie ao Gemini grandes bases de código, contratos ou coleções de pesquisa em uma única requisição e deixe o Hermes Agent fazer perguntas de acompanhamento sobre o mesmo material.

  • Cadeias de chamadas de ferramentas econômicas

    Rode uma versão Flash do Gemini em loops de ferramentas rápidos e baratos, em que o agente faz muitas chamadas em sequência.

Por que usar Gemini pelo RunAPI + Hermes Agent

  • 11 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Respostas diretas

    Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.

Perguntas sobre Hermes Agent + Gemini

Posso usar o Gemini no Hermes Agent sem credenciais do Google Cloud?

Sim. A RunAPI oferece o Gemini pelo seu endpoint compatível com a OpenAI. Configure a RunAPI como provedor no Hermes Agent com sua chave de API da RunAPI; não é preciso projeto do Google Cloud nem configuração do Vertex AI.

Como o cache de contexto ajuda com documentos longos?

Quando o mesmo contexto grande é enviado em muitas requisições, o cache reduz o custo de entrada das chamadas seguintes. Isso ajuda em loops de agente em que instruções e material de referência se repetem.

O Hermes Agent pode alternar entre o Gemini e outros modelos no meio da sessão?

Sim. Todos os modelos de linguagem da RunAPI compartilham o mesmo provedor e a mesma chave de API, então você pode trocar de modelo durante a sessão sem mudar a configuração do provedor.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.

Comece a usar Gemini com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco