Versões e endpoints públicos
| ID do modelo | Endpoints | Preço inicial | Catálogo |
|---|---|---|---|
gemini-2.5-flash
|
/v1/chat/completions
|
$0.30 / 1M de tokens | Detalhes do modelo |
gemini-2.5-flash-lite
|
/v1/chat/completions
|
$0.10 / 1M de tokens | Detalhes do modelo |
gemini-2.5-pro
|
/v1/chat/completions
|
$1.25 / 1M de tokens | Detalhes do modelo |
gemini-3-flash-preview
|
/v1/chat/completions
/v1beta/models/gemini-3-flash-preview:streamGenerateContent
|
$0.30 / 1M de tokens | Detalhes do modelo |
gemini-3.1-flash-lite
|
/v1/chat/completions
|
$0.25 / 1M de tokens | Detalhes do modelo |
gemini-3.1-pro-preview
|
/v1/chat/completions
|
$1.00 / 1M de tokens | Detalhes do modelo |
gemini-3.5-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash:streamGenerateContent
|
$0.90 / 1M de tokens | Detalhes do modelo |
gemini-3.5-flash-lite
|
/v1/chat/completions
/v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
|
$0.15 / 1M de tokens | Detalhes do modelo |
gemini-3.6-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.6-flash:streamGenerateContent
|
$0.75 / 1M de tokens | Detalhes do modelo |
gemini-3.7-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.7-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Detalhes do modelo |
gemini-3.8-flash
|
/v1/chat/completions
/v1beta/models/gemini-3.8-flash:streamGenerateContent
|
$0.45 / 1M de tokens | Detalhes do modelo |
Verificar
Consulte até que a Task alcance um estado final
Selecione <model-id> para gerar os comandos de verificação.
Configuração
Endpoint do guia: <endpoint>
Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Comece em 3 passos
-
Escolha um ID de modelo
Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.
-
Configure o RunAPI
Adicione a configuração do provedor para este agente.
-
Verifique o resultado
Execute os comandos de status e seleção de modelo mostrados abaixo.
O que criar com Hermes Agent + Gemini
-
Agentes multimodais
Aproveite a entrada multimodal do Gemini para criar fluxos do Hermes Agent que raciocinam sobre texto, imagens, áudio e vídeo ao mesmo tempo.
-
Análise de documentos longos
Envie ao Gemini grandes bases de código, contratos ou coleções de pesquisa em uma única requisição e deixe o Hermes Agent fazer perguntas de acompanhamento sobre o mesmo material.
-
Cadeias de chamadas de ferramentas econômicas
Rode uma versão Flash do Gemini em loops de ferramentas rápidos e baratos, em que o agente faz muitas chamadas em sequência.
Por que usar Gemini pelo RunAPI + Hermes Agent
-
11 variantes, uma chave de API
Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.
-
Preços de uso claros
Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.
-
Respostas diretas
Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.
Perguntas sobre Hermes Agent + Gemini
Posso usar o Gemini no Hermes Agent sem credenciais do Google Cloud?
Sim. A RunAPI oferece o Gemini pelo seu endpoint compatível com a OpenAI. Configure a RunAPI como provedor no Hermes Agent com sua chave de API da RunAPI; não é preciso projeto do Google Cloud nem configuração do Vertex AI.
Como o cache de contexto ajuda com documentos longos?
Quando o mesmo contexto grande é enviado em muitas requisições, o cache reduz o custo de entrada das chamadas seguintes. Isso ajuda em loops de agente em que instruções e material de referência se repetem.
O Hermes Agent pode alternar entre o Gemini e outros modelos no meio da sessão?
Sim. Todos os modelos de linguagem da RunAPI compartilham o mesmo provedor e a mesma chave de API, então você pode trocar de modelo durante a sessão sem mudar a configuração do provedor.
Qual ID de modelo devo usar?
Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.
Este guia configura um modelo de chat?
Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.