OpenAI · Texto

Hermes Agent x GPT

GPT é a família de LLMs frontier da OpenAI, abrangendo variants padrão e mini para diferentes trade-offs de custo e performance. Pelo RunAPI, todos os modelos GPT compartilham o mesmo formato de API e cobrança.

15 variants a partir de $0.06 / 1M de tokens Uso comercial permitido

Prerequisite: npx runapi mcp install

Prompt

Modelos de prompt

Use codex-auto-review quando ele corresponder à tarefa: codex-auto-review.

You have access to RunAPI chat models for GPT.

Available GPT models:
- codex-auto-review: codex-auto-review
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-4o-mini: Modelo GPT-4o rápido e econômico para tarefas de texto do dia a dia
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5-pro: GPT-5 Pro para análise e programação via API Responses
  chat endpoints: /v1/responses
- gpt-5.2: Trabalho profissional de conhecimento; Thinking mode para tarefas profundas
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4: Melhor coding + workflows agênticos; benchmark de código líder
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.4-mini: Alternativa custo-efetiva ao gpt-5.4; disponível no plano Free
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.4-nano: gpt-5.4-nano
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.5: Feito para tarefas agênticas de longo horizonte; melhor recuperação de erros
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-luna: Nível GPT-5.6 mais rápido e leve para resumos, rascunhos e automação do dia a dia
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-5.6-sol: Principal para as tarefas mais difíceis: codificação complexa, pesquisa profunda, agentes de longo horizonte
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-5.6-terra: Cavalo de batalha equilibrado para tarefas de alto volume; qualidade quase principal, custo-efetivo
  chat endpoints: /v1/responses, /v1/chat/completions
- gpt-6-astra: Modelo mais capaz: raciocínio avançado, contexto de 1M, geração de código e tarefas agênticas
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-luna: Nível GPT-6 mais rápido e leve: contexto de 1M para resumos, rascunhos e automação diária
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6-sol: Nível GPT-6 econômico: raciocínio sólido, contexto de 1M, programação e tarefas agênticas
  chat endpoints: /v1/chat/completions, /v1/responses
- gpt-6.1-sol: Nível GPT-6 econômico: raciocínio sólido, contexto de 1M, programação e tarefas agênticas
  chat endpoints: /v1/chat/completions, /v1/responses

Use the model ID and chat endpoint that match the user's request.
Example request: Analise estes dados de receita trimestral e produza um resumo com tendências principais, anomalias e três recomendações.
Verify the active model with: hermes model;hermes doctor

Versões e endpoints públicos

ID do modelo Endpoints Preço inicial Catálogo
codex-auto-review
/v1/chat/completions /v1/responses
$0.20 / 1M de tokens Detalhes do modelo
gpt-4o-mini
/v1/chat/completions /v1/responses
$0.15 / 1M de tokens Detalhes do modelo
gpt-5-pro
/v1/responses
$7.50 / 1M de tokens Detalhes do modelo
gpt-5.2
/v1/responses /v1/chat/completions
$1.75 / 1M de tokens Detalhes do modelo
gpt-5.4
/v1/responses /v1/chat/completions
$2.50 / 1M de tokens Detalhes do modelo
gpt-5.4-mini
/v1/chat/completions /v1/responses
$0.75 / 1M de tokens Detalhes do modelo
gpt-5.4-nano
/v1/responses /v1/chat/completions
$0.20 / 1M de tokens Detalhes do modelo
gpt-5.5
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Detalhes do modelo
gpt-5.6-luna
/v1/responses /v1/chat/completions
$0.20 / 1M de tokens Detalhes do modelo
gpt-5.6-sol
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Detalhes do modelo
gpt-5.6-terra
/v1/responses /v1/chat/completions
$2.00 / 1M de tokens Detalhes do modelo
gpt-6-astra
/v1/chat/completions /v1/responses
$5.00 / 1M de tokens Detalhes do modelo
gpt-6-luna
/v1/chat/completions /v1/responses
$0.06 / 1M de tokens Detalhes do modelo
gpt-6-sol
/v1/chat/completions /v1/responses
$1.20 / 1M de tokens Detalhes do modelo
gpt-6.1-sol
/v1/chat/completions /v1/responses
$1.00 / 1M de tokens Detalhes do modelo

Verificar

Consulte até que a Task alcance um estado final

Selecione <model-id> para gerar os comandos de verificação.

Configuração

Endpoint do guia: <endpoint>

Selecione <model-id> para gerar uma solicitação com o contrato público de entrada do endpoint.
Como funciona

Comece em 3 passos

  1. Escolha um ID de modelo

    Selecione um ID público do catálogo e confira seu endpoint e preço inicial atual.

  2. Configure o RunAPI

    Adicione a configuração do provedor para este agente.

  3. Verifique o resultado

    Execute os comandos de status e seleção de modelo mostrados abaixo.

O que criar com Hermes Agent + GPT

  • Raciocínio complexo e tarefas com várias etapas

    Use o GPT pelo Hermes Agent para raciocínio complexo, refatoração e fluxos automatizados com várias etapas.

  • Processamento em lote com saídas estruturadas

    Processe grandes conjuntos de documentos com JSON restrito por schema para pipelines de RAG, leitura de notas fiscais ou classificação de conteúdo.

  • Roteamento de modelos pela complexidade

    Envie consultas simples para uma versão menor do GPT e o raciocínio difícil para uma maior, tudo pelo mesmo provedor e pela mesma chave da RunAPI.

Por que usar GPT pelo RunAPI + Hermes Agent

  • 15 variantes, uma chave de API

    Use uma única conexão do RunAPI para escolher entre as variantes de modelo disponíveis sem mudar sua integração.

  • Preços de uso claros

    Consulte os preços atuais do catálogo antes de enviar uma solicitação, sem assinatura ou gasto mínimo.

  • Respostas diretas

    Chamadas síncronas retornam o resultado na mesma resposta, então seu agente pode usá-lo na hora, sem consultar o status de uma tarefa.

Perguntas sobre Hermes Agent + GPT

Posso usar o GPT no Hermes Agent pela RunAPI?

Sim. O Hermes Agent aceita provedores personalizados compatíveis com a OpenAI. Adicione a RunAPI com a configuração mostrada nesta página e defina como modelo uma versão do GPT da lista de versões.

A API Responses funciona pela RunAPI no Hermes Agent?

A RunAPI suporta para o GPT tanto a API Chat Completions quanto a API Responses. O Hermes Agent pode usar qualquer uma com a mesma chave de API.

O Hermes Agent pode trocar de versão do GPT a cada requisição?

Sim. Altere apenas o campo do modelo. O provedor, a URL base e a chave de API continuam os mesmos.

Qual ID de modelo devo usar?

Escolha um ID público na tabela de versões. Cada ID expõe os endpoints mostrados em sua linha.

Este guia configura um modelo de chat?

Sim. Esta linha de modelos oferece um protocolo LLM voltado ao cliente.

Comece a usar GPT com Hermes Agent

Construindo com uma equipe?

Ajudamos com a configuração empresarial, integrações e dúvidas técnicas.

Fale conosco