Google · Testo

Hermes Agent x Gemini

Gemini è l'LLM multimodale di punta di Google, disponibile nelle varianti Flash (veloce) e Pro (ragionamento all'avanguardia). Tramite RunAPI tutti i modelli Gemini condividono la stessa struttura API e la stessa fatturazione.

11 variants da $0.10 / 1M di token Uso commerciale consentito

Prerequisite: npx runapi mcp install

Prompt

Modelli del prompt

Usa gemini-2.5-flash quando è adatto all'attività: Ottimizzato per velocità/costi; contesto da 1M; riferimento della generazione precedente.

You have access to RunAPI chat models for Gemini.

Available Gemini models:
- gemini-2.5-flash: Ottimizzato per velocità/costi; contesto da 1M; riferimento della generazione precedente
  chat endpoints: /v1/chat/completions
- gemini-2.5-flash-lite: Gemini 2.5 Flash-Lite; contesto 1M, thinking disattivato per impostazione predefinita; Chat Completions compatibile OpenAI
  chat endpoints: /v1/chat/completions
- gemini-2.5-pro: Miglior ragionamento della generazione 2.5; contesto da 1M
  chat endpoints: /v1/chat/completions
- gemini-3-flash-preview: gemini-3-flash-preview
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3-flash-preview:streamGenerateContent
- gemini-3.1-flash-lite: Gemini 3.1 Flash-Lite; contesto 1M, thinking regolabile; richieste di testo con Chat Completions compatibile OpenAI
  chat endpoints: /v1/chat/completions
- gemini-3.1-pro-preview: gemini-3.1-pro-preview
  chat endpoints: /v1/chat/completions
- gemini-3.5-flash: Streaming multimodale veloce per carichi di produzione ad alto volume
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash:streamGenerateContent
- gemini-3.5-flash-lite: Gemini leggero per generare testo tramite Chat Completions o streaming di contenuti nativi
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
- gemini-3.6-flash: Chat, strumenti e streaming multimodali rapidi per la produzione
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.6-flash:streamGenerateContent
- gemini-3.7-flash: Chat in streaming rapido e output di contenuti nativi con report di utilizzo
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.7-flash:streamGenerateContent
- gemini-3.8-flash: Chat testuale con chiamata di funzioni e streaming di contenuti nativo per carichi di agenti
  chat endpoints: /v1/chat/completions, /v1beta/models/gemini-3.8-flash:streamGenerateContent

Use the model ID and chat endpoint that match the user's request.
Example request: Analizza questa codebase e suggerisci tre miglioramenti delle prestazioni con esempi prima/dopo.
Verify the active model with: hermes model;hermes doctor

Versioni ed endpoint pubblici

ID modello Endpoint Prezzo iniziale Catalogo
gemini-2.5-flash
/v1/chat/completions
$0.30 / 1M di token Dettagli modello
gemini-2.5-flash-lite
/v1/chat/completions
$0.10 / 1M di token Dettagli modello
gemini-2.5-pro
/v1/chat/completions
$1.25 / 1M di token Dettagli modello
gemini-3-flash-preview
/v1/chat/completions /v1beta/models/gemini-3-flash-preview:streamGenerateContent
$0.30 / 1M di token Dettagli modello
gemini-3.1-flash-lite
/v1/chat/completions
$0.25 / 1M di token Dettagli modello
gemini-3.1-pro-preview
/v1/chat/completions
$1.00 / 1M di token Dettagli modello
gemini-3.5-flash
/v1/chat/completions /v1beta/models/gemini-3.5-flash:streamGenerateContent
$0.90 / 1M di token Dettagli modello
gemini-3.5-flash-lite
/v1/chat/completions /v1beta/models/gemini-3.5-flash-lite:streamGenerateContent
$0.15 / 1M di token Dettagli modello
gemini-3.6-flash
/v1/chat/completions /v1beta/models/gemini-3.6-flash:streamGenerateContent
$0.75 / 1M di token Dettagli modello
gemini-3.7-flash
/v1/chat/completions /v1beta/models/gemini-3.7-flash:streamGenerateContent
$0.45 / 1M di token Dettagli modello
gemini-3.8-flash
/v1/chat/completions /v1beta/models/gemini-3.8-flash:streamGenerateContent
$0.45 / 1M di token Dettagli modello

Verifica

Esegui il polling finché la Task non raggiunge uno stato terminale

Seleziona <model-id> per generare i comandi di verifica.

Configurazione

Endpoint della guida: <endpoint>

Seleziona <model-id> per generare una richiesta con il contratto di input pubblico dell’endpoint.
Come funziona

Inizia in 3 passaggi

  1. Scegli un ID modello

    Seleziona un ID pubblico del catalogo e controlla il relativo endpoint e il prezzo iniziale corrente.

  2. Configura RunAPI

    Aggiungi la configurazione del provider per questo agente.

  3. Verifica il risultato

    Esegui i comandi di stato e selezione del modello mostrati sotto.

Cosa puoi creare con Hermes Agent + Gemini

  • Agenti multimodali

    Sfrutta l'input multimodale di Gemini per creare workflow di Hermes Agent che ragionano insieme su testo, immagini, audio e video.

  • Analisi di documenti lunghi

    Affida a Gemini grandi codebase, contratti o collezioni di ricerca in un'unica richiesta e lascia che Hermes Agent faccia domande di approfondimento sullo stesso materiale.

  • Catene di chiamate agli strumenti economiche

    Esegui una versione Flash di Gemini per loop di strumenti rapidi ed economici in cui l'agente effettua molte chiamate in sequenza.

Perché usare Gemini con RunAPI + Hermes Agent

  • 11 varianti, una chiave API

    Usa una sola connessione RunAPI per scegliere tra le varianti del modello disponibili senza modificare la tua integrazione.

  • Prezzi d'uso chiari

    Visualizza i prezzi attuali del catalogo prima di inviare una richiesta, senza abbonamento o spesa minima.

  • Risposte dirette

    Le chiamate sincrone restituiscono il risultato nella stessa risposta, così il tuo agente può usarlo subito senza interrogare lo stato di un task.

Domande su Hermes Agent + Gemini

Posso usare Gemini in Hermes Agent senza credenziali Google Cloud?

Sì. RunAPI serve Gemini tramite il suo endpoint compatibile con OpenAI. Configura RunAPI come provider in Hermes Agent con la tua chiave API RunAPI; non servono un progetto Google Cloud o una configurazione Vertex AI.

Come aiuta il caching del contesto con i documenti lunghi?

Quando lo stesso contesto ampio viene inviato in molte richieste, il caching riduce il costo di input delle chiamate successive. Questo aiuta nei loop degli agenti in cui istruzioni e materiali di riferimento si ripetono.

Hermes Agent può passare da Gemini ad altri modelli durante una sessione?

Sì. Tutti i modelli linguistici di RunAPI condividono lo stesso provider e la stessa chiave API, quindi puoi cambiare modello durante una sessione senza modificare la configurazione del provider.

Quale ID modello devo usare?

Scegli un ID pubblico dalla tabella delle versioni. Ogni ID espone gli endpoint mostrati nella sua riga.

Questa guida configura un modello di chat?

Sì. Questa linea di modelli supporta un protocollo LLM rivolto al client.

Inizia a usare Gemini con Hermes Agent

Stai costruendo con un team?

Ti aiutiamo con la configurazione enterprise, le integrazioni e le domande tecniche.

Contattaci