HERMES + DEEPSEEK

Usa DeepSeek in Hermes Agent.

DeepSeek V4 supporta sia il protocollo OpenAI chat completions che quello Anthropic messages tramite RunAPI. Hermes Agent si connette tramite il provider custom:runapi — stesso base URL e key che usi per gli altri modelli. Attiva la modalità di ragionamento con un parametro di richiesta. RunAPI applica i prezzi DeepSeek al 50% delle tariffe ufficiali.

una API key · protocolli OpenAI + Anthropic · supporto streaming
Usa RunAPI per chiamare DeepSeek V4 Pro tramite il provider custom:runapi di Hermes Agent.

Requisiti:
- Usa il provider custom:runapi già configurato in Hermes Agent
- Chiama l'endpoint chat completions di RunAPI su https://runapi.ai/v1/chat/completions
- Imposta model su "deepseek-v4-pro"
- La variabile d'ambiente RUNAPI_API_KEY fornisce l'autorizzazione
- La risposta viene restituita in streaming come eventi SSE nel formato OpenAI chat completions
- Per abilitare il ragionamento, imposta thinking.type su "enabled" nel corpo della richiesta
curl -X POST https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "system", "content": "You are a helpful coding assistant."},
      {"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
    ],
    "stream": true,
    "max_tokens": 4096
  }'
{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "model": "deepseek-v4-pro",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Here is Manacher's algorithm implementation..."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 42,
    "completion_tokens": 356,
    "total_tokens": 398
  }
}
Copia il comando curl per testare deepseek
COME FUNZIONA

Usa DeepSeek in Hermes Agent in tre passaggi

1

Configura il provider RunAPI

Imposta la variabile d'ambiente RUNAPI_API_KEY. Se hai già aggiunto RunAPI come custom:runapi in Hermes Agent, lo stesso provider e key funzionano per DeepSeek — nessuna configurazione aggiuntiva. In caso contrario, aggiungi RunAPI con base_url https://runapi.ai/v1 e api_mode chat_completions.

export RUNAPI_API_KEY=runapi_xxx
2

Seleziona un modello DeepSeek

Passa il model su deepseek-v4-pro per la qualità o deepseek-v4-flash per la velocità. Entrambi usano l'endpoint /v1/chat/completions tramite il provider custom:runapi. Abilita il ragionamento passando thinking.type impostato su enabled — nessuna voce di modello separata necessaria.

model: deepseek-v4-pro
3

Ricevi la risposta in streaming

Hermes Agent riceve la risposta come flusso SSE nel formato OpenAI chat completions. L'utilizzo dei token appare nell'evento finale. Passa tra i modelli DeepSeek, GPT e Claude senza cambiare la configurazione del provider — cambia solo il campo model.

stream: true
PARAMETRI

Parametri chat completions DeepSeek

Parametro Tipo Descrizione
model string Obbligatorio. deepseek-v4-pro o deepseek-v4-flash.
messages array Obbligatorio. Array di oggetti messaggio con i campi role (system, user, assistant) e content.
stream boolean Facoltativo. Imposta su true per lo streaming SSE. Predefinito false.
max_tokens integer Facoltativo. Numero massimo di token da generare.
temperature number Facoltativo. Temperatura di campionamento tra 0 e 2. Valori più bassi sono più deterministici.
thinking object Facoltativo. Imposta type su "enabled" per attivare la modalità di ragionamento integrata di DeepSeek.

Cos'è DeepSeek su Hermes Agent?

DeepSeek V4 è un LLM economico che funziona tramite le superfici di protocollo OpenAI e Anthropic su RunAPI. Hermes Agent lo chiama tramite lo stesso provider custom:runapi usato per GPT e Claude -- basta cambiare il parametro model. La modalità di ragionamento integrata si attiva con un parametro di richiesta, e RunAPI fattura DeepSeek al 50 % delle già basse tariffe ufficiali, rendendolo il modello capace di ragionamento più economico disponibile tramite una singola API key.

Casi d'uso di DeepSeek

Valutazione dell'alternativa self-hosted

Testare DeepSeek tramite l'API di RunAPI prima di decidere se ospitare autonomamente i pesi open source. Se i costi API rimangono al di sotto del punto di pareggio dell'infrastruttura, mantenere la versione ospitata. Se il volume lo giustifica, distribuire localmente con lo stesso modello.

Costruzione di UI di ragionamento che mostrino il chain-of-thought

Abilitare la modalità di pensiero e mostrare i token di pensiero nella UI in modo che gli utenti possano vedere come il modello ha elaborato un problema. Utile per app di tutoraggio, strumenti di debug del codice o sistemi di supporto alle decisioni.

Elaborazione batch ad alto volume a costo minimo

Eseguire DeepSeek Flash per l'elaborazione rapida ed economica di grandi set di documenti, task di classificazione o job di estrazione dati dove il costo per token è più importante della qualità massima.

FAQ

Domande su DeepSeek + Hermes Agent

Configurazione generale di Hermes Agent

Non ancora configurato? Inizia con la guida di configurazione RunAPI per Hermes Agent.

Guida di configurazione di Hermes Agent →

Catalogo modelli DeepSeek

Vedi le varianti DeepSeek V4, i prezzi e la documentazione API.

Modelli DeepSeek →

Prova DeepSeek in Hermes Agent oggi.

Ottieni una API key RunAPI gratuita, imposta il model su deepseek-v4-pro in Hermes Agent e inizia a ragionare alla metà del costo dell'accesso diretto a DeepSeek.