---
title: &quot;Usa DeepSeek in Hermes Agent tramite RunAPI — Guida API LLM&quot;
url: &quot;https://runapi.ai/it/hermes-deepseek.md&quot;
canonical: &quot;https://runapi.ai/it/hermes-deepseek&quot;
locale: &quot;it&quot;
model: &quot;deepseek&quot;
---

# Usa DeepSeek in Hermes Agent.

DeepSeek V4 supporta sia il protocollo OpenAI chat completions che quello Anthropic messages tramite RunAPI. Hermes Agent si connette tramite il provider custom:runapi — stesso base URL e key che usi per gli altri modelli. Attiva la modalità di ragionamento con un parametro di richiesta. RunAPI applica i prezzi DeepSeek al 50% delle tariffe ufficiali.

## API example

```bash
curl -X POST https://runapi.ai/v1/chat/completions \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
    &quot;messages&quot;: [
      {&quot;role&quot;: &quot;system&quot;, &quot;content&quot;: &quot;You are a helpful coding assistant.&quot;},
      {&quot;role&quot;: &quot;user&quot;, &quot;content&quot;: &quot;Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm.&quot;}
    ],
    &quot;stream&quot;: true,
    &quot;max_tokens&quot;: 4096
  }&#39;

```

### Response

```json
{
  &quot;id&quot;: &quot;chatcmpl-abc123&quot;,
  &quot;object&quot;: &quot;chat.completion&quot;,
  &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
  &quot;choices&quot;: [
    {
      &quot;index&quot;: 0,
      &quot;message&quot;: {
        &quot;role&quot;: &quot;assistant&quot;,
        &quot;content&quot;: &quot;Here is Manacher&#39;s algorithm implementation...&quot;
      },
      &quot;finish_reason&quot;: &quot;stop&quot;
    }
  ],
  &quot;usage&quot;: {
    &quot;prompt_tokens&quot;: 42,
    &quot;completion_tokens&quot;: 356,
    &quot;total_tokens&quot;: 398
  }
}

```

## How it works

1. **Configura il provider RunAPI** — Imposta la variabile d&#39;ambiente RUNAPI_API_KEY. Se hai già aggiunto RunAPI come custom:runapi in Hermes Agent, lo stesso provider e key funzionano per DeepSeek — nessuna configurazione aggiuntiva. In caso contrario, aggiungi RunAPI con base_url https://runapi.ai/v1 e api_mode chat_completions.
2. **Seleziona un modello DeepSeek** — Passa il model su deepseek-v4-pro per la qualità o deepseek-v4-flash per la velocità. Entrambi usano l&#39;endpoint /v1/chat/completions tramite il provider custom:runapi. Abilita il ragionamento passando thinking.type impostato su enabled — nessuna voce di modello separata necessaria.
3. **Ricevi la risposta in streaming** — Hermes Agent riceve la risposta come flusso SSE nel formato OpenAI chat completions. L&#39;utilizzo dei token appare nell&#39;evento finale. Passa tra i modelli DeepSeek, GPT e Claude senza cambiare la configurazione del provider — cambia solo il campo model.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Obbligatorio. deepseek-v4-pro o deepseek-v4-flash. |
| `messages` | `array` | Obbligatorio. Array di oggetti messaggio con i campi role (system, user, assistant) e content. |
| `stream` | `boolean` | Facoltativo. Imposta su true per lo streaming SSE. Predefinito false. |
| `max_tokens` | `integer` | Facoltativo. Numero massimo di token da generare. |
| `temperature` | `number` | Facoltativo. Temperatura di campionamento tra 0 e 2. Valori più bassi sono più deterministici. |
| `thinking` | `object` | Facoltativo. Imposta type su &quot;enabled&quot; per attivare la modalità di ragionamento integrata di DeepSeek. |

## FAQ

### Hermes Agent può usare DeepSeek tramite il provider RunAPI esistente?

Sì. Se hai già custom:runapi configurato in Hermes Agent, passa il model su deepseek-v4-pro o deepseek-v4-flash. Il base URL, la API key e l&#39;api_mode rimangono gli stessi. Usa hermes model o modifica direttamente il file di configurazione.

### DeepSeek su RunAPI supporta il protocollo Anthropic messages?

Sì. DeepSeek V4 funziona sia con /v1/chat/completions (formato OpenAI) sia con /v1/messages (formato Anthropic) tramite RunAPI. Se la tua configurazione Hermes Agent usa la superficie Anthropic messages, imposta il model su deepseek-v4-pro e funziona senza modifiche al protocollo.

### Qual è la differenza tra deepseek-v4-flash e deepseek-v4-pro?

Flash privilegia la velocità con latenza e costo inferiori. Pro privilegia la qualità con prestazioni migliori su ragionamento complesso, programmazione e task multi-step. Entrambi usano lo stesso endpoint e accettano gli stessi parametri.

### Come attivo la modalità di ragionamento per DeepSeek in Hermes Agent?

Passa thinking.type impostato su enabled nel corpo della richiesta. La modalità di ragionamento è un parametro di richiesta, non un modello separato. I token di ragionamento vengono fatturati come token di output. Funziona tramite entrambe le superfici di protocollo OpenAI e Anthropic.

### Come si confrontano i prezzi DeepSeek su RunAPI rispetto all&#39;utilizzo diretto di DeepSeek?

RunAPI applica i prezzi per i token DeepSeek al 50% delle tariffe ufficiali DeepSeek. Poiché DeepSeek già supera GPT e Claude nel costo per token, questo lo rende il modello LLM con capacità di ragionamento a prezzo più basso disponibile tramite una singola API. Nessun abbonamento, nessun minimo — paghi per token.


## Links

- [Guida di configurazione di Hermes Agent →](https://runapi.ai/it/hermes-agent)
- [Modelli DeepSeek →](https://runapi.ai/it/models/deepseek)
- [Model catalog](https://runapi.ai/it/models)
- [API docs](https://runapi.ai/it/docs)
