Usa DeepSeek in Hermes Agent.
DeepSeek V4 supporta sia il protocollo OpenAI chat completions che quello Anthropic messages tramite RunAPI. Hermes Agent si connette tramite il provider custom:runapi — stesso base URL e key che usi per gli altri modelli. Attiva la modalità di ragionamento con un parametro di richiesta. RunAPI applica i prezzi DeepSeek al 50% delle tariffe ufficiali.
Usa RunAPI per chiamare DeepSeek V4 Pro tramite il provider custom:runapi di Hermes Agent.
Requisiti:
- Usa il provider custom:runapi già configurato in Hermes Agent
- Chiama l'endpoint chat completions di RunAPI su https://runapi.ai/v1/chat/completions
- Imposta model su "deepseek-v4-pro"
- La variabile d'ambiente RUNAPI_API_KEY fornisce l'autorizzazione
- La risposta viene restituita in streaming come eventi SSE nel formato OpenAI chat completions
- Per abilitare il ragionamento, imposta thinking.type su "enabled" nel corpo della richiesta
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
Usa DeepSeek in Hermes Agent in tre passaggi
Configura il provider RunAPI
Imposta la variabile d'ambiente RUNAPI_API_KEY. Se hai già aggiunto RunAPI come custom:runapi in Hermes Agent, lo stesso provider e key funzionano per DeepSeek — nessuna configurazione aggiuntiva. In caso contrario, aggiungi RunAPI con base_url https://runapi.ai/v1 e api_mode chat_completions.
export RUNAPI_API_KEY=runapi_xxx
Seleziona un modello DeepSeek
Passa il model su deepseek-v4-pro per la qualità o deepseek-v4-flash per la velocità. Entrambi usano l'endpoint /v1/chat/completions tramite il provider custom:runapi. Abilita il ragionamento passando thinking.type impostato su enabled — nessuna voce di modello separata necessaria.
model: deepseek-v4-pro
Ricevi la risposta in streaming
Hermes Agent riceve la risposta come flusso SSE nel formato OpenAI chat completions. L'utilizzo dei token appare nell'evento finale. Passa tra i modelli DeepSeek, GPT e Claude senza cambiare la configurazione del provider — cambia solo il campo model.
stream: true
Parametri chat completions DeepSeek
| Parametro | Tipo | Descrizione |
|---|---|---|
model |
string |
Obbligatorio. deepseek-v4-pro o deepseek-v4-flash. |
messages |
array |
Obbligatorio. Array di oggetti messaggio con i campi role (system, user, assistant) e content. |
stream |
boolean |
Facoltativo. Imposta su true per lo streaming SSE. Predefinito false. |
max_tokens |
integer |
Facoltativo. Numero massimo di token da generare. |
temperature |
number |
Facoltativo. Temperatura di campionamento tra 0 e 2. Valori più bassi sono più deterministici. |
thinking |
object |
Facoltativo. Imposta type su "enabled" per attivare la modalità di ragionamento integrata di DeepSeek. |
Cos'è DeepSeek su Hermes Agent?
DeepSeek V4 è un LLM economico che funziona tramite le superfici di protocollo OpenAI e Anthropic su RunAPI. Hermes Agent lo chiama tramite lo stesso provider custom:runapi usato per GPT e Claude -- basta cambiare il parametro model. La modalità di ragionamento integrata si attiva con un parametro di richiesta, e RunAPI fattura DeepSeek al 50 % delle già basse tariffe ufficiali, rendendolo il modello capace di ragionamento più economico disponibile tramite una singola API key.
Casi d'uso di DeepSeek
Valutazione dell'alternativa self-hosted
Testare DeepSeek tramite l'API di RunAPI prima di decidere se ospitare autonomamente i pesi open source. Se i costi API rimangono al di sotto del punto di pareggio dell'infrastruttura, mantenere la versione ospitata. Se il volume lo giustifica, distribuire localmente con lo stesso modello.
Costruzione di UI di ragionamento che mostrino il chain-of-thought
Abilitare la modalità di pensiero e mostrare i token di pensiero nella UI in modo che gli utenti possano vedere come il modello ha elaborato un problema. Utile per app di tutoraggio, strumenti di debug del codice o sistemi di supporto alle decisioni.
Elaborazione batch ad alto volume a costo minimo
Eseguire DeepSeek Flash per l'elaborazione rapida ed economica di grandi set di documenti, task di classificazione o job di estrazione dati dove il costo per token è più importante della qualità massima.
Domande su DeepSeek + Hermes Agent
Sì. Se hai già custom:runapi configurato in Hermes Agent, passa il model su deepseek-v4-pro o deepseek-v4-flash. Il base URL, la API key e l'api_mode rimangono gli stessi. Usa hermes model o modifica direttamente il file di configurazione.
Sì. DeepSeek V4 funziona sia con /v1/chat/completions (formato OpenAI) sia con /v1/messages (formato Anthropic) tramite RunAPI. Se la tua configurazione Hermes Agent usa la superficie Anthropic messages, imposta il model su deepseek-v4-pro e funziona senza modifiche al protocollo.
Flash privilegia la velocità con latenza e costo inferiori. Pro privilegia la qualità con prestazioni migliori su ragionamento complesso, programmazione e task multi-step. Entrambi usano lo stesso endpoint e accettano gli stessi parametri.
Passa thinking.type impostato su enabled nel corpo della richiesta. La modalità di ragionamento è un parametro di richiesta, non un modello separato. I token di ragionamento vengono fatturati come token di output. Funziona tramite entrambe le superfici di protocollo OpenAI e Anthropic.
RunAPI applica i prezzi per i token DeepSeek al 50% delle tariffe ufficiali DeepSeek. Poiché DeepSeek già supera GPT e Claude nel costo per token, questo lo rende il modello LLM con capacità di ragionamento a prezzo più basso disponibile tramite una singola API. Nessun abbonamento, nessun minimo — paghi per token.
Configurazione generale di Hermes Agent
Non ancora configurato? Inizia con la guida di configurazione RunAPI per Hermes Agent.
Guida di configurazione di Hermes Agent →Catalogo modelli DeepSeek
Vedi le varianti DeepSeek V4, i prezzi e la documentazione API.
Modelli DeepSeek →Prova DeepSeek in Hermes Agent oggi.
Ottieni una API key RunAPI gratuita, imposta il model su deepseek-v4-pro in Hermes Agent e inizia a ragionare alla metà del costo dell'accesso diretto a DeepSeek.