Gebruik DeepSeek in Hermes Agent.
DeepSeek V4 ondersteunt zowel OpenAI chat completions als Anthropic messages-protocollen via RunAPI. Hermes Agent verbindt via de custom:runapi-provider — dezelfde base URL en sleutel die je voor andere modellen gebruikt. Activeer de redeneermodus met een verzoekparameter. RunAPI prijst DeepSeek tegen 50% van het officiële tarief.
Use RunAPI to call DeepSeek V4 Pro through Hermes Agent's custom:runapi provider.
Requirements:
- Use the custom:runapi provider already configured in Hermes Agent
- Call the RunAPI chat completions endpoint at https://runapi.ai/v1/chat/completions
- Set model to "deepseek-v4-pro"
- The RUNAPI_API_KEY environment variable provides authorization
- The response streams back as SSE events in OpenAI chat completions format
- To enable reasoning, set thinking.type to "enabled" in the request body
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
Gebruik DeepSeek in Hermes Agent in drie stappen
Configureer RunAPI-provider
Stel de omgevingsvariabele RUNAPI_API_KEY in. Als je RunAPI al als custom:runapi in Hermes Agent hebt toegevoegd, werken dezelfde provider en sleutel voor DeepSeek — geen extra configuratie. Zo niet, voeg RunAPI toe met base_url https://runapi.ai/v1 en api_mode chat_completions.
export RUNAPI_API_KEY=runapi_xxx
Selecteer een DeepSeek-model
Schakel het model naar deepseek-v4-pro voor kwaliteit of deepseek-v4-flash voor snelheid. Beide gebruiken het /v1/chat/completions-endpoint via de custom:runapi-provider. Activeer redeneren door thinking.type op enabled in te stellen — geen apart modelentry nodig.
model: deepseek-v4-pro
Stream de reactie
Hermes Agent ontvangt de reactie als SSE-stream in OpenAI chat completions-formaat. Tokengebruik verschijnt in het laatste event. Wissel tussen DeepSeek, GPT en Claude-modellen zonder de providerconfiguratie te wijzigen — alleen het modelveld verandert.
stream: true
DeepSeek chat completions-parameters
| Parameter | Type | Beschrijving |
|---|---|---|
model |
string |
Verplicht. deepseek-v4-pro of deepseek-v4-flash. |
messages |
array |
Verplicht. Array van berichtobjecten met role (system, user, assistant) en content-velden. |
stream |
boolean |
Optioneel. Stel in op true voor SSE-streaming. Standaard false. |
max_tokens |
integer |
Optioneel. Maximum aantal te genereren tokens. |
temperature |
number |
Optioneel. Samplingtemperatuur tussen 0 en 2. Lagere waarden zijn meer deterministisch. |
thinking |
object |
Optioneel. Stel type in op "enabled" om de ingebouwde redeneermodus van DeepSeek te activeren. |
Wat is DeepSeek in Hermes Agent?
DeepSeek V4 is een budgetvriendelijke LLM die werkt via zowel OpenAI- als Anthropic-compatibele endpoints, wat het eenvoudig maakt om te wisselen in Hermes Agent-workflows. Via RunAPI is het beschikbaar zonder directe API-toegang tot DeepSeek.
DeepSeek-toepassingen
Evaluatie van zelf-hosting-alternatieven
Test DeepSeek via RunAPI's API voordat je besluit of je het zelf wilt hosten.
Redeneer-UI's bouwen die gedachtegang tonen
Activeer denkmodus en toon de denktokens in je UI voor transparante AI-redenering.
Hoog-volume batchverwerking tegen minimale kosten
Voer DeepSeek Flash uit voor snelle, goedkope verwerking van grote documentsets.
Vragen over DeepSeek + Hermes Agent
Ja. Als je custom:runapi al hebt geconfigureerd in Hermes Agent, schakel het model dan naar deepseek-v4-pro of deepseek-v4-flash. De base URL, API-sleutel en api_mode blijven gelijk. Gebruik hermes model of bewerk het configuratiebestand direct.
Ja. DeepSeek V4 werkt met zowel /v1/chat/completions (OpenAI-formaat) als /v1/messages (Anthropic-formaat) via RunAPI. Als je Hermes Agent-configuratie het Anthropic messages-oppervlak gebruikt, stel dan het model in op deepseek-v4-pro en het werkt zonder protocolwijzigingen.
Flash geeft prioriteit aan snelheid met lagere latentie en kosten. Pro geeft prioriteit aan kwaliteit met betere prestaties bij complex redeneren, coderen en meerstapstaken. Beide gebruiken hetzelfde endpoint en accepteren dezelfde parameters.
Geef thinking.type ingesteld op enabled mee in de request-body. Redeneermodus is een verzoekparameter, geen apart model. De redeneertokens worden gefactureerd als uitvoertokens. Dit werkt via zowel het OpenAI- als het Anthropic-protocoloppervlak.
RunAPI prijst DeepSeek-tokens tegen 50% van het officiële DeepSeek-tarief. Aangezien DeepSeek al goedkoper is dan GPT en Claude per token, krijg je via RunAPI de laagste prijs per token voor een redeneerbaar LLM. Geen abonnement, geen minimum — betaal per token.
Algemene Hermes Agent-configuratie
Nog niet geconfigureerd? Begin met de RunAPI-configuratiegids voor Hermes Agent.
Hermes Agent-configuratiegids →DeepSeek-modelcatalogus
Bekijk DeepSeek V4-varianten, prijzen en API-documentatie.
DeepSeek-modellen →Probeer DeepSeek in Hermes Agent vandaag.
Haal een gratis RunAPI-sleutel, stel het model in op deepseek-v4-pro in Hermes Agent en begin te redeneren tegen de helft van de kosten van directe DeepSeek-toegang.