DeepSeek in Hermes Agent verwenden.
DeepSeek V4 unterstützt sowohl OpenAI-Chat-Completions als auch Anthropic-Messages-Protokolle über RunAPI. Hermes Agent verbindet sich über den custom:runapi-Provider — gleiche Base URL und gleicher Key wie für andere Modelle. Reasoning-Modus mit einem Request-Parameter aktivieren. RunAPI berechnet DeepSeek zu 50% der offiziellen Preise.
RunAPI verwenden, um DeepSeek V4 Pro über Hermes Agents custom:runapi-Provider aufzurufen.
Requirements:
- Use the custom:runapi provider already configured in Hermes Agent
- Call the RunAPI chat completions endpoint at https://runapi.ai/v1/chat/completions
- Set model to "deepseek-v4-pro"
- The RUNAPI_API_KEY environment variable provides authorization
- The response streams back as SSE events in OpenAI chat completions format
- To enable reasoning, set thinking.type to "enabled" in the request body
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
DeepSeek in Hermes Agent in drei Schritten verwenden
RunAPI Provider konfigurieren
Die RUNAPI_API_KEY-Umgebungsvariable setzen. Wenn RunAPI bereits als custom:runapi in Hermes Agent hinzugefügt wurde, funktionieren derselbe Provider und derselbe Key für DeepSeek — keine zusätzliche Konfiguration. Andernfalls RunAPI mit base_url https://runapi.ai/v1 und api_mode chat_completions hinzufügen.
export RUNAPI_API_KEY=runapi_xxx
Ein DeepSeek-Modell auswählen
Das Modell auf deepseek-v4-pro für Qualität oder deepseek-v4-flash für Geschwindigkeit wechseln. Beide verwenden den /v1/chat/completions-Endpunkt über den custom:runapi-Provider. Reasoning durch Übergabe von thinking.type auf enabled aktivieren — kein separater Modell-Eintrag nötig.
model: deepseek-v4-pro
Antwort streamen
Hermes Agent empfängt die Antwort als SSE-Stream im OpenAI-Chat-Completions-Format. Token-Usage erscheint im letzten Event. Zwischen DeepSeek-, GPT- und Claude-Modellen wechseln, ohne die Provider-Konfiguration zu ändern — nur das model-Feld wechselt.
stream: true
DeepSeek Chat-Completions-Parameter
| Parameter | Typ | Beschreibung |
|---|---|---|
model |
string |
Erforderlich. deepseek-v4-pro oder deepseek-v4-flash. |
messages |
array |
Erforderlich. Array von Message-Objekten mit role (system, user, assistant) und content-Feldern. |
stream |
boolean |
Optional. Auf true für SSE-Streaming setzen. Standard false. |
max_tokens |
integer |
Optional. Maximale Anzahl zu generierender Token. |
temperature |
number |
Optional. Sampling-Temperatur zwischen 0 und 2. Niedrigere Werte sind deterministischer. |
thinking |
object |
Optional. type auf "enabled" setzen, um DeepSeeks eingebauten Reasoning-Modus zu aktivieren. |
Was ist DeepSeek mit Hermes Agent?
DeepSeek V4 ist ein budgetfreundliches LLM, das über RunAPI sowohl auf OpenAI- als auch auf Anthropic-Protokolloberflächen funktioniert. Hermes Agent ruft es über denselben custom:runapi-Provider auf, der für GPT und Claude verwendet wird – nur den Modell-Parameter ändern. Der eingebaute Reasoning-Modus aktiviert sich mit einem Request-Parameter und RunAPI berechnet DeepSeek zu 50 % der bereits niedrigen offiziellen Preise, was es zum günstigsten reasoning-fähigen Modell über einen einzigen API-Key macht.
DeepSeek Anwendungsfälle
Evaluierung der Self-Hosting-Alternative
DeepSeek über RunAPIs API testen, bevor entschieden wird, ob die Open-Source-Weights selbst gehostet werden sollen. Wenn API-Kosten unter dem Infrastruktur-Break-Even bleiben, die gehostete Version behalten. Wenn das Volumen es rechtfertigt, lokal mit demselben Modell deployen.
Reasoning-UIs mit Chain-of-Thought aufbauen
Denkmodus aktivieren und die Denk-Token in der UI anzeigen, damit Nutzer sehen können, wie das Modell ein Problem durchgearbeitet hat. Nützlich für Nachhilfe-Apps, Code-Debugging-Tools oder Entscheidungsunterstützungssysteme.
Hochvolumige Stapelverarbeitung zu Mindestkosten
DeepSeek Flash für schnelle, günstige Verarbeitung großer Dokumentensets, Klassifizierungsaufgaben oder Datenextraktionsjobs ausführen, bei denen Token-Kosten wichtiger sind als Spitzenqualität.
DeepSeek + Hermes Agent — Fragen
Ja. Wenn custom:runapi bereits in Hermes Agent konfiguriert ist, das Modell auf deepseek-v4-pro oder deepseek-v4-flash wechseln. Base URL, API-Key und api_mode bleiben gleich. hermes model oder die Konfigurationsdatei direkt bearbeiten.
Ja. DeepSeek V4 funktioniert sowohl mit /v1/chat/completions (OpenAI-Format) als auch mit /v1/messages (Anthropic-Format) über RunAPI. Wenn die Hermes-Agent-Konfiguration die Anthropic-Messages-Oberfläche verwendet, das Modell auf deepseek-v4-pro setzen und es funktioniert ohne Protokolländerungen.
Flash priorisiert Geschwindigkeit mit niedrigerer Latenz und geringeren Kosten. Pro priorisiert Qualität mit besserer Leistung bei komplexem Reasoning, Coding und mehrstufigen Aufgaben. Beide verwenden denselben Endpunkt und dieselben Parameter.
thinking.type auf enabled im Request-Body übergeben. Reasoning-Modus ist ein Request-Parameter, kein separates Modell. Die Reasoning-Token werden als Output-Token abgerechnet. Dies funktioniert über beide Protokoll-Oberflächen (OpenAI und Anthropic).
RunAPI berechnet DeepSeek-Token zu 50 % der offiziellen DeepSeek-Preise. Da DeepSeek bereits GPT und Claude bei den Token-Kosten unterbietet, macht das DeepSeek zum günstigsten verfügbaren reasoning-fähigen LLM über eine einzige API. Kein Abonnement, kein Minimum — pro Token bezahlen.
Hermes Agent Grundeinrichtung
Noch nicht eingerichtet? Mit der RunAPI-Einrichtungsanleitung für Hermes Agent starten.
Hermes Agent Einrichtungsanleitung →DeepSeek Modellkatalog
DeepSeek-V4-Varianten, Preise und API-Dokumentation ansehen.
DeepSeek models →DeepSeek in Hermes Agent noch heute ausprobieren.
Einen kostenlosen RunAPI-Key holen, das Modell in Hermes Agent auf deepseek-v4-pro setzen und zum halben Preis des direkten DeepSeek-Zugangs mit Reasoning starten.