HERMES + DEEPSEEK

DeepSeek in Hermes Agent verwenden.

DeepSeek V4 unterstützt sowohl OpenAI-Chat-Completions als auch Anthropic-Messages-Protokolle über RunAPI. Hermes Agent verbindet sich über den custom:runapi-Provider — gleiche Base URL und gleicher Key wie für andere Modelle. Reasoning-Modus mit einem Request-Parameter aktivieren. RunAPI berechnet DeepSeek zu 50% der offiziellen Preise.

ein API-Key · OpenAI + Anthropic Protokolle · Streaming-Unterstützung
RunAPI verwenden, um DeepSeek V4 Pro über Hermes Agents custom:runapi-Provider aufzurufen.


      Requirements:

      - Use the custom:runapi provider already configured in Hermes Agent

      - Call the RunAPI chat completions endpoint at https://runapi.ai/v1/chat/completions

      - Set model to "deepseek-v4-pro"

      - The RUNAPI_API_KEY environment variable provides authorization

      - The response streams back as SSE events in OpenAI chat completions format

      - To enable reasoning, set thinking.type to "enabled" in the request body

      
curl -X POST https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "system", "content": "You are a helpful coding assistant."},
      {"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
    ],
    "stream": true,
    "max_tokens": 4096
  }'
{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "model": "deepseek-v4-pro",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Here is Manacher's algorithm implementation..."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 42,
    "completion_tokens": 356,
    "total_tokens": 398
  }
}
Den curl-Befehl kopieren und testen deepseek
SO FUNKTIONIERT ES

DeepSeek in Hermes Agent in drei Schritten verwenden

1

RunAPI Provider konfigurieren

Die RUNAPI_API_KEY-Umgebungsvariable setzen. Wenn RunAPI bereits als custom:runapi in Hermes Agent hinzugefügt wurde, funktionieren derselbe Provider und derselbe Key für DeepSeek — keine zusätzliche Konfiguration. Andernfalls RunAPI mit base_url https://runapi.ai/v1 und api_mode chat_completions hinzufügen.

export RUNAPI_API_KEY=runapi_xxx
2

Ein DeepSeek-Modell auswählen

Das Modell auf deepseek-v4-pro für Qualität oder deepseek-v4-flash für Geschwindigkeit wechseln. Beide verwenden den /v1/chat/completions-Endpunkt über den custom:runapi-Provider. Reasoning durch Übergabe von thinking.type auf enabled aktivieren — kein separater Modell-Eintrag nötig.

model: deepseek-v4-pro
3

Antwort streamen

Hermes Agent empfängt die Antwort als SSE-Stream im OpenAI-Chat-Completions-Format. Token-Usage erscheint im letzten Event. Zwischen DeepSeek-, GPT- und Claude-Modellen wechseln, ohne die Provider-Konfiguration zu ändern — nur das model-Feld wechselt.

stream: true
PARAMETER

DeepSeek Chat-Completions-Parameter

Parameter Typ Beschreibung
model string Erforderlich. deepseek-v4-pro oder deepseek-v4-flash.
messages array Erforderlich. Array von Message-Objekten mit role (system, user, assistant) und content-Feldern.
stream boolean Optional. Auf true für SSE-Streaming setzen. Standard false.
max_tokens integer Optional. Maximale Anzahl zu generierender Token.
temperature number Optional. Sampling-Temperatur zwischen 0 und 2. Niedrigere Werte sind deterministischer.
thinking object Optional. type auf "enabled" setzen, um DeepSeeks eingebauten Reasoning-Modus zu aktivieren.

Was ist DeepSeek mit Hermes Agent?

DeepSeek V4 ist ein budgetfreundliches LLM, das über RunAPI sowohl auf OpenAI- als auch auf Anthropic-Protokolloberflächen funktioniert. Hermes Agent ruft es über denselben custom:runapi-Provider auf, der für GPT und Claude verwendet wird – nur den Modell-Parameter ändern. Der eingebaute Reasoning-Modus aktiviert sich mit einem Request-Parameter und RunAPI berechnet DeepSeek zu 50 % der bereits niedrigen offiziellen Preise, was es zum günstigsten reasoning-fähigen Modell über einen einzigen API-Key macht.

DeepSeek Anwendungsfälle

Evaluierung der Self-Hosting-Alternative

DeepSeek über RunAPIs API testen, bevor entschieden wird, ob die Open-Source-Weights selbst gehostet werden sollen. Wenn API-Kosten unter dem Infrastruktur-Break-Even bleiben, die gehostete Version behalten. Wenn das Volumen es rechtfertigt, lokal mit demselben Modell deployen.

Reasoning-UIs mit Chain-of-Thought aufbauen

Denkmodus aktivieren und die Denk-Token in der UI anzeigen, damit Nutzer sehen können, wie das Modell ein Problem durchgearbeitet hat. Nützlich für Nachhilfe-Apps, Code-Debugging-Tools oder Entscheidungsunterstützungssysteme.

Hochvolumige Stapelverarbeitung zu Mindestkosten

DeepSeek Flash für schnelle, günstige Verarbeitung großer Dokumentensets, Klassifizierungsaufgaben oder Datenextraktionsjobs ausführen, bei denen Token-Kosten wichtiger sind als Spitzenqualität.

FAQ

DeepSeek + Hermes Agent — Fragen

Hermes Agent Grundeinrichtung

Noch nicht eingerichtet? Mit der RunAPI-Einrichtungsanleitung für Hermes Agent starten.

Hermes Agent Einrichtungsanleitung →

DeepSeek Modellkatalog

DeepSeek-V4-Varianten, Preise und API-Dokumentation ansehen.

DeepSeek models →

DeepSeek in Hermes Agent noch heute ausprobieren.

Einen kostenlosen RunAPI-Key holen, das Modell in Hermes Agent auf deepseek-v4-pro setzen und zum halben Preis des direkten DeepSeek-Zugangs mit Reasoning starten.