---
title: &quot;DeepSeek in Hermes Agent via RunAPI verwenden — LLM-API-Anleitung&quot;
url: &quot;https://runapi.ai/de/hermes-deepseek.md&quot;
canonical: &quot;https://runapi.ai/de/hermes-deepseek&quot;
locale: &quot;de&quot;
model: &quot;deepseek&quot;
---

# DeepSeek in Hermes Agent verwenden.

DeepSeek V4 unterstützt sowohl OpenAI-Chat-Completions als auch Anthropic-Messages-Protokolle über RunAPI. Hermes Agent verbindet sich über den custom:runapi-Provider — gleiche Base URL und gleicher Key wie für andere Modelle. Reasoning-Modus mit einem Request-Parameter aktivieren. RunAPI berechnet DeepSeek zu 50% der offiziellen Preise.

## API example

```bash
curl -X POST https://runapi.ai/v1/chat/completions \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
    &quot;messages&quot;: [
      {&quot;role&quot;: &quot;system&quot;, &quot;content&quot;: &quot;You are a helpful coding assistant.&quot;},
      {&quot;role&quot;: &quot;user&quot;, &quot;content&quot;: &quot;Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm.&quot;}
    ],
    &quot;stream&quot;: true,
    &quot;max_tokens&quot;: 4096
  }&#39;

```

### Response

```json
{
  &quot;id&quot;: &quot;chatcmpl-abc123&quot;,
  &quot;object&quot;: &quot;chat.completion&quot;,
  &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
  &quot;choices&quot;: [
    {
      &quot;index&quot;: 0,
      &quot;message&quot;: {
        &quot;role&quot;: &quot;assistant&quot;,
        &quot;content&quot;: &quot;Here is Manacher&#39;s algorithm implementation...&quot;
      },
      &quot;finish_reason&quot;: &quot;stop&quot;
    }
  ],
  &quot;usage&quot;: {
    &quot;prompt_tokens&quot;: 42,
    &quot;completion_tokens&quot;: 356,
    &quot;total_tokens&quot;: 398
  }
}

```

## How it works

1. **RunAPI Provider konfigurieren** — Die RUNAPI_API_KEY-Umgebungsvariable setzen. Wenn RunAPI bereits als custom:runapi in Hermes Agent hinzugefügt wurde, funktionieren derselbe Provider und derselbe Key für DeepSeek — keine zusätzliche Konfiguration. Andernfalls RunAPI mit base_url https://runapi.ai/v1 und api_mode chat_completions hinzufügen.
2. **Ein DeepSeek-Modell auswählen** — Das Modell auf deepseek-v4-pro für Qualität oder deepseek-v4-flash für Geschwindigkeit wechseln. Beide verwenden den /v1/chat/completions-Endpunkt über den custom:runapi-Provider. Reasoning durch Übergabe von thinking.type auf enabled aktivieren — kein separater Modell-Eintrag nötig.
3. **Antwort streamen** — Hermes Agent empfängt die Antwort als SSE-Stream im OpenAI-Chat-Completions-Format. Token-Usage erscheint im letzten Event. Zwischen DeepSeek-, GPT- und Claude-Modellen wechseln, ohne die Provider-Konfiguration zu ändern — nur das model-Feld wechselt.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Erforderlich. deepseek-v4-pro oder deepseek-v4-flash. |
| `messages` | `array` | Erforderlich. Array von Message-Objekten mit role (system, user, assistant) und content-Feldern. |
| `stream` | `boolean` | Optional. Auf true für SSE-Streaming setzen. Standard false. |
| `max_tokens` | `integer` | Optional. Maximale Anzahl zu generierender Token. |
| `temperature` | `number` | Optional. Sampling-Temperatur zwischen 0 und 2. Niedrigere Werte sind deterministischer. |
| `thinking` | `object` | Optional. type auf &quot;enabled&quot; setzen, um DeepSeeks eingebauten Reasoning-Modus zu aktivieren. |

## FAQ

### Kann Hermes Agent DeepSeek über den bestehenden RunAPI-Provider verwenden?

Ja. Wenn custom:runapi bereits in Hermes Agent konfiguriert ist, das Modell auf deepseek-v4-pro oder deepseek-v4-flash wechseln. Base URL, API-Key und api_mode bleiben gleich. hermes model oder die Konfigurationsdatei direkt bearbeiten.

### Unterstützt DeepSeek auf RunAPI das Anthropic-Messages-Protokoll?

Ja. DeepSeek V4 funktioniert sowohl mit /v1/chat/completions (OpenAI-Format) als auch mit /v1/messages (Anthropic-Format) über RunAPI. Wenn die Hermes-Agent-Konfiguration die Anthropic-Messages-Oberfläche verwendet, das Modell auf deepseek-v4-pro setzen und es funktioniert ohne Protokolländerungen.

### Was ist der Unterschied zwischen deepseek-v4-flash und deepseek-v4-pro?

Flash priorisiert Geschwindigkeit mit niedrigerer Latenz und geringeren Kosten. Pro priorisiert Qualität mit besserer Leistung bei komplexem Reasoning, Coding und mehrstufigen Aufgaben. Beide verwenden denselben Endpunkt und dieselben Parameter.

### Wie aktiviere ich den Reasoning-Modus für DeepSeek in Hermes Agent?

thinking.type auf enabled im Request-Body übergeben. Reasoning-Modus ist ein Request-Parameter, kein separates Modell. Die Reasoning-Token werden als Output-Token abgerechnet. Dies funktioniert über beide Protokoll-Oberflächen (OpenAI und Anthropic).

### Wie unterscheidet sich der DeepSeek-Preis auf RunAPI von der direkten Verwendung von DeepSeek?

RunAPI berechnet DeepSeek-Token zu 50 % der offiziellen DeepSeek-Preise. Da DeepSeek bereits GPT und Claude bei den Token-Kosten unterbietet, macht das DeepSeek zum günstigsten verfügbaren reasoning-fähigen LLM über eine einzige API. Kein Abonnement, kein Minimum — pro Token bezahlen.


## Links

- [Hermes Agent Einrichtungsanleitung →](https://runapi.ai/de/hermes-agent)
- [DeepSeek models →](https://runapi.ai/de/models/deepseek)
- [Model catalog](https://runapi.ai/de/models)
- [API docs](https://runapi.ai/de/docs)
