---
title: &quot;Usa DeepSeek en Hermes Agent con RunAPI — Guía de API LLM&quot;
url: &quot;https://runapi.ai/es/hermes-deepseek.md&quot;
canonical: &quot;https://runapi.ai/es/hermes-deepseek&quot;
locale: &quot;es&quot;
model: &quot;deepseek&quot;
---

# Usa DeepSeek en Hermes Agent.

DeepSeek V4 admite tanto el protocolo de chat completions de OpenAI como el de mensajes de Anthropic a través de RunAPI. Hermes Agent se conecta a través del proveedor custom:runapi — la misma URL base y clave que usas para otros modelos. Activa el modo de razonamiento con un parámetro de solicitud. RunAPI precio DeepSeek al 50% de las tarifas oficiales.

## API example

```bash
curl -X POST https://runapi.ai/v1/chat/completions \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
    &quot;messages&quot;: [
      {&quot;role&quot;: &quot;system&quot;, &quot;content&quot;: &quot;You are a helpful coding assistant.&quot;},
      {&quot;role&quot;: &quot;user&quot;, &quot;content&quot;: &quot;Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm.&quot;}
    ],
    &quot;stream&quot;: true,
    &quot;max_tokens&quot;: 4096
  }&#39;

```

### Response

```json
{
  &quot;id&quot;: &quot;chatcmpl-abc123&quot;,
  &quot;object&quot;: &quot;chat.completion&quot;,
  &quot;model&quot;: &quot;deepseek-v4-pro&quot;,
  &quot;choices&quot;: [
    {
      &quot;index&quot;: 0,
      &quot;message&quot;: {
        &quot;role&quot;: &quot;assistant&quot;,
        &quot;content&quot;: &quot;Here is Manacher&#39;s algorithm implementation...&quot;
      },
      &quot;finish_reason&quot;: &quot;stop&quot;
    }
  ],
  &quot;usage&quot;: {
    &quot;prompt_tokens&quot;: 42,
    &quot;completion_tokens&quot;: 356,
    &quot;total_tokens&quot;: 398
  }
}

```

## How it works

1. **Configura el proveedor RunAPI** — Establece la variable de entorno RUNAPI_API_KEY. Si ya añadiste RunAPI como custom:runapi en Hermes Agent, el mismo proveedor y clave funcionan para DeepSeek — no se necesita configuración adicional. Si no, añade RunAPI con base_url https://runapi.ai/v1 y api_mode chat_completions.
2. **Selecciona un modelo DeepSeek** — Cambia el model a deepseek-v4-pro para calidad o deepseek-v4-flash para velocidad. Ambos usan el endpoint /v1/chat/completions a través del proveedor custom:runapi. Habilita el razonamiento pasando thinking.type establecido en enabled — no se necesita entrada de modelo separada.
3. **Transmite la respuesta en streaming** — Hermes Agent recibe la respuesta como un stream SSE en formato de chat completions de OpenAI. El uso de tokens aparece en el evento final. Cambia entre modelos DeepSeek, GPT y Claude sin cambiar la configuración del proveedor — solo cambia el campo model.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Obligatorio. deepseek-v4-pro o deepseek-v4-flash. |
| `messages` | `array` | Obligatorio. Array de objetos de mensaje con campos role (system, user, assistant) y content. |
| `stream` | `boolean` | Opcional. Establece en true para streaming SSE. Por defecto false. |
| `max_tokens` | `integer` | Opcional. Número máximo de tokens a generar. |
| `temperature` | `number` | Opcional. Temperatura de muestreo entre 0 y 2. Valores más bajos son más deterministas. |
| `thinking` | `object` | Opcional. Establece type en &quot;enabled&quot; para activar el modo de razonamiento integrado de DeepSeek. |

## FAQ

### ¿Puede Hermes Agent usar DeepSeek a través del proveedor RunAPI existente?

Sí. Si ya tienes custom:runapi configurado en Hermes Agent, cambia el model a deepseek-v4-pro o deepseek-v4-flash. La URL base, la clave API y el api_mode no cambian. Usa hermes model o edita el archivo de configuración directamente.

### ¿DeepSeek en RunAPI admite el protocolo de mensajes de Anthropic?

Sí. DeepSeek V4 funciona tanto con /v1/chat/completions (formato OpenAI) como con /v1/messages (formato Anthropic) a través de RunAPI. Si tu configuración de Hermes Agent usa la interfaz de mensajes de Anthropic, establece el model en deepseek-v4-pro y funciona sin cambios de protocolo.

### ¿Cuál es la diferencia entre deepseek-v4-flash y deepseek-v4-pro?

Flash prioriza la velocidad con menor latencia y coste. Pro prioriza la calidad con mejor rendimiento en razonamiento complejo, codificación y tareas de múltiples pasos. Ambos usan el mismo endpoint y aceptan los mismos parámetros.

### ¿Cómo activo el modo de razonamiento para DeepSeek en Hermes Agent?

Pasa thinking.type establecido en enabled en el cuerpo de la solicitud. El modo de razonamiento es un parámetro de solicitud, no un modelo separado. Los tokens de razonamiento se facturan como tokens de salida. Esto funciona a través de las interfaces de protocolo OpenAI y Anthropic.

### ¿Cómo se compara el precio de DeepSeek en RunAPI con usar DeepSeek directamente?

RunAPI precio los tokens de DeepSeek al 50% de las tarifas oficiales de DeepSeek. Como DeepSeek ya tiene un coste por token inferior a GPT y Claude, esto lo convierte en el LLM con capacidad de razonamiento de menor precio disponible a través de una sola API. Sin suscripción, sin mínimo — paga por token.


## Links

- [Guía de configuración de Hermes Agent →](https://runapi.ai/es/hermes-agent)
- [Modelos de DeepSeek →](https://runapi.ai/es/models/deepseek)
- [Model catalog](https://runapi.ai/es/models)
- [API docs](https://runapi.ai/es/docs)
