Usa DeepSeek en Hermes Agent.
DeepSeek V4 admite tanto el protocolo de chat completions de OpenAI como el de mensajes de Anthropic a través de RunAPI. Hermes Agent se conecta a través del proveedor custom:runapi — la misma URL base y clave que usas para otros modelos. Activa el modo de razonamiento con un parámetro de solicitud. RunAPI precio DeepSeek al 50% de las tarifas oficiales.
Usa RunAPI para llamar a DeepSeek V4 Pro a través del proveedor custom:runapi de Hermes Agent.
Requisitos:
- Usa el proveedor custom:runapi ya configurado en Hermes Agent
- Llama al endpoint de chat completions de RunAPI en https://runapi.ai/v1/chat/completions
- Establece model en "deepseek-v4-pro"
- La variable de entorno RUNAPI_API_KEY proporciona la autorización
- La respuesta se transmite en streaming como eventos SSE en formato de chat completions de OpenAI
- Para habilitar razonamiento, establece thinking.type en "enabled" en el cuerpo de la solicitud
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
Usa DeepSeek en Hermes Agent en tres pasos
Configura el proveedor RunAPI
Establece la variable de entorno RUNAPI_API_KEY. Si ya añadiste RunAPI como custom:runapi en Hermes Agent, el mismo proveedor y clave funcionan para DeepSeek — no se necesita configuración adicional. Si no, añade RunAPI con base_url https://runapi.ai/v1 y api_mode chat_completions.
export RUNAPI_API_KEY=runapi_xxx
Selecciona un modelo DeepSeek
Cambia el model a deepseek-v4-pro para calidad o deepseek-v4-flash para velocidad. Ambos usan el endpoint /v1/chat/completions a través del proveedor custom:runapi. Habilita el razonamiento pasando thinking.type establecido en enabled — no se necesita entrada de modelo separada.
model: deepseek-v4-pro
Transmite la respuesta en streaming
Hermes Agent recibe la respuesta como un stream SSE en formato de chat completions de OpenAI. El uso de tokens aparece en el evento final. Cambia entre modelos DeepSeek, GPT y Claude sin cambiar la configuración del proveedor — solo cambia el campo model.
stream: true
Parámetros de chat completions de DeepSeek
| Parâmetro | Tipo | Descrição |
|---|---|---|
model |
string |
Obligatorio. deepseek-v4-pro o deepseek-v4-flash. |
messages |
array |
Obligatorio. Array de objetos de mensaje con campos role (system, user, assistant) y content. |
stream |
boolean |
Opcional. Establece en true para streaming SSE. Por defecto false. |
max_tokens |
integer |
Opcional. Número máximo de tokens a generar. |
temperature |
number |
Opcional. Temperatura de muestreo entre 0 y 2. Valores más bajos son más deterministas. |
thinking |
object |
Opcional. Establece type en "enabled" para activar el modo de razonamiento integrado de DeepSeek. |
O que é DeepSeek no Hermes Agent?
DeepSeek V4 é um LLM econômico que funciona via endpoints compatíveis com OpenAI e Anthropic, facilitando a troca em workflows do Hermes Agent. Via RunAPI, está disponível sem acesso direto à API do DeepSeek.
Casos de uso do DeepSeek
Avaliação de alternativas de auto-hospedagem
Teste DeepSeek via API do RunAPI antes de decidir se deseja hospedá-lo por conta própria.
Construção de UIs de raciocínio que mostram cadeia de pensamento
Ative o modo de pensamento e exiba os tokens de pensamento em sua UI para raciocínio transparente de IA.
Processamento em lote de alto volume a custo mínimo
Execute DeepSeek Flash para processamento rápido e barato de grandes conjuntos de documentos.
Preguntas sobre DeepSeek + Hermes Agent
Sí. Si ya tienes custom:runapi configurado en Hermes Agent, cambia el model a deepseek-v4-pro o deepseek-v4-flash. La URL base, la clave API y el api_mode no cambian. Usa hermes model o edita el archivo de configuración directamente.
Sí. DeepSeek V4 funciona tanto con /v1/chat/completions (formato OpenAI) como con /v1/messages (formato Anthropic) a través de RunAPI. Si tu configuración de Hermes Agent usa la interfaz de mensajes de Anthropic, establece el model en deepseek-v4-pro y funciona sin cambios de protocolo.
Flash prioriza la velocidad con menor latencia y coste. Pro prioriza la calidad con mejor rendimiento en razonamiento complejo, codificación y tareas de múltiples pasos. Ambos usan el mismo endpoint y aceptan los mismos parámetros.
Pasa thinking.type establecido en enabled en el cuerpo de la solicitud. El modo de razonamiento es un parámetro de solicitud, no un modelo separado. Los tokens de razonamiento se facturan como tokens de salida. Esto funciona a través de las interfaces de protocolo OpenAI y Anthropic.
RunAPI precio los tokens de DeepSeek al 50% de las tarifas oficiales de DeepSeek. Como DeepSeek ya tiene un coste por token inferior a GPT y Claude, esto lo convierte en el LLM con capacidad de razonamiento de menor precio disponible a través de una sola API. Sin suscripción, sin mínimo — paga por token.
Configuración general de Hermes Agent
¿Aún no lo has configurado? Empieza con la guía de configuración de RunAPI para Hermes Agent.
Guía de configuración de Hermes Agent →Catálogo de modelos DeepSeek
Ver variantes de DeepSeek V4, precios y documentación de la API.
Modelos de DeepSeek →Prueba DeepSeek en Hermes Agent hoy.
Obtén una clave RunAPI gratuita, establece el model en deepseek-v4-pro en Hermes Agent y empieza a razonar al 50% del coste del acceso directo a DeepSeek.