Utiliser DeepSeek dans Hermes Agent.
DeepSeek V4 prend en charge les protocoles openai chat completions et anthropic messages via RunAPI. Hermes Agent se connecte via le fournisseur custom:runapi — même URL de base et même clé que vous utilisez pour les autres modèles. Activez le mode raisonnement avec un paramètre de requête. RunAPI facture DeepSeek à 50% des tarifs officiels.
Utilisez RunAPI pour appeler DeepSeek V4 Pro via le fournisseur custom:runapi de Hermes Agent.
Exigences :
- Utiliser le fournisseur custom:runapi déjà configuré dans Hermes Agent
- Appeler l'endpoint chat completions de RunAPI à https://runapi.ai/v1/chat/completions
- Définir le modèle sur "deepseek-v4-pro"
- La variable d'environnement RUNAPI_API_KEY fournit l'autorisation
- La réponse revient en flux SSE au format openai chat completions
- Pour activer le raisonnement, définir thinking.type sur "enabled" dans le corps de la requête
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
Utiliser DeepSeek dans Hermes Agent en trois étapes
Configurer le fournisseur RunAPI
Définissez la variable d'environnement RUNAPI_API_KEY. Si vous avez déjà ajouté RunAPI en tant que custom:runapi dans Hermes Agent, le même fournisseur et la même clé fonctionnent pour DeepSeek — aucune configuration supplémentaire. Sinon, ajoutez RunAPI avec base_url https://runapi.ai/v1 et api_mode chat_completions.
export RUNAPI_API_KEY=runapi_xxx
Sélectionner un modèle DeepSeek
Changez le modèle sur deepseek-v4-pro pour la qualité ou deepseek-v4-flash pour la vitesse. Les deux utilisent l'endpoint /v1/chat/completions via le fournisseur custom:runapi. Activez le raisonnement en passant thinking.type défini sur enabled — aucune entrée de modèle séparée requise.
model: deepseek-v4-pro
Diffuser la réponse
Hermes Agent reçoit la réponse comme flux SSE au format openai chat completions. L'utilisation des tokens apparaît dans l'événement final. Passez de DeepSeek, GPT et Claude sans changer la configuration du fournisseur — seul le champ model change.
stream: true
Paramètres chat completions DeepSeek
| Paramètre | Type | Description |
|---|---|---|
model |
string |
Requis. deepseek-v4-pro ou deepseek-v4-flash. |
messages |
array |
Requis. Tableau d'objets de message avec les champs role (system, user, assistant) et content. |
stream |
boolean |
Optionnel. Définissez sur true pour le streaming SSE. Par défaut false. |
max_tokens |
integer |
Optionnel. Nombre maximum de tokens à générer. |
temperature |
number |
Optionnel. Température d'échantillonnage entre 0 et 2. Des valeurs plus basses sont plus déterministes. |
thinking |
object |
Optionnel. Définissez type sur "enabled" pour activer le mode raisonnement intégré de DeepSeek. |
Qu'est-ce que DeepSeek sur Hermes Agent ?
DeepSeek V4 est un LLM économique qui fonctionne via les surfaces de protocole OpenAI et Anthropic sur RunAPI. Hermes Agent l'appelle via le même fournisseur custom:runapi utilisé pour GPT et Claude -- juste changer le paramètre model. Le mode de raisonnement intégré s'active avec un paramètre de requête, et RunAPI facture DeepSeek à 50 % des tarifs officiels déjà bas, ce qui en fait le modèle capable de raisonnement le moins cher disponible via une seule clé API.
Cas d'utilisation de DeepSeek
Évaluation de l'alternative auto-hébergée
Tester DeepSeek via l'API de RunAPI avant de décider d'héberger soi-même les poids open source. Si les coûts API restent en dessous de votre seuil de rentabilité d'infrastructure, garder la version hébergée. Si le volume le justifie, déployer localement avec le même modèle.
Construction d'interfaces de raisonnement montrant la chaîne de pensée
Activer le mode de réflexion et afficher les tokens de réflexion dans votre interface pour que les utilisateurs puissent voir comment le modèle a résolu un problème. Utile pour les applications de tutorat, les outils de débogage de code ou les systèmes d'aide à la décision.
Traitement par lot à grand volume à coût minimum
Exécuter DeepSeek Flash pour un traitement rapide et économique de grands ensembles de documents, des tâches de classification ou des jobs d'extraction de données où le coût par token importe plus que la qualité maximale.
Questions sur DeepSeek + Hermes Agent
Oui. Si vous avez déjà configuré custom:runapi dans Hermes Agent, changez le modèle sur deepseek-v4-pro ou deepseek-v4-flash. L'URL de base, la clé API et api_mode restent les mêmes. Utilisez la commande hermes model ou modifiez directement le fichier de configuration.
Oui. DeepSeek V4 fonctionne avec /v1/chat/completions (format OpenAI) et /v1/messages (format Anthropic) via RunAPI. Si votre configuration Hermes Agent utilise la surface messages Anthropic, définissez le modèle sur deepseek-v4-pro et cela fonctionne sans changement de protocole.
Flash privilégie la vitesse avec une latence et un coût plus faibles. Pro privilégie la qualité avec de meilleures performances sur le raisonnement complexe, le codage et les tâches multi-étapes. Les deux utilisent le même endpoint et acceptent les mêmes paramètres.
Passez thinking.type défini sur enabled dans le corps de la requête. Le mode raisonnement est un paramètre de requête, pas un modèle séparé. Les tokens de raisonnement sont facturés comme des tokens de sortie. Cela fonctionne via les surfaces de protocole OpenAI et Anthropic.
RunAPI facture les tokens DeepSeek à 50% des tarifs officiels DeepSeek. Puisque DeepSeek sous-coûte déjà GPT et Claude par token, cela en fait le LLM capable de raisonnement le moins cher disponible via une seule API. Aucun abonnement, pas de minimum — paiement par token.
Configuration générale de Hermes Agent
Pas encore configuré ? Commencez par le guide de configuration RunAPI pour Hermes Agent.
Guide de configuration Hermes Agent →Catalogue des modèles DeepSeek
Voir les variantes DeepSeek V4, la tarification et la documentation API.
Modèles DeepSeek →Essayez DeepSeek dans Hermes Agent dès aujourd'hui.
Obtenez une clé RunAPI gratuite, définissez le modèle sur deepseek-v4-pro dans Hermes Agent et commencez à raisonner à la moitié du coût de l'accès direct à DeepSeek.