Użwaj DeepSeek w Hermes Agent.
DeepSeek V4 obsługuje zarówno uzupełnienia czatu OpenAI, jak i protokoły wiadomości Anthropic przez RunAPI. Hermes Agent łączy się przez dostawcę custom:runapi — ten sam bazowy URL i klucz, których użwasz dla innych modeli. Aktywuj tryb rozumowania parametrem żądania. RunAPI wycenia DeepSeek w 50% oficjalnych stawek.
Use RunAPI to call DeepSeek V4 Pro through Hermes Agent's custom:runapi provider.
Requirements:
- Use the custom:runapi provider already configured in Hermes Agent
- Call the RunAPI chat completions endpoint at https://runapi.ai/v1/chat/completions
- Set model to "deepseek-v4-pro"
- The RUNAPI_API_KEY environment variable provides authorization
- The response streams back as SSE events in OpenAI chat completions format
- To enable reasoning, set thinking.type to "enabled" in the request body
curl -X POST https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"messages": [
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function that finds the longest palindromic substring in O(n) time using Manacher algorithm."}
],
"stream": true,
"max_tokens": 4096
}'
{
"id": "chatcmpl-abc123",
"object": "chat.completion",
"model": "deepseek-v4-pro",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Here is Manacher's algorithm implementation..."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 42,
"completion_tokens": 356,
"total_tokens": 398
}
}
Użwaj DeepSeek w Hermes Agent w trzech krokach
Skonfiguruj dostawcę RunAPI
Ustaw zmienną środowiskową RUNAPI_API_KEY. Jeśli dodałeś już RunAPI jako custom:runapi w Hermes Agent, ten sam dostawca i klucz działają dla DeepSeek — bez dodatkowej konfiguracji. Jeśli nie, dodaj RunAPI z base_url https://runapi.ai/v1 i api_mode chat_completions.
export RUNAPI_API_KEY=runapi_xxx
Wybierz model DeepSeek
Przełącz model na deepseek-v4-pro dla jakości lub deepseek-v4-flash dla szybkości. Oba użwają punktu końcowego /v1/chat/completions przez dostawcę custom:runapi. Włącz rozumowanie przekazując thinking.type ustawione na enabled — nie potrzeba osobnego wpisu modelu.
model: deepseek-v4-pro
Strumieniuj odpowiedź
Hermes Agent odbiera odpowiedź jako strumień SSE w formacie uzupełnień czatu OpenAI. Użycie tokenów pojawia się w ostatnim zdarzeniu. Przełączaj między modelami DeepSeek, GPT i Claude bez zmiany konfiguracji dostawcy — zmienia się tylko pole model.
stream: true
Parametry uzupełnień czatu DeepSeek
| Parametr | Typ | Opis |
|---|---|---|
model |
string |
Wymagane. deepseek-v4-pro lub deepseek-v4-flash. |
messages |
array |
Wymagane. Tablica obiektów wiadomości z polami role (system, user, assistant) i content. |
stream |
boolean |
Opcjonalne. Ustaw na true dla strumieniowania SSE. Domyślnie false. |
max_tokens |
integer |
Opcjonalne. Maksymalna liczba tokenów do wygenerowania. |
temperature |
number |
Opcjonalne. Temperatura próbkowania między 0 a 2. Niższe wartości są bardziej deterministyczne. |
thinking |
object |
Opcjonalne. Ustaw type na "enabled", aby aktywować wbudowany tryb rozumowania DeepSeek. |
Czym jest DeepSeek w Hermes Agent?
DeepSeek V4 to budżetowy LLM działający przez endpointy zgodne z OpenAI i Anthropic, co ułatwia przełączanie w workflow'ach Hermes Agent. Przez RunAPI jest dostępny bez bezpośredniego dostępu do API DeepSeek.
Zastosowania DeepSeek
Ewaluacja alternatyw self-hostingowych
Testuj DeepSeek przez API RunAPI przed podjęciem decyzji, czy chcesz go hostować samodzielnie.
Budowanie UI rozumowania pokazujących łańcuch myślenia
Włącz tryb myślenia i wyświetlaj tokeny myślenia w UI dla przejrzystego rozumowania AI.
Przetwarzanie wsadowe o dużym wolumenie przy minimalnych kosztach
Uruchamiaj DeepSeek Flash do szybkiego, taniego przetwarzania dużych zestawów dokumentów.
Pytania dotyczące DeepSeek + Hermes Agent
Tak. Jeśli masz już skonfigurowany custom:runapi w Hermes Agent, przełącz model na deepseek-v4-pro lub deepseek-v4-flash. Bazowy URL, klucz API i api_mode pozostają takie same. Użyj hermes model lub edytuj plik konfiguracyjny bezpośrednio.
Tak. DeepSeek V4 działa zarówno z /v1/chat/completions (format OpenAI) jak i /v1/messages (format Anthropic) przez RunAPI. Jeśli konfiguracja Hermes Agent używa powierzchni Anthropic messages, ustaw model na deepseek-v4-pro i działa bez zmian protokołu.
Flash priorytetyzuje szybkość przy niższym opóźnieniu i koszcie. Pro priorytetyzuje jakość z lepszą wydajnością w złożonym rozumowaniu, kodowaniu i zadaniach wieloetapowych. Oba użwają tego samego punktu końcowego i akceptują te same parametry.
Przekaż thinking.type ustawione na enabled w treści żądania. Tryb rozumowania jest parametrem żądania, a nie osobnym modelem. Tokeny rozumowania są rozliczane jako tokeny wyjściowe. Działa to zarówno przez protokół OpenAI, jak i Anthropic.
RunAPI wycenia tokeny DeepSeek w 50% oficjalnych stawek DeepSeek. Ponieważ DeepSeek już podbija GPT i Claude pod względem kosztu per token, czyni go najtańszym dostępnym modelem LLM zdolnym do rozumowania przez jedno API. Bez subskrypcji, bez minimum — płać per token.
Ogólna konfiguracja Hermes Agent
Nie skonfigurowano jeszcze? Zacznij od przewodnika konfiguracji RunAPI dla Hermes Agent.
Przewodnik konfiguracji Hermes Agent →Wypróbuj DeepSeek w Hermes Agent już dziś.
Zdobadź darmowy klucz RunAPI, ustaw model na deepseek-v4-pro w Hermes Agent i zacznij rozumować w połowie kosztu bezpośredniego dostępu do DeepSeek.