deepseek-v4-flash API
Korzystaj z deepseek-v4-flash z rodziny DeepSeek przez RunAPI. Cennik za wywołanie, bez subskrypcji — nieudane generacje nie są rozliczane.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/deepseek-v4-flash:generateContent
POST /v1beta/models/deepseek-v4-flash:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash",
"max_tokens": 1024,
"messages": [
{
"role": "user",
"content": "Refactor this Python module for readability, explain each change, then add unit tests for the edge cases."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[{"role": "user", "content": "Refactor this Python module for readability, explain each change, then add unit tests for the edge cases."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "deepseek-v4-flash",
messages: [{ role: "user", content: "Refactor this Python module for readability, explain each change, then add unit tests for the edge cases." }]
});
deepseek-v4-flash trafia w optymalny punkt między jakością a kosztem w rodzinie DeepSeek.
- Cennik za wywołanie w USD
- Nieudane generacje nie są rozliczane
- Streaming, gdy jest obsługiwany przez model
- Setup model skilla
Cennik
Szczegóły techniczne
| ID modelu | deepseek-v4-flash |
| Dostawca | DeepSeek |
| Modalność | text |
| Typ zadania | synchronous |
| Jednostka rozliczeniowa | 1K tokens |
| API endpoint | /v1/chat/completions |
| /v1/responses | |
| /v1/messages | |
| /v1beta/models/deepseek-v4-flash:generateContent | |
| /v1beta/models/deepseek-v4-flash:streamGenerateContent | |
| Licencja komercyjna | Tak — wliczona przez API |
| Status katalogu | Operacyjny |
Szybki start — deepseek-v4-flash
Ten sam format · wariant przypięty w modelu
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/deepseek-v4-flash:generateContent | Gemini generateContent |
| /v1beta/models/deepseek-v4-flash:streamGenerateContent | Gemini streamGenerateContent |
Użyj deepseek-v4-flash w czterech krokach
Instalacja
Zainstaluj model skill dla tej linii modeli.
Konfiguracja
Ustaw pole model na pełny identyfikator modelu widoczny na tej stronie.
Wywołanie
Wyślij typowane żądanie z promptem, danymi wejściowymi i ustawieniami callbacku.
Odbiór
Odczytaj odpowiedź zadania, webhook callback lub adres URL zapisanego wyniku z RunAPI.
Co wyróżnia deepseek-v4-flash
Fast, low-cost reasoning; toggle thinking per request
Flagship reasoning and analysis for complex agentic work
Najlepiej sprawdza się w
Obsługa klienta
Odpowiadaj na pytania klientów na podstawie prywatnej bazy wiedzy, zmniejszając liczbę zgłoszeń.
Analiza dokumentów
Twórz podsumowania umów i wyłapuj kluczowe klauzule do weryfikacji przez prawnika.
Generowanie kodu
Automatycznie generuj testy jednostkowe, sugestie code review i refaktoryzacji w CI.
Najczęściej zadawane pytania o deepseek-v4-flash
Czy identyfikator modelu jest stały między wersjami?
RunAPI utrzymuje stały identyfikator modelu i obsługuje zgodne odświeżenia wersji bez zmiany kształtu żądania.
Jaki jest limit rate limit dla tej warianty?
Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.
Czy mogę później zmienić wariant?
Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.
Czy obsługuje streaming?
Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.
Gdzie zgłaszać problemy z jakością?
Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.