Uma API key
Use as mesmas credenciais entre modelos e provedores.
It looks like you may prefer a different language. Switch anytime.
Use a API do DeepSeek via RunAPI com um model skill, autenticação unificada e preços pay-as-you-go.
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-vision-exp",
"messages": [
{
"role": "user",
"content": "Refatore este módulo Python para maior legibilidade, explique cada mudança e depois adicione testes unitários para os casos extremos."
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[{"role": "user", "content": "Refatore este módulo Python para maior legibilidade, explique cada mudança e depois adicione testes unitários para os casos extremos."}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "deepseek-v4-flash-vision-exp",
messages: [{ role: "user", content: "Refatore este módulo Python para maior legibilidade, explique cada mudança e depois adicione testes unitários para os casos extremos." }]
});
DeepSeek é uma família de modelos de linguagem focados em raciocínio. deepseek-flash é o tier rápido e barato com modo thinking opcional; deepseek-v4-pro atende aos workloads de raciocínio mais difíceis e agênticos; deepseek-v4-flash-vision-exp é a variante experimental para entradas de imagem. Os três estão disponíveis pelo RunAPI com uma única key e cobrança por token.
| Endpoint | Protocol |
|---|---|
POST /v1/chat/completions | OpenAI compatible |
POST /v1/responses | OpenAI Responses |
POST /v1/messages | Anthropic compatible |
POST /v1beta/models/{model}:generateContent | Gemini generateContent |
POST /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
| Variante | Cobrança | Preços | |
|---|---|---|---|
| deepseek-flash | 1K tokens | Input $0.30 / 1M tokens | Output $1.20 / 1M tokens | Ver → |
| deepseek-v4-flash | 1K tokens | Input $0.30 / 1M tokens | Output $1.20 / 1M tokens | Ver → |
| deepseek-v4-flash-vision-exp | 1K tokens | Input $0.30 / 1M tokens | Output $1.20 / 1M tokens | Ver → |
| deepseek-v4-pro | 1K tokens | Input $1.32 / 1M tokens | Output $3.96 / 1M tokens | Ver → |
| Endpoint | Resolução | Duração | Preço | |
|---|---|---|---|---|
| message | — | — | Input $0.30 / 1M tokens | Output $1.20 / 1M tokens | |
| chat_completion | — | — | Input $0.30 / 1M tokens | Output $1.20 / 1M tokens |
Preços exibidos para deepseek-flash. Outras variantes mantêm seus próprios preços por endpoint.
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Use sua chave RunAPI para todos os modelos compatíveis.
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Consulte por task ID ou trate o callback quando a geração terminar.
Os modelos DeepSeek são modelos de linguagem de grande porte otimizados para raciocínio, código e uso agêntico de ferramentas. Pelo RunAPI, compartilham uma única API key com cobrança pay-as-you-go por token, e são chamáveis tanto pelos SDKs da OpenAI quanto da Anthropic.
Use as mesmas credenciais entre modelos e provedores.
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
O preço por uso fica visível antes da chamada.
Use deepseek-flash. Os nomes anteriores deepseek-v4-flash e deepseek-v4-flash-vision-exp continuam aceitos; as solicitações com esses nomes de modelo descontinuados são atendidas pelo DeepSeek-V4.1-Flash e cobradas pelo preço do Flash.
Flash é o tier rápido e barato para tarefas do dia a dia; pro atende ao raciocínio mais complexo e workflows agênticos longos com preço de token mais alto.
Thinking é um parâmetro de requisição no deepseek-flash, não um modelo separado — defina-o por requisição quando quiser raciocínio passo a passo.
Sim. O DeepSeek está disponível tanto nas superfícies OpenAI Chat Completions quanto Anthropic Messages; aponte qualquer SDK para o RunAPI e passe o model id do deepseek.
Tokens de prompt em cache são cobrados a uma taxa de leitura de cache bem mais baixa que tokens de entrada frescos; hits de cache são detectados automaticamente e refletidos no uso.
Use deepseek-flash para trabalho rápido do dia a dia e deepseek-v4-pro para raciocínio mais complexo e workflows agênticos; use deepseek-v4-flash-vision-exp para entradas de imagem.