DeepSeek API
DeepSeek API 调用 —— flash 快速低成本,pro 应对复杂智能体任务。
# Base URL
https://runapi.ai
# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-vision-exp",
"messages": [
{
"role": "user",
"content": "重构这个 Python 模块以提升可读性,逐条解释改动,并为边界情况补充单元测试。"
}
]
}'
from openai import OpenAI
client = OpenAI(
base_url="https://runapi.ai/v1",
api_key="your-runapi-key"
)
response = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[{"role": "user", "content": "重构这个 Python 模块以提升可读性,逐条解释改动,并为边界情况补充单元测试。"}]
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://runapi.ai/v1",
apiKey: "your-runapi-key"
});
const response = await client.chat.completions.create({
model: "deepseek-v4-flash-vision-exp",
messages: [{ role: "user", content: "重构这个 Python 模块以提升可读性,逐条解释改动,并为边界情况补充单元测试。" }]
});
DeepSeek 是一系列推理优先的大语言模型。deepseek-v4-flash 为快速、低成本档位,可按需开启思考模式;deepseek-v4-pro 面向最复杂的推理与智能体任务;deepseek-v4-flash-vision-exp 是支持图像输入的实验性视觉版本。三者均可通过 RunAPI 用一个密钥按 token 计费调用。
- 多变体覆盖不同速度/质量层级
- Model skill 包含文档、schema 和接入说明
- 适合面向应用的编码工作流
- 失败的生成不计费
对比全部 API 变体
DeepSeek API 端点
使用 OpenAI 或 Anthropic SDK 配合 RunAPI key 调用,无需额外 SDK。
| Endpoint | Protocol |
|---|---|
| /v1/chat/completions | OpenAI compatible |
| /v1/responses | OpenAI Responses |
| /v1/messages | Anthropic compatible |
| /v1beta/models/{model}:generateContent | Gemini generateContent |
| /v1beta/models/{model}:streamGenerateContent | Gemini streamGenerateContent |
四步从 model skill 到首次结果
选择模型
根据输出类型、质量要求和延迟目标选择模型与变体。
配置
设置 RunAPI key,并在代码工作区安装对应 model skill。
调用
按 skill 里的说明,把模型能力接入到你的应用里。
接收
按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。
DeepSeek API 是什么?
DeepSeek 模型是面向推理、代码与智能体工具调用的大语言模型。通过 RunAPI 共用一个 API key、按量计费,并可同时用 OpenAI 与 Anthropic SDK 调用。
为什么用 RunAPI 调用 DeepSeek API
一把认证,覆盖所有提供方
一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。
统一的定价与账单
USD 按次定价,按月结算。失败的生成不计费。
Schema 优先的 SDK
Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。
常见问题
deepseek-v4-flash 和 deepseek-v4-pro 有什么区别?
flash 是面向日常任务的快速、低成本档位;pro 面向最复杂的推理与长链路智能体任务,token 单价更高。
如何开启思考(推理)模式?
思考是 deepseek-v4-flash 上的请求参数,并非独立模型——需要逐步推理时按请求开启即可。
可以同时用 OpenAI 和 Anthropic SDK 调用 DeepSeek 吗?
可以。DeepSeek 同时提供 OpenAI Chat Completions 与 Anthropic Messages 两种接口;将任一 SDK 指向 RunAPI 并传入 deepseek 模型 id 即可。
命中缓存的 prompt token 如何计费?
命中缓存的 prompt token 按远低于新输入 token 的缓存读取价计费;缓存命中会自动识别并体现在用量中。
DeepSeek 有哪些模型?
DeepSeek 提供 deepseek-v4-flash(可按请求开启思考)、deepseek-v4-pro,以及支持图像输入的实验性视觉版本 deepseek-v4-flash-vision-exp。
应该从哪个变体开始?
选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。
有免费额度吗?
新账户每个模型都有免费调用额度,之后按次计费。
支持流式吗?
模型支持流式时,RunAPI 端到端流式。
失败怎么计费?
失败的生成不计费。
输出会缓存吗?
输出按任务 ID 存储在 R2 供回取。输入不缓存。
可以商用吗?
可以——所有变体默认含商用许可,除非模型许可明确限制;有例外会在变体页面注明。
速率限制?
Key 级限流随使用层级伸缩。当前限制见定价页。
在哪里报问题?
在公共 GitHub 仓库提 issue 或邮件联系 support。