Text · DeepSeek

DeepSeek API

RunAPI를 통한 DeepSeek API 액세스 — 빠르고 저렴한 작업에는 flash, 복잡한 에이전트 작업에는 pro를 사용합니다.

운영 중 · 3 variants · 최저 $0.0004
runapi.ai
# Base URL
https://runapi.ai

# Endpoints
POST /v1/chat/completions
POST /v1/responses
POST /v1/messages
POST /v1beta/models/{model}:generateContent
POST /v1beta/models/{model}:streamGenerateContent
curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-v4-flash-vision-exp",
  "messages": [
    {
      "role": "user",
      "content": "이 Python 모듈을 가독성을 위해 리팩터링하고, 각 변경 사항을 설명한 후 엣지 케이스에 대한 단위 테스트를 추가해 주세요."
    }
  ]
}'
from openai import OpenAI

client = OpenAI(
    base_url="https://runapi.ai/v1",
    api_key="your-runapi-key"
)

response = client.chat.completions.create(
    model="deepseek-v4-flash-vision-exp",
    messages=[{"role": "user", "content": "이 Python 모듈을 가독성을 위해 리팩터링하고, 각 변경 사항을 설명한 후 엣지 케이스에 대한 단위 테스트를 추가해 주세요."}]
)
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://runapi.ai/v1",
  apiKey: "your-runapi-key"
});

const response = await client.chat.completions.create({
  model: "deepseek-v4-flash-vision-exp",
  messages: [{ role: "user", content: "이 Python 모듈을 가독성을 위해 리팩터링하고, 각 변경 사항을 설명한 후 엣지 케이스에 대한 단위 테스트를 추가해 주세요." }]
});
https://runapi.ai 5 endpoints
개요

DeepSeek는 추론 중심의 언어 모델 패밀리입니다. deepseek-v4-flash는 선택적 thinking 모드를 갖춘 빠르고 저렴한 티어이며, deepseek-v4-pro는 가장 어려운 추론 및 에이전트 워크로드를 위한 모델이고, deepseek-v4-flash-vision-exp는 이미지 입력을 위한 실험적 비전 모델입니다. 세 모델 모두 단일 API 키와 토큰별 과금 방식으로 RunAPI를 통해 사용할 수 있습니다.

  • 품질과 지연 시간 목표에 맞춘 모델 변형
  • 통합 API key
  • Model skill에 docs, schema, 설정 메모 포함
  • 실패한 생성은 과금되지 않습니다
변형

변형

Variant Billing Pricing
deepseek-v4-flash 1K tokens Input $0.22 / 1M tokens | Output $0.66 / 1M tokens 보기 →
deepseek-v4-flash-vision-exp 1K tokens Input $0.22 / 1M tokens | Output $0.66 / 1M tokens 보기 →
deepseek-v4-pro 1K tokens Input $0.66 / 1M tokens | Output $1.98 / 1M tokens 보기 →
API

DeepSeek API 엔드포인트

RunAPI 키로 OpenAI 또는 Anthropic SDK를 사용하세요. 추가 SDK가 필요 없습니다.

Endpoint Protocol
/v1/chat/completions OpenAI compatible
/v1/responses OpenAI Responses
/v1/messages Anthropic compatible
/v1beta/models/{model}:generateContent Gemini generateContent
/v1beta/models/{model}:streamGenerateContent Gemini streamGenerateContent
작동 방식

이 model skill로 구현하는 방법

01

모델 선택

출력 유형, 품질 기준, 지연 시간 목표에 맞는 모델과 변형을 고릅니다.

02

한 번 인증

모든 지원 모델에 RunAPI key를 사용합니다.

03

skill 설치

기능을 구현하기 전에 코딩 워크스페이스에 model skill을 추가합니다.

04

결과 받기

task ID로 조회하거나 생성 완료 시 callback을 처리합니다.

컨텍스트

DeepSeek의 위치

DeepSeek 모델은 추론, 코드, 에이전트 툴 사용을 위해 최적화된 대형 언어 모델입니다. RunAPI를 통해 단일 API 키와 종량제 토큰 과금을 공유하며, OpenAI와 Anthropic SDK 모두에서 호출할 수 있습니다.

Provider
DeepSeek
Modality
Text
RUNAPI를 선택하는 이유

RunAPI로 DeepSeek을 쓰는 이유

하나의 API key

모델과 제공사를 넘나들며 같은 인증 정보를 사용합니다.

Skill-ready

model skill에 schema, 설정 메모, 가격 컨텍스트, 모델 ID가 포함됩니다.

예측 가능한 과금

호출 전에 사용량 기반 가격을 확인할 수 있습니다.

FAQ

자주 묻는 질문

deepseek-v4-flash와 deepseek-v4-pro의 차이는 무엇인가요?

flash는 일상적인 작업을 위한 빠르고 저렴한 티어이며, pro는 더 높은 토큰 가격으로 가장 복잡한 추론 및 긴 에이전트 워크플로우를 처리합니다.

thinking(추론) 모드를 어떻게 활성화하나요?

thinking은 별도의 모델이 아니라 deepseek-v4-flash의 요청 파라미터입니다. 단계별 추론이 필요할 때 각 요청에서 설정하면 됩니다.

DeepSeek를 OpenAI와 Anthropic SDK 모두에서 호출할 수 있나요?

네. DeepSeek는 OpenAI Chat Completions와 Anthropic Messages 두 방식 모두에서 사용할 수 있습니다. 두 SDK를 RunAPI에 연결하고 deepseek 모델 ID를 전달하면 됩니다.

캐시된 프롬프트 토큰은 어떻게 과금되나요?

캐시된 프롬프트 토큰은 일반 입력 토큰보다 훨씬 낮은 캐시 읽기 요금으로 과금됩니다. 캐시 히트는 자동으로 감지되어 사용량에 반영됩니다.

어떤 DeepSeek 변형을 사용해야 하나요?

빠른 일상적인 작업에는 deepseek-v4-flash를, 더 복잡한 추론 및 에이전트 워크플로우에는 deepseek-v4-pro를, 이미지 입력에는 deepseek-v4-flash-vision-exp를 사용하세요.

이 모델은 어떻게 호출하나요?

model skill을 설치하고 RunAPI key와 함께 설정 메모를 따르세요.

실패한 생성도 비용이 드나요?

실패한 생성은 과금되지 않습니다

애플리케이션에서 호출할 수 있나요?

네. 코딩 워크스페이스에 model skill을 설치하고 모델 기능을 추가할 때 사용하세요.

지금 시작

DeepSeek로 개발을 시작하세요.