LLM API

LLM API — OpenAI 相容

透過一個 OpenAI 相容的 endpoint 存取 Claude、GPT、GeminiDeepSeek 和 Grok。/v1/chat/completions、/v1/messages、/v1/responses。

67 個模型 直接替換 base_url 按 token 付費

67
LLM 模型
15-25%
低於官方價格
2 行
遷移只需

Playground

即時
模型
訊息
Refactor this handler to stream partial results and return a typed error on timeout.
最大 token 數
integer | null
溫度
number | null
串流
false
Endpoint
/v1/chat/completions
預估費用
$0.22 / 1M in $0.30 / 1M in $0.41 / 1M in $2.50 / 1M in
範例

多模型比較

提示詞 用一句話解釋量子運算

Claude/claude-fable-5

透過 /v1/messages 呼叫 Claude/claude-fable-5。
比較輸出結果時,維持相同的 RunAPI key 和請求格式。

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-fable-5-1

透過 /v1/messages 呼叫 Claude/claude-fable-5-1。
比較輸出結果時,維持相同的 RunAPI key 和請求格式。

Anthropic Input $10.00 / 1M tokens | Output $50.00 / 1M tokens

Claude/claude-haiku-4-5-20251001

透過 /v1/messages 呼叫 Claude/claude-haiku-4-5-20251001。
比較輸出結果時,維持相同的 RunAPI key 和請求格式。

Anthropic Input $0.60 / 1M tokens | Output $3.00 / 1M tokens

4 種 endpoint 格式,一把 key

Chat completion

所有 SDK 都已支援的 OpenAI 格式。替換 base_url,同時保留現有請求程式碼。

Message

適用於 system prompt、工具使用和結構化內容區塊的 Messages API 格式。

Response

適用於多輪 agent 迴圈的有狀態格式,由伺服器端處理對話。

Embedding

用於檢索的向量 embeddings,以同一把 RunAPI key 按 token 計費。

一把 key 使用所有 LLM

Claude/claude-fable-5

Anthropic

$10.00 / 1M in

Claude/claude-fable-5-1

Anthropic

$10.00 / 1M in

Claude/claude-haiku-4-5-20251001

Anthropic

$0.60 / 1M in

Claude/claude-opus-4-1-20250805

Anthropic

$9.00 / 1M in

Claude/claude-opus-4-5-20251101

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-6

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-7

Anthropic

$3.00 / 1M in

Claude/claude-opus-4-8

Anthropic

$3.00 / 1M in

查看全部 67 個 LLM 模型
快速入門

使用 OpenAI 格式呼叫任何模型

curl https://runapi.ai/v1/chat/completions \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Explain the difference between concurrency and parallelism."}]}'
使用方式

四步完成第一次生成

  1. 取得 API 金鑰

    為你的 RunAPI 帳戶建立一個金鑰。

  2. 使用 OpenAI 格式

    透過文件中的 OpenAI 相容端點傳送請求。

  3. 智慧路由

    RunAPI 為你的請求選擇受支援的路由。

  4. 串流回應

    當所選端點支援 SSE 時接收串流輸出。

為什麼開發者選擇 RunAPI

一把 Key,所有模型

不再為 API 金鑰疲於奔命。一次整合即可存取所有供應商的 230+ 個模型。

節省 15-25% 費用

我們與供應商的用量協議意味著價格比直接購買更低,且不額外加價。

自動容錯切換

若供應商故障,我們會路由至下一個最佳選項,讓您的應用程式持續運作。

相容 OpenAI

OpenAI SDK 的直接替代方案。只要修改一行程式碼,即可存取任何模型。

即時帳單

只為實際用量付費。按請求計費,無最低消費;可依模型和專案追蹤成本。

資料隱私

隱私政策說明了請求資料和生成內容的處理與保存方式。

團隊如何運用它

程式開發 Agents

將規劃任務交給 Opus,將編輯任務交給低成本模型;共用同一個 key 與一張帳單。

RAG 管線

embeddings 和生成使用相同 endpoint,讓檢索與回答共用預算。

內容生成

將草稿分送至多個模型並保留最佳版本,無須簽訂五家供應商合約。

多模型比較

只要變更一個字串,即可在 Claude、GPT 和 Gemini 之間對同一個 prompt 進行 A/B 測試。

RunAPI 與其他方案比較

功能 RunAPI OpenRouter 直接 API
LLM 模型 66 300+ 1 個供應商
其他模態 影片、圖片、音樂、音訊 依供應商而定
定價 比官方價格低 15–25% 市場價格 官方費率
原生 Messages API
統一點數
MCP server + CLI

LLM API 常見問題

如何從 OpenAI 相容用戶端遷移?

將用戶端指向文件列出的 RunAPI base URL,並使用您的 RunAPI key。維持所選 endpoint 支援的請求格式。

支援串流嗎?

所選模型和 endpoint 提供串流回應時,即可使用串流。

工具呼叫可以運作嗎?

在其執行階段合約宣告支援工具的模型和 endpoint 格式上,可使用工具呼叫。

token 如何計費?

模型目錄中列有輸入與輸出費率。使用量會依請求回報的 token 數量計費。

我該使用哪個 endpoint?

請選擇符合您現有用戶端及請求所需功能的 endpoint 格式。

如果路由無法使用怎麼辦?

API 會透過文件定義的回應合約傳回請求狀態,讓您的應用程式能重試或選擇其他支援的模型。

替換兩行,保留您的程式碼

您已部署的 OpenAI 格式背後有 67 個模型。免費開始,無需信用卡。