快取輸入
重複的提示前綴以較低的輸入費率計費。RunAPI 以 OpenAI 快取費率的 50% 傳遞此折扣。
GPT-5.4 每百萬 token 的輸入成本為 $2.50、輸出成本為 $15;GPT-5.5 則為 $5 和 $30。RunAPI 以這些費率的一半提供相同模型——相同 API、相同輸出、相同行為,發票上的金額更低。
OpenAI 以每百萬 token 計費,輸入(你的提示)和輸出(模型的回應)有不同費率。輸出 token 成本更高——模型必須逐一產生它們。當你重新送出相同提示前綴時,也有較便宜的快取輸入費率。以下所有數字皆為每百萬 token。
透過 RunAPI,GPT-5.4 輸入 $1.25/M,輸出 $7.50/M。官方費率為 $2.50/$15。
GPT-5.4-mini——適合不需要完整旗艦模型、但有高用量工作的較便宜選項。透過 RunAPI 以 50% off 計費。
透過 RunAPI,GPT-5.5 輸入 $2.50/M,輸出 $15/M。官方費率為 $5/$30。
快取輸入 token 費率遠低於標準輸入——在 RunAPI 上傳遞 50% 折扣。
表格顯示官方 OpenAI 定價與 RunAPI 定價並列。輸出 token 的成本明顯高於輸入 token——這是設計使然,因為產生每個 token 需要比讀取更多的運算。RunAPI 對所有 GPT 模型提供固定 50% 折扣。無需用量承諾,無需訂閱。
| 模型 | 官方輸入 /M | 官方輸出 /M | RunAPI 輸入 /M | RunAPI 輸出 /M | 上下文視窗 |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI 對快取輸入 token 收取較低費用,並將可等待最多 24 小時的工作之批次請求成本減半。如果你正在執行 coding agent 或處理大型批次,這兩點都很重要——重複的上下文和大量工作很快就會累積成本。
重複的提示前綴以較低的輸入費率計費。RunAPI 以 OpenAI 快取費率的 50% 傳遞此折扣。
提交到 Batch API 的請求以標準費率的一半計費,回應時間最長 24 小時。RunAPI 在其自身折扣之上傳遞此折扣。
GPT-5 模型允許你設定推理力度。較低的力度產生較少的推理 token,直接降低計量計費的輸出費用。
每次請求設定最大輸出 token 上限,以控制費用並避免長時間代理任務產生過多輸出。
token 費率在對應到實際工作前看起來很抽象。每天處理 50 場對話的客服 chatbot,與整天執行的 coding agent 或處理數百份文件的內容管線,成本結構都不同。以下是常見開發者工作負載——包含自動化工作流程——在兩種用量水準下,以 RunAPI 費率計算的每月預估成本。
| 工作負載 | 模型 | 輕度使用(每天約 50 個任務) | 重度使用(每天約 200 個任務) | 與官方相比每月節省 |
|---|---|---|---|---|
| 程式碼代理(Codex) | GPT-5.3-codex | $20/月 | $80/月 | $20–$80 |
| 客戶服務聊天機器人 | GPT-5.4-mini | $6/月 | $24/月 | $6–$24 |
| RAG 知識助理 | GPT-5.4 | $18/月 | $72/月 | $18–$72 |
| 內容生成 pipeline | GPT-5.4 | $25/月 | $100/月 | $25–$100 |
| 多代理協調器 | GPT-5.5 | $90/月 | $360/月 | $90–$360 |
鎖定單一供應商是實際風險,因為一夕之間的降價就可能讓競爭對手便宜 30%。以下是旗艦模型每百萬 token 的比較——OpenAI、Anthropic 和 Google 並列——讓你不用翻三個計費頁面就能做決定。RunAPI 提供一組 API key,可路由到這三家。
| 供應商 | 旗艦模型 | 輸入 /M | 輸出 /M | RunAPI 費率 |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI 對上表所有供應商提供 50% 折扣。價格已於 2026 年 6 月驗證。
在 runapi.ai 註冊。免費方案無需信用卡。
前往 Dashboard → API Keys。建立金鑰並儲存——你將以此作為 OpenAI API key 使用。
將基礎 URL 設定為 https://api.runapi.ai/v1 並使用你的 RunAPI 金鑰。任何相容 OpenAI 的客戶端都可使用。
在模型參數中使用 gpt-5.4、gpt-5.5 或任何 GPT 模型 ID。RunAPI 以官方費率的 50% 處理路由和計費。
GPT-5.4 官方費用為每百萬輸入 token $2.50,每百萬輸出 token $15。GPT-5.5 為 $5 和 $30。透過 RunAPI,每個 GPT 模型均以這些費率的一半計費——GPT-5.4 每百萬 token 輸入 $1.25,輸出 $7.50。
RunAPI 與模型供應商協商批量定價,並將節省的費用傳遞給開發者。請求到達相同的 OpenAI 模型,輸出、安全過濾器和行為完全相同,因此唯一的區別是你發票上更低的費率。沒有任何品質取捨,也沒有單獨的計費層級——折扣自動應用於每個 GPT 模型。
可以。新的 RunAPI 帳號會獲得免費額度,可測試任何 GPT 模型——不需要信用卡。之後採用按量付費,沒有每月最低消費,也沒有訂閱制。儲值餘額後,每次 API 呼叫都會扣除其 token 成本。你可以儲值任意金額,並在儀表板中按模型追蹤用量。
可以,而且很適合 n8n、Make 或 Zapier 這類自動化工具。每個呼叫 GPT 模型的工作流程步驟都依使用的 token 計費——沒有額外的單次呼叫費,也沒有費率限制級距。對於排程執行或批次處理的工作流程,Batch API 折扣(50% off)適用,並可與 RunAPI 的基礎折扣疊加,因此定期自動化工作成本會大幅降低。
圖片輸入按圖塊計費——OpenAI 會將圖片切分為 512×512 圖塊並依圖塊收費。音訊則按輸入秒數計費。兩者都不使用每百萬 token 的單位。RunAPI 以相同的 50% 折扣轉嫁圖片與音訊價格,因此 GPT-4o vision 請求或 Whisper 轉錄的成本是官方費率的一半。
可以。RunAPI 與 OpenAI 相容。將任何 OpenAI 客戶端指向 https://api.runapi.ai/v1,使用你的 RunAPI 金鑰並傳入 GPT 模型 ID。已使用 OpenAI SDK 的現有程式碼除基礎 URL 和金鑰外無需任何修改,因此遷移一個已建立的專案大約只需一分鐘。
可以。GPT-5.3-codex 可透過 RunAPI 以官方費率的 50% 使用,即每百萬 token 輸入 $1.25,輸出 $7.50。透過在設定中覆蓋基礎 URL 和金鑰,它可與 Codex 和其他相容 OpenAI 的程式碼工具搭配使用。快取輸入和批次折扣也會傳遞,進一步降低重複程式碼作業的實際費用。
有。新 RunAPI 帳戶在承諾使用前可獲得免費點數來測試任何 GPT 模型。之後,完全按使用量計費,無最低消費、無訂閱、無月費承諾——你為帳戶儲值,每次呼叫扣除其 token 費用。你可以隨時充值任意金額,並在儀表板中按模型查看使用情況。