緩存輸入
重複的提示前置內容按較低的輸入費率計費。RunAPI 以 OpenAI 緩存費率的 50% 傳遞折扣。
GPT-5.4 每百萬 token 輸入收費 $2.50、輸出收費 $15;GPT-5.5 則為 $5 同 $30。RunAPI 讓你以一半價格使用相同 models——同一 API、同一 output、同行為,invoice 上的金額更低。
OpenAI 按每百萬 token 收費,input(你的 prompt)同 output(model 的回應)有不同費率。Output tokens 較貴——因為 model 要逐個生成。當你重新傳送相同 prompt prefix 時,亦有較便宜的 cached-input rate。以下所有數字均按每百萬 token 計算。
透過 RunAPI,GPT-5.4 輸入 $1.25/M,輸出 $7.50/M。官方費率為 $2.50/$15。
GPT-5.4-mini——適合高用量工作而又不需要完整旗艦能力的較便宜選項。經 RunAPI 收費享 50% off。
透過 RunAPI,GPT-5.5 輸入 $2.50/M,輸出 $15/M。官方費率為 $5/$30。
緩存輸入 token 的費用遠低於標準輸入——透過 RunAPI 享 50% 折扣。
表格顯示官方 OpenAI pricing 以及 RunAPI pricing。Output tokens 比 input tokens 貴得多——這是設計使然,因為生成每個 token 比讀取它需要更多 compute。RunAPI 對所有 GPT models 套用劃一 50% discount。無 volume commits,無 subscriptions。
| 模型 | 官方輸入 /M | 官方輸出 /M | RunAPI 輸入 /M | RunAPI 輸出 /M | 上下文視窗 |
|---|---|---|---|---|---|
| GPT-5.5 | $5.00 | $30.00 | $2.50 | $15.00 | 400K |
| GPT-5.4 | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
| GPT-5.4-mini | $0.25 | $2.00 | $0.13 | $1.00 | 400K |
| GPT-5.3-codex | $2.50 | $15.00 | $1.25 | $7.50 | 400K |
OpenAI 對快取輸入 token 收費較低,而可等待最多 24 小時的工作,批次請求成本亦會減半。如果你正在運行 coding agent 或處理大量批次,這兩點都很重要——重複 context 同大量工作量會好快累積成本。
重複的提示前置內容按較低的輸入費率計費。RunAPI 以 OpenAI 緩存費率的 50% 傳遞折扣。
提交到 Batch API 的請求以標準費率的一半運行,回應時間最長 24 小時。RunAPI 在自身折扣之上傳遞此折扣。
GPT-5 模型讓你設置推理力度。較低的力度會產生更少的推理 token,直接降低按量計費的輸出費用。
限制每次請求的最大輸出 token 數量,以控制費用並避免長時間代理任務中的失控生成。
Token 費率看起來抽象,直到你把它對應到實際工作。一個每日處理 50 段對話的 customer-support chatbot,成本結構就不同於全天運行的 coding agent,或處理數百份文件的 content pipeline。以下是常見 developer workloads——包括 automation workflows——在兩個用量水平下,以 RunAPI rates 計算的預估每月成本。
| 工作負載 | 模型 | 輕度使用(每天約 50 個任務) | 重度使用(每天約 200 個任務) | 相比官方的每月節省 |
|---|---|---|---|---|
| 編程 Agent(Codex) | GPT-5.3-codex | $20/月 | $80/月 | $20–$80 |
| 客戶支持聊天機器人 | GPT-5.4-mini | $6/月 | $24/月 | $6–$24 |
| RAG 知識助手 | GPT-5.4 | $18/月 | $72/月 | $18–$72 |
| 內容生成流水線 | GPT-5.4 | $25/月 | $100/月 | $25–$100 |
| 多 Agent 協調器 | GPT-5.5 | $90/月 | $360/月 | $90–$360 |
鎖定單一 provider 係真實風險,因為一次隔夜減價就可以令競爭對手平 30%。以下係旗艦模型每百萬 token 的比較——OpenAI、Anthropic 同 Google 並排展示——讓你毋須翻查三個 billing 頁面都可以作決定。RunAPI 提供一條 API key,可路由到三者全部。
| 供應商 | 旗艦模型 | 輸入 /M | 輸出 /M | RunAPI 費率 |
|---|---|---|---|---|
| OpenAI | GPT-5.4 | $2.50 | $15.00 | $1.25 / $7.50 |
| Anthropic | Claude Opus 4.7 | $10.00 | $50.00 | $5.00 / $25.00 |
| Gemini 2.5 Pro | $1.25 | $10.00 | $0.63 / $5.00 |
RunAPI 對以上所有供應商均提供 50% 折扣。價格已於 2026 年 6 月核實。
在 runapi.ai 註冊。免費方案無需信用卡。
前往 Dashboard → API Keys。創建一個密鑰並保存——你將以此作為 OpenAI API key。
將 base URL 設定為 https://runapi.ai/v1,並使用你的 RunAPI 密鑰。任何兼容 OpenAI 的客戶端均可使用。
在 model 參數中使用 gpt-5.4、gpt-5.5 或任何 GPT 模型 ID。RunAPI 以官方費率的 50% 處理路由和計費。
GPT-5.4 的官方定價為每百萬輸入 token $2.50,每百萬輸出 token $15。GPT-5.5 為 $5 和 $30。透過 RunAPI,每個 GPT 模型均以這些費率的一半計費——GPT-5.4 的輸入為 $1.25/M,輸出為 $7.50/M。
RunAPI 與模型供應商協商批量定價,並將節省的費用傳遞給開發者。請求到達相同的 OpenAI 模型,輸出、安全過濾器和行為完全相同,因此唯一的差異是你帳單上更低的費率。沒有質量上的取捨,也沒有單獨的計費層級——折扣自動應用於每個 GPT 模型。
可以。新的 RunAPI 帳戶會獲得免費 credits,用嚟測試任何 GPT model——毋須信用卡。之後收費按用量計算,無每月最低消費,亦無訂閱。充值餘額後,每次 API call 都會扣除其 token 成本。你可以充值任何金額,並在 dashboard 按 model 追蹤用量。
有,而且很適合 n8n、Make 或 Zapier 等自動化工具。每個呼叫 GPT model 的 workflow step 都按所用 token 收費——沒有額外 per-call 費用或 rate limit tier。對於定時執行或批次處理的 workflow,Batch API 折扣(50% off)適用,並可疊加 RunAPI 的基本折扣,所以 recurring automation jobs 成本會顯著降低。
圖片輸入按 tile 收費——OpenAI 會將圖片分成 512×512 tiles,並按 tile 收費。音訊按輸入秒數收費。兩者都不使用每百萬 token 的單位。RunAPI 以同樣 50% discount 轉嫁 image 同 audio pricing,所以一次 GPT-4o vision request 或 Whisper transcription 只需官方價格的一半。
可以。RunAPI 兼容 OpenAI。將任何 OpenAI 客戶端指向 https://runapi.ai/v1,使用你的 RunAPI 密鑰,並傳遞 GPT 模型 ID。已使用 OpenAI SDK 的現有代碼除了 base URL 和密鑰外無需任何修改,因此遷移一個現有項目大約需要一分鐘。
可以。GPT-5.3-codex 透過 RunAPI 以官方費率的 50% 提供,即每百萬 token 輸入 $1.25,輸出 $7.50。透過覆蓋其設置中的 base URL 和密鑰,它可與 Codex 和其他兼容 OpenAI 的編程工具配合使用。緩存輸入和批量折扣也會傳遞,進一步降低重複編程會話的實際費用。
有。新 RunAPI 帳戶在承諾之前可獲得免費積分以測試任何 GPT 模型。之後,計費嚴格按使用量付費,無最低消費、無訂閱、無月度承諾——你充值一個餘額,每次呼叫扣除其 token 費用。你可以充值任意金額,並在 Dashboard 中按模型查看使用情況。