OpenAI · 圖像

OpenClaw x GPT-4o Image

GPT-4o Image 將視覺創作原生整合進 GPT-4o,結合推理與生成能力。透過 RunAPI,它與所有 OpenAI 模型共用相同的 API 存取方式與計費。

1 variants 起價 $0.06 / 次呼叫 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 gpt-4o-image:gpt-4o-image。

You have access to RunAPI task tools for GPT-4o Image.

Available GPT-4o Image models:
- gpt-4o-image: gpt-4o-image
  endpoints: /api/v1/gpt_4o_image/text_to_image
  request fields: model, prompt, aspect_ratio

Use the model ID and endpoint that match the user's request.
Example prompt: 根據我們關於品牌改版的討論,生成新首頁主視覺區塊的示意圖。
/api/v1/gpt_4o_image/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_4o_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

公開版本與端點

模型 ID 端點 起始價格 模型目錄
gpt-4o-image
/api/v1/gpt_4o_image/text_to_image
$0.06 / 次呼叫 模型詳情

驗證

輪詢,直到 Task 進入終態

POST /api/v1/gpt_4o_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

設定

指南端點: /api/v1/gpt_4o_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_4o_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-image",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1"
}'
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

使用 OpenClaw + GPT-4o Image 可以打造什麼

  • 行銷與商品圖片

    根據文字需求產生行銷活動圖片、商品圖和社群媒體素材。

  • 批次素材變體

    一次執行產生同一創意的多個版本,比較風格、版面和尺寸。

  • 編輯與局部重繪

    當模型提供編輯端點時,描述對背景、物件或細節的修改即可調整現有圖片。

為什麼透過 RunAPI + OpenClaw 使用 GPT-4o Image

  • 1 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需變更現有整合。

  • 清楚的用量價格

    送出請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 自動化工作流程

    透過一致的工作流程提交工作、查詢狀態並收集非同步結果,無需撰寫手動輪詢程式碼。

OpenClaw + GPT-4o Image 常見問題

GPT-4o Image 和 GPT Image 有什麼不同?

GPT-4o Image 在 GPT-4o 對話中原生生成圖片,並以對話脈絡作為圖片依據。GPT Image 則是獨立的生成端點。

對話脈絡有什麼幫助?

模型會利用完整的對話記錄來理解你的需求——你可以用自然語言描述修改內容,反覆調整圖片。

單張圖片中可以處理多少個物件?

GPT-4o Image 能在單一場景中處理許多不同的物件,同時維持構圖連貫性與物件辨識度。

可以編輯先前生成的圖片嗎?

可以——在對話中描述要修改的內容,模型就會修改既有圖片,同時保留場景的其餘部分。

適合反覆迭代的設計流程嗎?

適合——對話式介面讓迭代變得很自然:生成、檢視、描述調整,再重新生成,不必重寫完整的提示詞。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點都列在對應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。

開始在 OpenClaw 中使用 GPT-4o Image

正在與團隊一起打造?

我們可以協助企業接入、整合與技術問題。

聯絡我們