OpenAI · 圖像

OpenClaw x GPT-4o Image

GPT-4o Image 將視覺創作原生整合到 GPT-4o 中,結合推理與生成。透過 RunAPI,它與所有 OpenAI 模型共用相同的 API 存取及計費方式。

1 variants 由 $0.06 / 次請求 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 gpt-4o-image:gpt-4o-image。

You have access to RunAPI task tools for GPT-4o Image.

Available GPT-4o Image models:
- gpt-4o-image: gpt-4o-image
  endpoints: /api/v1/gpt_4o_image/text_to_image
  request fields: model, prompt, aspect_ratio

Use the model ID and endpoint that match the user's request.
Example prompt: 根據我們關於品牌重新設計的討論,生成新首頁主視覺區的模擬圖。
/api/v1/gpt_4o_image/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_4o_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

公開版本與端點

模型 ID 端點 起始價格 模型目錄
gpt-4o-image
/api/v1/gpt_4o_image/text_to_image
$0.06 / 次請求 模型詳情

驗證

輪詢,直到 Task 進入終態

POST /api/v1/gpt_4o_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

設定

指南端點: /api/v1/gpt_4o_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_4o_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-image",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1"
}'
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

使用 OpenClaw + GPT-4o Image 可以建立甚麼

  • 營銷與產品圖片

    根據文字需求生成營銷活動圖片、產品圖和社交媒體素材。

  • 批量素材變體

    一次運行生成同一創意的多個版本,比較風格、版面和尺寸。

  • 編輯與局部重繪

    當模型提供編輯端點時,描述對背景、物件或細節的修改即可調整現有圖片。

為甚麼透過 RunAPI + OpenClaw 使用 GPT-4o Image

  • 1 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 自動化工作流程

    透過一致的工作流程提交工作、查詢狀態並收集非同步結果,無需編寫手動輪詢程式碼。

OpenClaw + GPT-4o Image 常見問題

GPT-4o Image 與 GPT Image 有甚麼不同?

GPT-4o Image 在 GPT-4o 對話中原生生成圖片,利用對話情境指導圖片內容。GPT Image 則是獨立的生成端點。

對話情境有甚麼幫助?

模型會利用完整對話記錄理解你的需要——你可以用自然語言描述改動,逐步完善圖片。

一張圖片可以處理多少個物件?

GPT-4o Image 能在單一場景中處理多個不同物件,同時保持構圖連貫及物件特徵。

可以編輯之前生成的圖片嗎?

可以——在對話中描述改動,模型便會修改現有圖片,同時保留場景的其餘部分。

它適合反覆迭代的設計工作流程嗎?

適合——對話式介面令迭代變得自然:生成、檢視、描述調整,然後重新生成,毋須重寫整個 prompt。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。

透過 OpenClaw 開始使用 GPT-4o Image

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們