OpenAI · 圖像

Hermes Agent x GPT Image

GPT Image 是 OpenAI 的圖片生成模型,支援文字生成圖片及圖片編輯。透過 RunAPI,所有 GPT Image 端點共用同一個 key,並按次收費。

1 variants 由 $0.12 / 次請求 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任務合適時使用 gpt-image-1.5:圖片生成及編輯,構圖控制能力出色。

You have access to RunAPI task tools for GPT Image.

Available GPT Image models:
- gpt-image-1.5: 圖片生成及編輯,構圖控制能力出色
  endpoints: /api/v1/gpt_image/edit_image, /api/v1/gpt_image/text_to_image
  request fields: model, prompt, aspect_ratio, quality

Use the model ID and endpoint that match the user's request.
Example prompt: 生成一幅扁平化設計插畫:一個團隊圍着白板協作,色彩鮮明,線條簡潔。
/api/v1/gpt_image/edit_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_image/edit_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_image/edit_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。
/api/v1/gpt_image/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

公開版本與端點

模型 ID 端點 起始價格 模型目錄
gpt-image-1.5
/api/v1/gpt_image/edit_image /api/v1/gpt_image/text_to_image
$0.12 / 次請求 模型詳情

驗證

輪詢,直到 Task 進入終態

POST /api/v1/gpt_image/text_to_image,並儲存回傳的 Task ID。
GET /api/v1/gpt_image/text_to_image/<task-id>,直到狀態為 completed 或 failed。
確認 completed 回應包含 API 參考中記載的端點專屬輸出。

設定

指南端點: /api/v1/gpt_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-image-1.5",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1",
  "quality": "high"
}'
使用流程

三步開始使用

  1. 選擇模型 ID

    選擇公開模型 ID,並查看其端點與目前起始價格。

  2. 設定 RunAPI

    呼叫端點前設定 RUNAPI_API_KEY。

  3. 驗證結果

    對非同步端點輪詢同一路徑,直到 Task 進入終態。

使用 Hermes Agent + GPT Image 可以建立甚麼

  • 營銷與產品圖片

    根據文字需求生成營銷活動圖片、產品圖和社交媒體素材。

  • 批量素材變體

    一次運行生成同一創意的多個版本,比較風格、版面和尺寸。

  • 編輯與局部重繪

    當模型提供編輯端點時,描述對背景、物件或細節的修改即可調整現有圖片。

為甚麼透過 RunAPI + Hermes Agent 使用 GPT Image

  • 1 個變體,一個 API 金鑰

    透過一個 RunAPI 連線選擇可用的模型變體,無需更改現有整合。

  • 清晰的用量價格

    發送請求前查看目錄中的目前價格,無需訂閱或最低消費。

  • 自動化工作流程

    透過一致的工作流程提交工作、查詢狀態並收集非同步結果,無需編寫手動輪詢程式碼。

Hermes Agent + GPT Image 常見問題

GPT Image 支援哪些端點?

文字生成圖像同圖像編輯。兩者都接受包含構圖指令嘅詳細文字 prompt。

構圖控制如何運作?

GPT Image 會遵循 prompt 中的空間佈局指示——你可以指定物件出現的位置、相對大小及在畫面中的排列。

有哪些輸出尺寸可選?

3 種固定尺寸,最大 1536 像素。

GPT Image 與 GPT Image 2 相比如何?

GPT Image 2 是較新的模型,多語言文字渲染近乎完美,最高輸出 4K。GPT Image 是上一代模型,構圖控制能力出色。

可以用 GPT Image 進行編輯嗎?

可以——圖片編輯端點接受來源圖片,並根據你的文字 prompt 進行修改,可作為圖片編輯工具使用。

應該使用哪個模型 ID?

從版本表選擇公開模型 ID。每個 ID 可用的端點均列於相應資料列。

本指南會設定聊天模型嗎?

不會。此 Model Line 使用頁面所示的端點流程,不會被描述為 Agent 聊天模型。

透過 Hermes Agent 開始使用 GPT Image

正在與團隊一起建立?

我們可以協助企業設定、整合和技術問題。

聯絡我們