OpenAI · 图像

Hermes Agent x GPT Image

GPT Image 是 OpenAI 的图像生成模型,支持文生图和图像编辑。通过 RunAPI,所有 GPT Image 端点共享一把 key 和按次计费。

1 variants 起价 $0.12 / 次调用 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任务匹配时使用 gpt-image-1.5:支持图像生成和编辑,具备强构图控制能力。

You have access to RunAPI task tools for GPT Image.

Available GPT Image models:
- gpt-image-1.5: 支持图像生成和编辑,具备强构图控制能力
  endpoints: /api/v1/gpt_image/edit_image, /api/v1/gpt_image/text_to_image
  request fields: model, prompt, aspect_ratio, quality

Use the model ID and endpoint that match the user's request.
Example prompt: 生成一张扁平设计风格的团队协作白板插画,鲜艳色彩,干净线条。
/api/v1/gpt_image/edit_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_image/edit_image,并保存返回的 Task ID。
GET /api/v1/gpt_image/edit_image/<task-id>,直到状态为 completed 或 failed。
确认 completed 响应包含 API 参考中记录的端点专属输出。
/api/v1/gpt_image/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_image/text_to_image,并保存返回的 Task ID。
GET /api/v1/gpt_image/text_to_image/<task-id>,直到状态为 completed 或 failed。
确认 completed 响应包含 API 参考中记录的端点专属输出。

公开版本与端点

模型 ID 端点 起步价格 模型目录
gpt-image-1.5
/api/v1/gpt_image/edit_image /api/v1/gpt_image/text_to_image
$0.12 / 次调用 模型详情

验证

轮询,直到 Task 进入终态

POST /api/v1/gpt_image/text_to_image,并保存返回的 Task ID。
GET /api/v1/gpt_image/text_to_image/<task-id>,直到状态为 completed 或 failed。
确认 completed 响应包含 API 参考中记录的端点专属输出。

配置

指南端点: /api/v1/gpt_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-image-1.5",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1",
  "quality": "high"
}'
使用流程

三步开始使用

  1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 配置 RunAPI

    调用端点前设置 RUNAPI_API_KEY。

  3. 验证结果

    对于异步端点,轮询同一端点,直到 Task 进入终态。

使用 Hermes Agent + GPT Image 可以构建什么

  • 营销与商品图

    根据文字需求生成营销活动图片、商品图和社交媒体素材。

  • 批量素材变体

    一次运行生成同一创意的多个版本,比较风格、版式和尺寸。

  • 编辑与局部重绘

    当模型提供编辑端点时,描述对背景、物体或细节的修改即可调整现有图片。

为什么通过 RunAPI + Hermes Agent 使用 GPT Image

  • 1 个变体,一个 API 密钥

    通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。

  • 清晰的用量价格

    发送请求前查看目录中的当前价格,无需订阅或最低消费。

  • 自动化任务流程

    通过一致的任务流程提交任务、查询状态并收集异步结果,无需编写手动轮询代码。

Hermes Agent + GPT Image 常见问题

GPT Image 支持哪些端点?

支持文本生成图像和图像编辑。两者均接受带有构图指令的详细文本提示词。

构图控制是如何工作的?

GPT Image 遵循提示词中的空间布局指令——你可以指定对象的位置、相对大小以及在画面中的排列方式。

支持哪些输出尺寸?

最多支持 1536 像素的 3 种固定尺寸。

GPT Image 和 GPT Image 2 有什么区别?

GPT Image 2 是更新的模型,具备近乎完美的多语言文字渲染能力,最高支持 4K 输出。GPT Image 是上一代产品,具备强大的构图控制能力。

GPT Image 能用于图像编辑吗?

可以——图像编辑端点接受源图像,并根据文本提示词对其进行修改,充当图像编辑工具。

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。

开始在 Hermes Agent 中使用 GPT Image

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们