OpenAI · 图像

OpenClaw x GPT-4o Image

GPT-4o Image 将视觉创作原生集成到 GPT-4o 中,融合推理与生成。通过 RunAPI,与所有 OpenAI 模型共享 API 和计费。

1 variants 起价 $0.06 / 次调用 可商用

Prerequisite: npx runapi mcp install

Prompt

Prompt 模型

任务匹配时使用 gpt-4o-image:gpt-4o-image。

You have access to RunAPI task tools for GPT-4o Image.

Available GPT-4o Image models:
- gpt-4o-image: gpt-4o-image
  endpoints: /api/v1/gpt_4o_image/text_to_image
  request fields: model, prompt, aspect_ratio

Use the model ID and endpoint that match the user's request.
Example prompt: 根据我们关于品牌重设计的对话,生成一张新首页 hero 区域的 mockup。
/api/v1/gpt_4o_image/text_to_image: Submit the task, poll for its status, then verify the completed output. POST /api/v1/gpt_4o_image/text_to_image,并保存返回的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到状态为 completed 或 failed。
确认 completed 响应包含 API 参考中记录的端点专属输出。

公开版本与端点

模型 ID 端点 起步价格 模型目录
gpt-4o-image
/api/v1/gpt_4o_image/text_to_image
$0.06 / 次调用 模型详情

验证

轮询,直到 Task 进入终态

POST /api/v1/gpt_4o_image/text_to_image,并保存返回的 Task ID。
GET /api/v1/gpt_4o_image/text_to_image/<task-id>,直到状态为 completed 或 failed。
确认 completed 响应包含 API 参考中记录的端点专属输出。

配置

指南端点: /api/v1/gpt_4o_image/text_to_image

export RUNAPI_API_KEY=your_api_key

curl -X POST https://runapi.ai/api/v1/gpt_4o_image/text_to_image \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gpt-4o-image",
  "prompt": "A cobalt vase on white marble.",
  "aspect_ratio": "1:1"
}'
使用流程

三步开始使用

  1. 选择模型 ID

    选择公开模型 ID,并查看其端点与当前起步价格。

  2. 配置 RunAPI

    调用端点前设置 RUNAPI_API_KEY。

  3. 验证结果

    对于异步端点,轮询同一端点,直到 Task 进入终态。

使用 OpenClaw + GPT-4o Image 可以构建什么

  • 营销与商品图

    根据文字需求生成营销活动图片、商品图和社交媒体素材。

  • 批量素材变体

    一次运行生成同一创意的多个版本,比较风格、版式和尺寸。

  • 编辑与局部重绘

    当模型提供编辑端点时,描述对背景、物体或细节的修改即可调整现有图片。

为什么通过 RunAPI + OpenClaw 使用 GPT-4o Image

  • 1 个变体,一个 API 密钥

    通过一个 RunAPI 连接选择可用的模型变体,无需更改现有集成。

  • 清晰的用量价格

    发送请求前查看目录中的当前价格,无需订阅或最低消费。

  • 自动化任务流程

    通过一致的任务流程提交任务、查询状态并收集异步结果,无需编写手动轮询代码。

OpenClaw + GPT-4o Image 常见问题

GPT-4o Image 与 GPT Image 有什么区别?

GPT-4o Image 在 GPT-4o 对话中原生生成图像,利用对话上下文指导图像内容。GPT Image 是独立的图像生成端点。

对话上下文有什么帮助?

模型会利用完整的对话历史来理解你的需求——你可以用自然语言描述修改内容,迭代优化图像。

单张图像中能处理多少个对象?

GPT-4o Image 可以在单个场景中处理多个不同对象,同时保持构图连贯性和对象身份。

我能编辑之前生成的图像吗?

可以——在对话中描述修改内容,模型会在保留场景其余部分的同时修改现有图像。

它适合迭代设计工作流吗?

适合——对话式界面让迭代变得自然:生成、审查、描述调整,再重新生成,无需重写完整提示词。

应该使用哪个模型 ID?

从版本表选择公开模型 ID。每个 ID 可使用的端点均显示在对应行。

本指南会配置聊天模型吗?

不会。该 Model Line 使用页面所示的端点流程,不会被描述为 Agent 聊天模型。

开始在 OpenClaw 中使用 GPT-4o Image

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们