---
title: "龙虾 (OpenClaw) 图片生成 — 通过 API 使用 Flux、Imagen 4、GPT Image 与 Midjourney"
description: "在龙虾 (OpenClaw) agent 工作流中通过 Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney 生成图片、编辑图片并制作图生视频。一个 RunAPI key，无需安装额外技能。"
url: "https://runapi.ai/zh-CN/openclaw-image-generation.md"
canonical: "https://runapi.ai/zh-CN/openclaw-image-generation"
locale: "zh-CN"
---

# 为 OpenClaw 添加 Flux、Imagen 4、GPT Image 与 Midjourney — 无需额外技能

你的 OpenClaw agent 用于对话的同一个 API key，也能调用 Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney — 10+ 款图片模型，覆盖 AI 绘图、图片编辑、图生视频、提示词反推和 seed 查询，无需安装额外技能。

每款模型满足不同的生产需求。Flux Kontext 处理品牌一致性编辑和文字渲染。Imagen 4 生成具备强提示词跟随能力的照片级真实感图片。Seedream 5 Lite 速度快且成本低，适合大批量工作流。GPT Image 2 擅长指令驱动的编辑和合成。Midjourney 适合风格化 AI 绘图、创意视觉方向、图片变体和图生视频。它们都可以通过 OpenClaw agent 已在用于对话的同一个 RunAPI 任务流程来调用。

## 通过 RunAPI 在 OpenClaw 中生成图片

1. **在 OpenClaw 中配置 RunAPI** — 如果你还没有在 OpenClaw 中设置 RunAPI，请参考 OpenClaw 配置指南。添加 RunAPI provider，设置 baseUrl 为 https://runapi.ai/v1，并配置 RUNAPI_API_KEY 环境变量。
2. **发送图片生成请求** — 在你的 agent 代码或直接 HTTP 调用中使用 RunAPI 任务端点。将 model 字段设置为图片模型的 slug，例如 flux-kontext-pro、imagen-4 或 gpt-image-2。请求体采用与 LLM 调用相同的 JSON 格式。
3. **轮询并获取结果** — 图片任务返回一个任务 ID。轮询任务状态端点或使用 webhook 回调。任务完成后，响应中包含生成图片的 URL。RunAPI SDK 和 CLI 会自动处理轮询。

## Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney

| 对比维度 | Flux Kontext | Imagen 4 | Seedream | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| 最佳默认用途 | 品牌一致性编辑、文字叠加、Logo 放置，以及带风格参考的上下文内图片修改。 | 基于详细提示词的照片级真实感生成、产品摄影，以及高保真单图输出。 | 速度和成本比最大细节更重要时的快速批量生成与原型开发。 | 指令驱动的合成、背景替换、风格迁移和多步图片编辑。 | 创意视觉指导、精致 AI 艺术图、电影感构图，以及更重视风格表现而非精确编辑的文生图。 |
| 输入类型 | 文字提示词、用于上下文内编辑的参考图，以及风格参考。 | 文字提示词。快速、标准和超高画质档位。 | 文字提示词，以及图生图所需的源图 URL。 | 生成用的文字提示词；编辑和合成时文字提示词加图片 URL。 | 用文字提示词生成图片；用源图 URL 进行图片编辑、图生视频、提示词反推和 seed 查询。 |
| 输出质量 | 高细节，文字渲染准确。擅长在多次编辑中保持品牌元素的一致性。 | 照片级真实感，提示词跟随能力强。超高画质档位可获得最高细节。 | 速度上的高质量表现。适合草稿、缩略图和迭代循环。 | 高质量且指令跟随能力强。最适合需要理解空间关系的编辑任务。 | 风格化且完成度高的视觉输出。适合电影感概念图、营销视觉和 mood board。 |
| 速度 | 标准生成速度。适合交互式和批量工作流。 | 快速档位可实现近即时输出。标准和超高画质档位在速度和质量之间取舍。 | 在低成本批量生成场景中速度优势明显，适合高吞吐流水线。 | 标准速度。复杂多步编辑稍慢。 | 异步任务流程。适合可以在媒体生成期间轮询或接收回调的 agent 流水线。 |
| 每张图成本 | 最低 2.5 美分（Pro）。Max 档位 5 美分，保真度更高。 | 最低 2 美分（快速）至 6 美分（超高画质）。标准档位 4 美分。 | 文生图和图生图均为每张 2.75 美分。 | 最低 3 美分，按分辨率计费。 | 生产使用前，请在实时 Midjourney 模型页面按端点确认当前任务价格。 |
| 最适合 OpenClaw agent 的场景 | 当 agent 工作流涉及品牌素材、营销图片或含文字的视觉内容时。 | 当 agent 需要根据自然语言描述生成照片级真实感图片时。 | 当 agent 每次会话生成大量图片，且成本或速度是首要考量时。 | 当 agent 根据用户指令编辑现有图片时。 | 当 agent 需要成熟的创意视觉方向、图片变体，或从选定画面生成视频时。 |

## USE CASES

- **营销素材生成** — OpenClaw agent 可以通过调用 Flux Kontext 或 Imagen 4 来生成产品图片、社交媒体视觉内容和广告创意。Agent 根据对话上下文编写提示词，在同一个会话中获取完成的图片。
- **自动图片编辑** — 将现有图片 URL 和编辑指令传给 GPT Image 2 或 Seedream。Agent 可以移除背景、替换风格或合成元素，无需人工设计工具。
- **大批量图片迭代** — 需要原型化 UI 组件、社交广告或产品变体的 OpenClaw agent 可以受益于 Seedream 5 Lite 的速度和低单图成本。每次会话生成 20 个草稿，再将选定提示词发送到 Flux Kontext Pro 输出最终结果。
- **Midjourney 创意视觉方向** — 当 agent 需要高完成度 AI 艺术图、电影感概念视觉、图片变体，或基于选定画面做图生视频动效测试时，使用 Midjourney。

## 通过 RunAPI 任务端点生成图片

每款图片模型使用相同的 RunAPI key 和任务生命周期。切换模型 slug 和端点即可在 Flux、Imagen、Seedream、GPT Image 和 Midjourney 之间切换。响应返回用于轮询的任务 ID；当 agent 需要更成熟的创意图片风格时可选择 Midjourney。

### Flux Kontext

POST /api/v1/task/text_to_image

```json
{
  "model": "flux-kontext-pro",
  "prompt": "A futuristic city skyline at sunset, photorealistic, 8K detail"
}
```
### Imagen 4

POST /api/v1/task/text_to_image

```json
{
  "model": "imagen-4",
  "prompt": "A golden retriever wearing astronaut suit, studio lighting"
}
```
### GPT Image 2

POST /api/v1/task/edit_image

```json
{
  "model": "gpt-image-2",
  "prompt": "Remove the background and add a tropical beach",
  "image_url": "https://example.com/photo.jpg"
}
```
### Midjourney

POST /api/v1/midjourney/text_to_image

```json
{
  "model": "midjourney-v8.1",
  "prompt": "A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting",
  "aspect_ratio": "16:9"
}
```

## 同一个 API key 还能生成视频和音乐

- **视频生成** — 使用 Kling 3.0、Veo 3 和 Seedance 2.0 生成视频片段。文生视频和图生视频端点与图片生成共用相同的异步任务生命周期。
- **音乐创作** — 使用 Suno v4、v4.5 和 v5 创作音乐。在提示词中描述流派、情绪和歌词。任务完成后，agent 收到音频 URL。

## 图片生成费用最低每张 2 美分

RunAPI 采用按量计费，无月度订阅费。每款图片模型按模型档位、端点和输出规格收取单次任务费用。Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney 的当前费率请以实时定价页面和模型页面为准。

本页价格反映发布时 RunAPI 的按量计费费率。RunAPI 根据计算成本加透明利润率定价。实际单图成本可能因分辨率、画质档位或模型专属选项而有所不同。生产部署前请在实时定价页面确认当前价格。

## OpenClaw 图片生成常见问题

### 在我的 OpenClaw 工作流中，如何在 Flux Kontext 和 Imagen 4 之间选择？

当 agent 生成品牌素材、营销图片或含文字的视觉内容时，使用 Flux Kontext Pro — 它能保持风格一致性并准确渲染文字。当 agent 需要根据自然语言描述生成照片级真实感图片时，使用 Imagen 4。两款模型都可通过同一个 RunAPI 端点调用。
### 哪些图片模型可以通过 RunAPI 在 OpenClaw 中使用？

Flux Kontext Pro 和 Max、Imagen 4 快速/标准/超高画质三个档位、Seedream 5 Lite、GPT Image 2、Midjourney、Nano Banana 以及更多模型。通过同一个 API key 可访问 10+ 款图片模型。完整列表在 RunAPI 定价页面，并随新模型上线自动更新。
### 通过 RunAPI 生成图片需要多少费用？

RunAPI 图片生成按量计费，无月度最低消费。不同模型会按端点、画质档位、输出分辨率或任务类型计费；请在实时定价页面查看 Flux、Imagen、Seedream、GPT Image 和 Midjourney 的当前费率。
### RunAPI 对图片调用和 LLM 调用分开收费吗？

不。RunAPI 所有模态共用一个积分余额。图片、视频、音乐和 LLM 调用均从同一账户余额扣除。无按模态订阅费或最低消费。你可以在 RunAPI 控制台按模型监控消费情况。
### 如何在 OpenClaw 工作流中切换图片模型？

修改请求体中的 model 字段即可。端点、API key、任务生命周期和轮询方式保持不变。你的 agent 可以根据任务类型路由到不同模型，无需修改任何集成代码。例如，草稿路由到 seedream-5-lite-text-to-image，最终输出路由到 flux-kontext-pro。
### RunAPI 的图片生成比 fal.ai 或 Replicate 更便宜吗？

RunAPI 图片生成最低每张 2 美分起，fal.ai 约 4 美分，Replicate 约 3.5 美分。具体价格因模型和分辨率而异。请在 RunAPI 定价页面查看各模型当前费率。

## Links

- [Flux Kontext](https://runapi.ai/zh-CN/models/flux-kontext)
- [Imagen 4](https://runapi.ai/zh-CN/models/imagen-4)
- [Seedream](https://runapi.ai/zh-CN/models/seedream)
- [GPT Image 2](https://runapi.ai/zh-CN/models/gpt-image-2)
- [Midjourney](https://runapi.ai/zh-CN/models/midjourney)
- [AI Video API Comparison](https://runapi.ai/zh-CN/ai-video-api-comparison)
- [Suno](https://runapi.ai/zh-CN/models/suno)
- [Models Hub](https://runapi.ai/zh-CN/models)
- [OpenClaw Setup](https://runapi.ai/zh-CN/openclaw)
- [Pricing](https://runapi.ai/zh-CN/pricing)
- [API docs](https://runapi.ai/zh-CN/docs/guides)
