---
title: &quot;OpenClaw 圖片生成 — 透過 API 使用 Flux、Imagen 4、GPT Image 與 Midjourney&quot;
description: &quot;在 OpenClaw agent 工作流中透過 Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney 生成圖片、編輯圖片並製作圖生影片。一個 RunAPI key，無需安裝額外技能。&quot;
url: &quot;https://runapi.ai/zh-TW/openclaw-image-generation.md&quot;
canonical: &quot;https://runapi.ai/zh-TW/openclaw-image-generation&quot;
locale: &quot;zh-TW&quot;
---

# 為 OpenClaw 添加 Flux、Imagen 4、GPT Image 與 Midjourney — 無需額外技能

你的 OpenClaw agent 用於對話的同一個 API key，也能呼叫 Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney — 10+ 款圖片模型，涵蓋 AI 繪圖、圖片編輯、圖生影片、提示詞反推和 seed 查詢，無需安裝額外技能。

每款模型滿足不同的生產需求。Flux Kontext 處理品牌一致性編輯和文字渲染。Imagen 4 生成具備強提示詞跟隨能力的照片級真實感圖片。Seedream 5 Lite 速度快且成本低，適合大批量工作流。GPT Image 2 擅長指令驅動的編輯和合成。Midjourney 適合風格化 AI 繪圖、創意視覺方向、圖片變體和圖生影片。它們都可以透過 OpenClaw agent 已在用於對話的同一個 RunAPI 任務流程來呼叫。

## 透過 RunAPI 在 OpenClaw 中生成圖片

1. **在 OpenClaw 中設定 RunAPI** — 如果你還沒有在 OpenClaw 中設定 RunAPI，請參考 OpenClaw 設定指南。添加 RunAPI provider，設定 baseUrl 為 https://runapi.ai/v1，並設定 RUNAPI_API_KEY 環境變數。
2. **發送圖片生成請求** — 在你的 agent 程式碼或直接 HTTP 呼叫中使用 RunAPI 任務端點。將 model 欄位設定為圖片模型的 slug，例如 flux-kontext-pro、imagen-4 或 gpt-image-2。請求體採用與 LLM 呼叫相同的 JSON 格式。
3. **輪詢並取得結果** — 圖片任務返回一個任務 ID。輪詢任務狀態端點或使用 webhook 回調。任務完成後，回應中包含生成圖片的 URL。RunAPI SDK 和 CLI 會自動處理輪詢。

## Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney

| 比較維度 | Flux Kontext | Imagen 4 | Seedream | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| 最佳預設用途 | 品牌一致性編輯、文字疊加、Logo 放置，以及帶風格參考的上下文內圖片修改。 | 基於詳細提示詞的照片級真實感生成、產品攝影，以及高保真單圖輸出。 | 速度和成本比最大細節更重要時的快速批量生成與原型開發。 | 指令驅動的合成、背景替換、風格遷移和多步圖片編輯。 | 創意視覺指導、精緻 AI 藝術圖、電影感構圖，以及更重視風格表現而非精準編輯的文生圖。 |
| 輸入類型 | 文字提示詞、用於上下文內編輯的參考圖，以及風格參考。 | 文字提示詞。快速、標準和超高畫質檔位。 | 文字提示詞，以及圖生圖所需的來源圖 URL。 | 生成用的文字提示詞；編輯和合成時文字提示詞加圖片 URL。 | 用文字提示詞生成圖片；用來源圖 URL 進行圖片編輯、圖生影片、提示詞反推和 seed 查詢。 |
| 輸出品質 | 高細節，文字渲染準確。擅長在多次編輯中保持品牌元素的一致性。 | 照片級真實感，提示詞跟隨能力強。超高畫質檔位可獲得最高細節。 | 速度上的高品質表現。適合草稿、縮圖和迭代循環。 | 高品質且指令跟隨能力強。最適合需要理解空間關係的編輯任務。 | 風格化且完成度高的視覺輸出。適合電影感概念圖、行銷視覺和 mood board。 |
| 速度 | 標準生成速度。適合互動式和批量工作流。 | 快速檔位可實現近即時輸出。標準和超高畫質檔位在速度和品質之間取捨。 | 在低成本批量生成場景中速度優勢明顯，適合高吞吐流水線。 | 標準速度。複雜多步編輯稍慢。 | 非同步任務流程。適合可以在媒體生成期間輪詢或接收回調的 agent 流水線。 |
| 每張圖成本 | 最低 2.5 美分（Pro）。Max 檔位 5 美分，保真度更高。 | 最低 2 美分（快速）至 6 美分（超高畫質）。標準檔位 4 美分。 | 文生圖和圖生圖均為每張 2.75 美分。 | 最低 3 美分，按解析度計費。 | 生產使用前，請在即時 Midjourney 模型頁面按端點確認目前任務價格。 |
| 最適合 OpenClaw agent 的場景 | 當 agent 工作流涉及品牌素材、行銷圖片或含文字的視覺內容時。 | 當 agent 需要根據自然語言描述生成照片級真實感圖片時。 | 當 agent 每次會話生成大量圖片，且成本或速度是首要考量時。 | 當 agent 根據使用者指令編輯現有圖片時。 | 當 agent 需要成熟的創意視覺方向、圖片變體，或從選定畫面生成影片時。 |

## USE CASES

- **行銷素材生成** — OpenClaw agent 可以透過呼叫 Flux Kontext 或 Imagen 4 來生成產品圖片、社群媒體視覺內容和廣告創意。Agent 根據對話上下文撰寫提示詞，在同一個會話中取得完成的圖片。
- **自動圖片編輯** — 將現有圖片 URL 和編輯指令傳給 GPT Image 2 或 Seedream。Agent 可以移除背景、替換風格或合成元素，無需人工設計工具。
- **大批量圖片迭代** — 需要原型化 UI 元件、社群廣告或產品變體的 OpenClaw agent 可以受益於 Seedream 5 Lite 的速度和低單圖成本。每次會話生成 20 個草稿，再將選定提示詞發送到 Flux Kontext Pro 輸出最終結果。
- **Midjourney 創意視覺方向** — 當 agent 需要高完成度 AI 藝術圖、電影感概念視覺、圖片變體，或基於選定畫面做圖生影片動效測試時，使用 Midjourney。

## 透過 RunAPI 任務端點生成圖片

每款圖片模型使用相同的 RunAPI key 和任務生命週期。切換模型 slug 和端點即可在 Flux、Imagen、Seedream、GPT Image 和 Midjourney 之間切換。回應返回用於輪詢的任務 ID；當 agent 需要更成熟的創意圖片風格時可選擇 Midjourney。

### Flux Kontext

POST /api/v1/task/text_to_image

```json
{
  &quot;model&quot;: &quot;flux-kontext-pro&quot;,
  &quot;prompt&quot;: &quot;A futuristic city skyline at sunset, photorealistic, 8K detail&quot;
}
```
### Imagen 4

POST /api/v1/task/text_to_image

```json
{
  &quot;model&quot;: &quot;imagen-4&quot;,
  &quot;prompt&quot;: &quot;A golden retriever wearing astronaut suit, studio lighting&quot;
}
```
### GPT Image 2

POST /api/v1/task/edit_image

```json
{
  &quot;model&quot;: &quot;gpt-image-2&quot;,
  &quot;prompt&quot;: &quot;Remove the background and add a tropical beach&quot;,
  &quot;image_url&quot;: &quot;https://example.com/photo.jpg&quot;
}
```
### Midjourney

POST /api/v1/midjourney/text_to_image

```json
{
  &quot;model&quot;: &quot;midjourney-v8.1&quot;,
  &quot;prompt&quot;: &quot;A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting&quot;,
  &quot;aspect_ratio&quot;: &quot;16:9&quot;
}
```

## 同一個 API key 還能生成影片和音樂

- **影片生成** — 使用 Kling 3.0、Veo 3 和 Seedance 2.0 生成影片片段。文生影片和圖生影片端點與圖片生成共用相同的非同步任務生命週期。
- **音樂創作** — 使用 Suno v4、v4.5 和 v5 創作音樂。在提示詞中描述曲風、情緒和歌詞。任務完成後，agent 收到音訊 URL。

## 圖片生成費用最低每張 2 美分

RunAPI 採用按量計費，無月度訂閱費。每款圖片模型按模型檔位、端點和輸出規格收取單次任務費用。Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney 的目前費率請以即時定價頁面和模型頁面為準。

本頁價格反映發布時 RunAPI 的按量計費費率。RunAPI 根據運算成本加透明利潤率定價。實際單圖成本可能因解析度、畫質檔位或模型專屬選項而有所不同。生產部署前請在即時定價頁面確認當前價格。

## OpenClaw 圖片生成常見問題

### 在我的 OpenClaw 工作流中，如何在 Flux Kontext 和 Imagen 4 之間選擇？

當 agent 生成品牌素材、行銷圖片或含文字的視覺內容時，使用 Flux Kontext Pro — 它能保持風格一致性並準確渲染文字。當 agent 需要根據自然語言描述生成照片級真實感圖片時，使用 Imagen 4。兩款模型都可透過同一個 RunAPI 端點呼叫。
### 哪些圖片模型可以透過 RunAPI 在 OpenClaw 中使用？

Flux Kontext Pro 和 Max、Imagen 4 快速/標準/超高畫質三個檔位、Seedream 5 Lite、GPT Image 2、Midjourney、Nano Banana 以及更多模型。透過同一個 API key 可存取 10+ 款圖片模型。完整列表在 RunAPI 定價頁面，並隨新模型上線自動更新。
### 透過 RunAPI 生成圖片需要多少費用？

RunAPI 圖片生成按量計費，無月度最低消費。不同模型會按端點、畫質檔位、輸出解析度或任務類型計費；請在即時定價頁面查看 Flux、Imagen、Seedream、GPT Image 和 Midjourney 的目前費率。
### RunAPI 對圖片呼叫和 LLM 呼叫分開收費嗎？

不。RunAPI 所有模態共用一個積分餘額。圖片、影片、音樂和 LLM 呼叫均從同一帳戶餘額扣除。無按模態訂閱費或最低消費。你可以在 RunAPI 控制台按模型監控消費情況。
### 如何在 OpenClaw 工作流中切換圖片模型？

修改請求體中的 model 欄位即可。端點、API key、任務生命週期和輪詢方式保持不變。你的 agent 可以根據任務類型路由到不同模型，無需修改任何串接程式碼。例如，草稿路由到 seedream-5-lite-text-to-image，最終輸出路由到 flux-kontext-pro。
### RunAPI 的圖片生成比 fal.ai 或 Replicate 更便宜嗎？

RunAPI 圖片生成最低每張 2 美分起，fal.ai 約 4 美分，Replicate 約 3.5 美分。具體價格因模型和解析度而異。請在 RunAPI 定價頁面查看各模型當前費率。

## Links

- [Flux Kontext](https://runapi.ai/zh-TW/models/flux-kontext)
- [Imagen 4](https://runapi.ai/zh-TW/models/imagen-4)
- [Seedream](https://runapi.ai/zh-TW/models/seedream)
- [GPT Image 2](https://runapi.ai/zh-TW/models/gpt-image-2)
- [Midjourney](https://runapi.ai/zh-TW/models/midjourney)
- [AI Video API Comparison](https://runapi.ai/zh-TW/ai-video-api-comparison)
- [Suno](https://runapi.ai/zh-TW/models/suno)
- [Models Hub](https://runapi.ai/zh-TW/models)
- [OpenClaw Setup](https://runapi.ai/zh-TW/openclaw)
- [Pricing](https://runapi.ai/zh-TW/pricing)
- [API docs](https://runapi.ai/zh-TW/docs)
