為 OpenClaw 添加 Flux、Imagen 4、GPT Image 與 Midjourney — 無需額外技能
你的 OpenClaw agent 用於對話的同一個 API key,也能呼叫 Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney — 10+ 款圖片模型,涵蓋 AI 繪圖、圖片編輯、圖生影片、提示詞反推和 seed 查詢,無需安裝額外技能。
Install the RunAPI CLI and generate an image in this OpenClaw workspace.
- Run: npx runapi
- It will prompt you for an API key. Sign up at https://runapi.ai if you don't have one.
- Then run: npx runapi run text_to_image --model flux-kontext-pro --prompt "A red cube on a white table"
- Confirm the image URL appears in the output.
Available image models: flux-kontext-pro, imagen-4, seedream-5-lite-text-to-image, gpt-image-2-text-to-image, midjourney-v8.1.
含 Midjourney 的五款圖片模型,一個 API key,零額外技能
每款模型滿足不同的生產需求。Flux Kontext 處理品牌一致性編輯和文字渲染。Imagen 4 生成具備強提示詞跟隨能力的照片級真實感圖片。Seedream 5 Lite 速度快且成本低,適合大批量工作流。GPT Image 2 擅長指令驅動的編輯和合成。Midjourney 適合風格化 AI 繪圖、創意視覺方向、圖片變體和圖生影片。它們都可以透過 OpenClaw agent 已在用於對話的同一個 RunAPI 任務流程來呼叫。
文字渲染、品牌一致性和上下文內編輯。擅長處理文字疊加和風格參考的市場推廣素材。最低每張 2.5 美分。
高提示詞保真度的照片級真實感生成。標準、快速和超高畫質檔位讓你在速度和細節之間靈活取捨。最低每張 2 美分。
適合批量工作流的快速低成本生成。每次呼叫 2.75 美分,支援文生圖和圖生圖,適合原型開發和快速迭代。
指令驅動的編輯與合成。最適合提示詞描述轉換操作的任務 — 背景移除、風格遷移、物件放置。
面向創意視覺的 AI 繪圖、提示詞驅動編輯、圖生影片動畫、提示詞反推和 seed 查詢,統一透過 RunAPI 呼叫。
透過 RunAPI 在 OpenClaw 中生成圖片
在 OpenClaw 中設定 RunAPI
如果你還沒有在 OpenClaw 中設定 RunAPI,請參考 OpenClaw 設定指南。添加 RunAPI provider,設定 baseUrl 為 https://runapi.ai/v1,並設定 RUNAPI_API_KEY 環境變數。
發送圖片生成請求
在你的 agent 程式碼或直接 HTTP 呼叫中使用 RunAPI 任務端點。將 model 欄位設定為圖片模型的 slug,例如 flux-kontext-pro、imagen-4 或 gpt-image-2。請求體採用與 LLM 呼叫相同的 JSON 格式。
輪詢並取得結果
圖片任務返回一個任務 ID。輪詢任務狀態端點或使用 webhook 回調。任務完成後,回應中包含生成圖片的 URL。RunAPI SDK 和 CLI 會自動處理輪詢。
Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney
| 比較維度 | Flux Kontext Pro | Imagen 4 | Seedream 5 Lite | GPT Image 2 | Midjourney |
|---|---|---|---|---|---|
| 最佳預設用途 | 品牌一致性編輯、文字疊加、Logo 放置,以及帶風格參考的上下文內圖片修改。 | 基於詳細提示詞的照片級真實感生成、產品攝影,以及高保真單圖輸出。 | 速度和成本比最大細節更重要時的快速批量生成與原型開發。 | 指令驅動的合成、背景替換、風格遷移和多步圖片編輯。 | 創意視覺指導、精緻 AI 藝術圖、電影感構圖,以及更重視風格表現而非精準編輯的文生圖。 |
| 輸入類型 | 文字提示詞、用於上下文內編輯的參考圖,以及風格參考。 | 文字提示詞。快速、標準和超高畫質檔位。 | 文字提示詞,以及圖生圖所需的來源圖 URL。 | 生成用的文字提示詞;編輯和合成時文字提示詞加圖片 URL。 | 用文字提示詞生成圖片;用來源圖 URL 進行圖片編輯、圖生影片、提示詞反推和 seed 查詢。 |
| 輸出品質 | 高細節,文字渲染準確。擅長在多次編輯中保持品牌元素的一致性。 | 照片級真實感,提示詞跟隨能力強。超高畫質檔位可獲得最高細節。 | 速度上的高品質表現。適合草稿、縮圖和迭代循環。 | 高品質且指令跟隨能力強。最適合需要理解空間關係的編輯任務。 | 風格化且完成度高的視覺輸出。適合電影感概念圖、市場推廣視覺和 mood board。 |
| 速度 | 標準生成速度。適合互動式和批量工作流。 | 快速檔位可實現近即時輸出。標準和超高畫質檔位在速度和品質之間取捨。 | 在低成本批量生成場景中速度優勢明顯,適合高吞吐流水線。 | 標準速度。複雜多步編輯稍慢。 | 非同步任務流程。適合可以在媒體生成期間輪詢或接收回調的 agent 流水線。 |
| 每張圖成本 | 最低 2.5 美分(Pro)。Max 檔位 5 美分,保真度更高。 | 最低 2 美分(快速)至 6 美分(超高畫質)。標準檔位 4 美分。 | 文生圖和圖生圖均為每張 2.75 美分。 | 最低 3 美分,按解像度收費。 | 生產使用前,請在即時 Midjourney 模型頁面按端點確認目前任務收費。 |
| 最適合 OpenClaw agent 的場景 | 當 agent 工作流涉及品牌素材、市場推廣圖片或含文字的視覺內容時。 | 當 agent 需要根據自然語言描述生成照片級真實感圖片時。 | 當 agent 每次會話生成大量圖片,且成本或速度是首要考量時。 | 當 agent 根據用戶指令編輯現有圖片時。 | 當 agent 需要成熟的創意視覺方向、圖片變體,或從選定畫面生成影片時。 |
市場推廣素材生成
OpenClaw agent 可以透過呼叫 Flux Kontext 或 Imagen 4 來生成產品圖片、社交媒體視覺內容和廣告創意。Agent 根據對話上下文撰寫提示詞,在同一個會話中取得完成的圖片。
探索 Flux Kontext大批量圖片迭代
需要原型化 UI 元件、社交廣告或產品變體的 OpenClaw agent 可以受益於 Seedream 5 Lite 的速度和低單圖成本。每次會話生成 20 個草稿,再將選定提示詞發送到 Flux Kontext Pro 輸出最終結果。
探索 Seedream透過 RunAPI 任務端點生成圖片
每款圖片模型使用相同的 RunAPI key 和任務生命週期。切換模型 slug 和端點即可在 Flux、Imagen、Seedream、GPT Image 和 Midjourney 之間切換。回應返回用於輪詢的任務 ID;當 agent 需要更成熟的創意圖片風格時可選擇 Midjourney。
{
"model": "flux-kontext-pro",
"prompt": "A futuristic city skyline at sunset, photorealistic, 8K detail"
}
{
"model": "imagen-4",
"prompt": "A golden retriever wearing astronaut suit, studio lighting"
}
{
"model": "gpt-image-2",
"prompt": "Remove the background and add a tropical beach",
"image_url": "https://example.com/photo.jpg"
}
{
"model": "midjourney-v8.1",
"prompt": "A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting",
"aspect_ratio": "16:9"
}
同一個 API key 還能生成影片和音樂
圖片生成費用最低每張 2 美分
RunAPI 採用按量計費,無月度訂閱費。每款圖片模型按模型檔位、端點和輸出規格收取單次任務費用。Flux Kontext、Imagen 4、Seedream、GPT Image 2 和 Midjourney 的目前費率請以即時收費頁面和模型頁面為準。
收費方法說明
本頁收費反映發布時 RunAPI 的按量計費費率。RunAPI 根據運算成本加透明利潤率定價。實際單圖成本可能因解像度、畫質檔位或模型專屬選項而有所不同。生產部署前請在即時收費頁面確認當前收費。
OpenClaw 圖片生成常見問題
在我的 OpenClaw 工作流中,如何在 Flux Kontext 和 Imagen 4 之間選擇?
當 agent 生成品牌素材、市場推廣圖片或含文字的視覺內容時,使用 Flux Kontext Pro — 它能保持風格一致性並準確渲染文字。當 agent 需要根據自然語言描述生成照片級真實感圖片時,使用 Imagen 4。兩款模型都可透過同一個 RunAPI 端點呼叫。
哪些圖片模型可以透過 RunAPI 在 OpenClaw 中使用?
Flux Kontext Pro 和 Max、Imagen 4 快速/標準/超高畫質三個檔位、Seedream 5 Lite、GPT Image 2、Midjourney、Nano Banana 以及更多模型。透過同一個 API key 可存取 10+ 款圖片模型。完整列表在 RunAPI 收費頁面,並隨新模型上線自動更新。
透過 RunAPI 生成圖片需要多少收費?
RunAPI 圖片生成按量計費,無月度最低消費。不同模型會按端點、畫質檔位、輸出解像度或任務類型收費;請在即時收費頁面查看 Flux、Imagen、Seedream、GPT Image 和 Midjourney 的目前費率。
RunAPI 對圖片呼叫和 LLM 呼叫分開收費嗎?
不。RunAPI 所有模態共用一個積分餘額。圖片、影片、音樂和 LLM 呼叫均從同一帳戶餘額扣除。無按模態訂閱費或最低消費。你可以在 RunAPI 控制台按模型監控消費情況。
如何在 OpenClaw 工作流中切換圖片模型?
修改請求體中的 model 欄位即可。端點、API key、任務生命週期和輪詢方式保持不變。你的 agent 可以根據任務類型路由到不同模型,無需修改任何整合程式碼。例如,草稿路由到 seedream-5-lite-text-to-image,最終輸出路由到 flux-kontext-pro。
RunAPI 的圖片生成比 fal.ai 或 Replicate 更便宜嗎?
RunAPI 圖片生成最低每張 2 美分起,fal.ai 約 4 美分,Replicate 約 3.5 美分。具體收費因模型和解像度而異。請在 RunAPI 收費頁面查看各模型當前費率。
幾分鐘內為 OpenClaw 添加圖片生成能力。
一個 RunAPI key 讓你的 OpenClaw agent 可以存取 Flux Kontext、Imagen 4、Seedream、GPT Image 2、Midjourney 以及 100+ 款跨圖片、影片、音樂和大型語言模型的模型。無額外技能,無額外計費帳戶。