OPENCLAW IMAGE GENERATION

Dodaj Flux, Imagen 4, GPT Image i Midjourney do OpenClaw — bez dodatkowych umiejętności

Ten sam klucz API, którego używa Twój agent OpenClaw do czatu, wywołuje też Flux Kontext, Imagen 4, Seedream, GPT Image 2 i Midjourney — ponad 10 modeli obrazów, bez dodatkowej umiejętności do zainstalowania. Korzystaj z tekstu na obraz, edycji obrazów, obrazu na wideo i odkrywania promptów w jednym przepływie zadań RunAPI.

Zaktualizowano June 11, 2026 RunAPI Editorial Team
Prompt
Install the RunAPI CLI and generate an image in this OpenClaw workspace.

- Run: npx runapi
- It will prompt you for an API key. Sign up at https://runapi.ai if you don't have one.
- Then run: npx runapi run text_to_image --model flux-kontext-pro --prompt "A red cube on a white table"
- Confirm the image URL appears in the output.

Available image models: flux-kontext-pro, imagen-4, seedream-5-lite-text-to-image, gpt-image-2-text-to-image, midjourney-v8.1.
Copy prompt → paste in OpenClaw flux-kontext-pro
IMAGE MODELS

Pięć rodzin modeli obrazów z Midjourney, jeden klucz API, zero dodatkowych umiejętności

Każdy model obsługuje inną potrzebę produkcyjną. Flux Kontext obsługuje edycje zgodne z marką i renderowanie tekstu. Imagen 4 generuje realistyczne wyniki z silnym przyleganiem do promptu. Seedream 5 Lite działa szybko i tanio w wysokonakładowych workflow. GPT Image 2 doskonale sprawdza się przy edycjach zgodnych z instrukcjami i compositingu. Midjourney dodaje dopracowane generowanie obrazów AI, kreatywną edycję, obraz na wideo, odkrywanie promptów i seed lookup. Wszystkie działają w tym samym cyklu życia zadań RunAPI, z którego Twój agent OpenClaw już korzysta.

Flux Kontext Pro

Renderowanie tekstu, spójność marki i edycja w kontekście. Świetny do materiałów marketingowych, gdzie ważne są nakładki tekstowe i odwołania do stylu. Od 2,5 centa za obraz.

Imagen 4

Fotorealistyczne generowanie z wysoką wiernością promptu. Tiers Standard, Fast i Ultra pozwalają wymieniać prędkość na szczegółowość. Od 2 centów za obraz.

Seedream 5 Lite

Szybkie, tanie generowanie w workflow masowych. Obsługuje tekst na obraz i obraz na obraz w cenie 2,75 centa za wywołanie — odpowiedni do prototypowania i iteracji.

GPT Image 2

Edycja i compositing sterowane instrukcjami. Najlepszy do zadań, gdzie prompt opisuje transformację — usuwanie tła, przeniesienie stylu, umieszczenie obiektów.

Midjourney

Dopracowane generowanie obrazów AI do koncepcji kampanii, filmowych wizualizacji, wariantów obrazów, testów obraz na wideo, odkrywania promptów i seed lookup przez RunAPI.

HOW TO USE

Generuj obrazy w OpenClaw przez RunAPI

1

Skonfiguruj RunAPI w OpenClaw

Jeśli nie skonfigurowałeś jeszcze RunAPI w OpenClaw, skorzystaj z przewodnika konfiguracji OpenClaw. Dodaj dostawcę RunAPI z baseUrl https://runapi.ai/v1 i zmienną środowiskową RUNAPI_API_KEY.

2

Wyślij żądanie generowania obrazu

Użyj endpointu zadania RunAPI z kodu agenta lub bezpośredniego wywołania HTTP. Ustaw pole model na slug modelu obrazu, np. flux-kontext-pro, imagen-4 lub gpt-image-2. Treść żądania jest zgodna z tym samym wzorcem JSON co wywołania LLM.

3

Odpytuj i pobieraj wyniki

Zadania obrazu zwracają ID zadania. Odpytuj endpoint statusu zadania lub użyj callbacku webhook. Po zakończeniu zadania odpowiedź zawiera URL wygenerowanego obrazu. Zestawy SDK i CLI RunAPI obsługują odpytywanie automatycznie.

MODEL COMPARISON

Flux Kontext vs Imagen 4 vs Seedream vs GPT Image 2 vs Midjourney

Punkt porównania Flux Kontext Pro Imagen 4 Seedream 5 Lite GPT Image 2 Midjourney
Najlepsze domyślne zastosowanie Edycje zgodne z marką, nakładki tekstowe, umieszczanie logo i modyfikacja obrazu w kontekście z odwołaniami do stylu. Fotorealistyczne generowanie ze szczegółowych promptów, fotografia produktów i wysokowierność pojedynczego obrazu. Szybkie masowe generowanie i prototypowanie, gdy prędkość i koszt mają większe znaczenie niż maksymalna szczegółowość. Compositing sterowany instrukcjami, zmiany tła, przenoszenie stylu i wieloetapowa edycja obrazów. Kreatywny art direction, dopracowana sztuka AI, filmowe kompozycje i tekst na obraz, gdy styl wizualny jest ważniejszy niż precyzja edycji.
Typy wejściowe Prompt tekstowy, obraz referencyjny do edycji w kontekście, odwołania do stylu. Prompt tekstowy. Tiery jakości Fast, Standard i Ultra. Prompt tekstowy, obraz na obraz z URL źródłowego obrazu. Prompt tekstowy do generowania, tekst plus URL obrazu do edycji i compositingu. Prompt tekstowy do generowania; URL obrazu źródłowego do edycji, obrazu na wideo, odkrywania promptów i seed lookup.
Jakość wyjściowa Wysoka szczegółowość z dokładnym renderowaniem tekstu. Silny w zachowaniu elementów marki w edycjach. Fotorealistyczny z silnym przyleganiem do promptu. Tier Ultra dla maksymalnej szczegółowości. Dobra jakość przy dużej prędkości. Odpowiedni do wersji roboczych, miniatur i pętli iteracyjnych. Wysoka jakość z silnym przestrzeganiem instrukcji. Najlepszy do edycji wymagających rozumienia relacji przestrzennych. Mocno stylizowane i dopracowane wyniki wizualne. Dobre do filmowego concept artu, wizualizacji kampanii i moodboardów.
Prędkość Standardowa prędkość generowania. Odpowiedni do workflow interaktywnych i wsadowych. Tier Fast dostępny dla niemal natychmiastowych wyników. Tiery Standard i Ultra wymieniają prędkość na jakość. Najszybszy wybór do wersji roboczych i prototypów w potokach wysokonakładowych. Standardowa prędkość. Nieco wolniejszy przy złożonych edycjach wieloetapowych. Asynchroniczny workflow zadania. Odpowiedni dla potoków agenta, które mogą odpytywać status lub używać callbacków podczas generowania mediów.
Koszt za obraz Od 2,5 centa (Pro). Tier Max za 5 centów dla wyższej wierności. Od 2 centów (Fast) do 6 centów (Ultra). Standard za 4 centy. 2,75 centa za obraz zarówno dla tekst na obraz, jak i obraz na obraz. Od 3 centów. Wycena oparta na rozdzielczości. Przed użyciem produkcyjnym sprawdź aktualną cenę zadania dla danego endpointu na live stronie modelu Midjourney.
Najlepszy dla agentów OpenClaw Gdy workflow agenta obejmuje zasoby marki, obrazy marketingowe lub wizualizacje z dużą ilością tekstu. Gdy agent potrzebuje fotorealistycznych wyników z opisu w języku naturalnym. Gdy agent generuje wiele obrazów na sesję, a koszt lub prędkość jest priorytetem. Gdy agent edytuje istniejące obrazy na podstawie instrukcji użytkownika. Gdy agent potrzebuje dopracowanego kierunku kreatywnego, wariantów obrazu lub obrazu na wideo z wybranej klatki.
USE CASES

Generowanie zasobów marketingowych

Agenci OpenClaw mogą generować zdjęcia produktów, wizualizacje do mediów społecznościowych i kreacje reklamowe, wywołując Flux Kontext lub Imagen 4. Agent tworzy prompt na podstawie kontekstu rozmowy i pobiera gotowy obraz w tej samej sesji.

Poznaj Flux Kontext

Zautomatyzowana edycja obrazów

Przekaż URL istniejącego obrazu do GPT Image 2 lub Seedream wraz z instrukcją edycji. Agent może usuwać tła, zmieniać style lub scalać elementy bez ręcznych narzędzi graficznych.

Poznaj GPT Image 2

Masowa iteracja obrazów

Agenci OpenClaw prototypujący komponenty UI, reklamy społecznościowe lub warianty produktów korzystają z prędkości i niskiego kosztu Seedream 5 Lite. Generuj 20 wersji roboczych na sesję, a następnie przekieruj wybrany prompt do Flux Kontext Pro jako wynik końcowy.

Poznaj Seedream

Kierunek kreatywny z Midjourney

Użyj Midjourney, gdy agent potrzebuje dopracowanej sztuki AI, filmowych wizualizacji koncepcyjnych, wariantów obrazów, odkrywania promptów lub testów obrazu na wideo z wybranej klatki.

Poznaj Midjourney
API EXAMPLES

Generuj obrazy przez endpoint zadania RunAPI

Używaj tego samego klucza RunAPI i cyklu życia zadania dla każdego modelu obrazu. Zmień slug modelu i endpoint, aby przełączać się między Flux, Imagen, Seedream, GPT Image i Midjourney. Odpowiedź zwraca ID zadania do odpytywania, więc agent zachowuje jeden workflow dla wersji roboczych, edycji, wariantów i zadań obraz na wideo.

{
  "model": "flux-kontext-pro",
  "prompt": "A futuristic city skyline at sunset, photorealistic, 8K detail"
}
POST /api/v1/task/text_to_image async task
{
  "model": "imagen-4",
  "prompt": "A golden retriever wearing astronaut suit, studio lighting"
}
POST /api/v1/task/text_to_image async task
{
  "model": "gpt-image-2",
  "prompt": "Remove the background and add a tropical beach",
  "image_url": "https://example.com/photo.jpg"
}
POST /api/v1/task/edit_image async task
{
  "model": "midjourney-v8.1",
  "prompt": "A cinematic product photo of a translucent AI compass on a black desk, dramatic lighting",
  "aspect_ratio": "16:9"
}
POST /api/v1/midjourney/text_to_image async task
BEYOND IMAGES

Ten sam klucz API generuje wideo i muzykę

Generowanie wideo

Generuj klipy wideo z Kling 3.0, Veo 3 i Seedance 2.0. Endpointy tekst na wideo i obraz na wideo korzystają z tego samego asynchronicznego cyklu życia zadań co generowanie obrazów.

Porównaj API wideo

Tworzenie muzyki

Twórz ścieżki muzyczne z Suno v4, v4.5 i v5. Opisz gatunek, nastrój i słowa w prompcie. Agent otrzymuje URL audio po zakończeniu zadania.

Poznaj modele Suno
PRICING

Koszt generowania obrazów zaczyna się od 2 centów za obraz

RunAPI stosuje płatność za użycie bez miesięcznej subskrypcji. Każdy model obrazu ma koszt zadania zależny od tieru modelu, endpointu i ustawień wyjścia. Flux Kontext, Imagen 4, Seedream, GPT Image 2 i Midjourney publikują aktualne stawki na stronie cenowej i stronach modeli; przed użyciem produkcyjnym sprawdź aktywną cenę endpointu.

Metodologia wyceny

Ceny na tej stronie odzwierciedlają stawki RunAPI z płatnością za użycie w momencie publikacji. RunAPI ustala ceny na podstawie kosztu obliczeniowego plus przejrzysta marża. Rzeczywisty koszt za obraz może się różnić w zależności od rozdzielczości, tieru jakości lub opcji specyficznych dla modelu. Zawsze potwierdź bieżące ceny na aktualnej stronie cenowej przed wdrożeniem produkcyjnym.

FAQ

FAQ dotyczące generowania obrazów w OpenClaw

Jak wybrać między Flux Kontext a Imagen 4 dla mojego workflow w OpenClaw?

Użyj Flux Kontext Pro, gdy agent tworzy zasoby marki, obrazy marketingowe lub wizualizacje zawierające tekst — zachowuje styl i dokładnie renderuje tekst. Użyj Imagen 4, gdy agent potrzebuje fotorealistycznych wyników z opisu w języku naturalnym. Oba są dostępne z tego samego endpointu RunAPI.

Które modele obrazów działają z OpenClaw przez RunAPI?

Flux Kontext Pro i Max, Imagen 4 w tierach Fast, Standard i Ultra, Seedream 5 Lite, GPT Image 2, Midjourney, Nano Banana i kilka więcej. Ponad 10 modeli obrazów jest dostępnych przez ten sam klucz API. Pełna lista jest dostępna na stronie cenowej RunAPI i aktualizuje się automatycznie w miarę dodawania nowych modeli.

Ile kosztuje generowanie obrazów przez RunAPI?

Ceny zaczynają się od 2 centów za obraz w Imagen 4 Fast. Flux Kontext Pro kosztuje 2,5 centa, Seedream 5 Lite kosztuje 2,75 centa, a GPT Image 2 zaczyna od 3 centów. Ceny Midjourney różnią się zależnie od endpointu, dlatego przed użyciem produkcyjnym sprawdź live stronę modelu Midjourney. Wszystkie ceny są naliczane za użycie bez miesięcznego minimum.

Czy RunAPI nalicza opłaty oddzielnie za wywołania obrazów i LLM?

Nie. RunAPI używa jednego salda kredytów dla wszystkich modalności. Wywołania obrazów, wideo, muzyki i LLM czerpią z tego samego salda konta. Nie ma subskrypcji ani minimalnych wydatków per modalność. Możesz monitorować wydatki per model w panelu RunAPI.

Jak przełączać się między modelami obrazów w moim workflow OpenClaw?

Zmień pole model w treści żądania. Endpoint, klucz API, cykl życia zadania i wzorzec odpytywania pozostają takie same. Twój agent może kierować do różnych modeli w zależności od zadania bez zmiany kodu integracji. Na przykład kieruj wersje robocze do seedream-5-lite-text-to-image, a eksporty końcowe do flux-kontext-pro.

Czy RunAPI jest tańszy niż fal.ai lub Replicate do generowania obrazów?

Generowanie obrazów w RunAPI zaczyna się od 2 centów za obraz w porównaniu do fal.ai za około 4 centy i Replicate za około 3,5 centa za obraz. Ceny różnią się w zależności od modelu i rozdzielczości. Sprawdź stronę cenową RunAPI, aby zobaczyć aktualne stawki per model.

START GENERATING

Dodaj generowanie obrazów do OpenClaw w kilka minut.

Jeden klucz RunAPI daje Twojemu agentowi OpenClaw dostęp do Flux Kontext, Imagen 4, Seedream, GPT Image 2, Midjourney i ponad 100 innych modeli w zakresie obrazów, wideo, muzyki i LLM. Bez dodatkowych umiejętności, bez dodatkowych kont rozliczeniowych.