---
title: &quot;Używaj Veo 3 w Hermes Agent przez RunAPI — Przewodnik API wideo&quot;
url: &quot;https://runapi.ai/pl/hermes-veo-3.md&quot;
canonical: &quot;https://runapi.ai/pl/hermes-veo-3&quot;
locale: &quot;pl&quot;
model: &quot;veo-3&quot;
---

# Używaj Veo 3 w Hermes Agent.

Veo 3 to model generowania wideo Google DeepMind, który produkuje klipy 1080p do 8 sekund z natywnym audio — zsynchronizowane dialogi, dźwięki otoczenia i muzyka generowane wraz z wideo. Hermes Agent wywołuje go przez endpoint custom provider RunAPI, ponownie używając tego samego klucza API skonfigurowanego do czatu.

## API example

```bash
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;veo-3.1&quot;,
    &quot;prompt&quot;: &quot;A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.&quot;,
    &quot;duration_seconds&quot;: 8,
    &quot;aspect_ratio&quot;: &quot;16:9&quot;
  }&#39;

```

### Response

```json
{
  &quot;task_id&quot;: &quot;tsk_abc123&quot;,
  &quot;status&quot;: &quot;pending&quot;,
  &quot;model&quot;: &quot;veo-3.1&quot;
}

```

## How it works

1. **Skonfiguruj RunAPI** — Ustaw RUNAPI_API_KEY w środowisku, w którym działa Hermes Agent. Jeśli dodałeś już RunAPI jako provider custom:runapi do czatu, ten sam klucz i base_url obsługują generowanie wideo — nie są potrzebne osobne dane uwierzytelniające Google Cloud.
2. **Wywołaj Veo 3 text_to_video** — Wyślij POST na endpoint text_to_video z modelem ustawionym na veo-3.1. Dołącz prompt z opisami scen i wskazówkami audio (dialogi, dźwięki otoczenia). Ustaw duration_seconds na 4, 6 lub 8 i aspect_ratio na 16:9 lub 9:16. Hermes Agent kieruje żądania przez provider custom:runapi.
3. **Pobierz wynik** — Endpoint natychmiast zwraca task_id. Odpytuj endpoint statusu zadania, aż status zmieni się na completed, a następnie pobierz URL wyjściowego wideo. Wideo zawiera zsynchronizowane audio wygenerowane z promptu.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | Wymagane. veo-3.1 (standardowa jakość) lub veo-3.1-fast (niższy koszt, szybsze generowanie). |
| `prompt` | `string` | Wymagane. Opis sceny zawierający akcję wizualną, ruch kamery i wskazówki audio dotyczące dialogów lub dźwięków otoczenia. |
| `duration_seconds` | `integer` | Opcjonalne. Długość wideo w sekundach. Akceptowane wartości: 4, 6, 8. Domyślnie 8. |
| `aspect_ratio` | `string` | Opcjonalne. Proporcje wyjściowe. Akceptowane wartości: 16:9, 9:16, auto. |
| `input_mode` | `string` | Opcjonalne. Tryb generowania. text (domyślnie), first_and_last_frames (prowadzony klatkami kluczowymi) lub reference (referencja stylu). |
| `first_frame_image_url` | `string` | Opcjonalne. URL obrazu pierwszej klatki. Używane gdy input_mode to first_and_last_frames. |
| `last_frame_image_url` | `string` | Opcjonalne. URL obrazu ostatniej klatki. Używane gdy input_mode to first_and_last_frames. |
| `reference_image_urls` | `array` | Opcjonalne. URL-e obrazów referencyjnych stylu. Używane gdy input_mode to reference. |
| `callback_url` | `string` | Opcjonalne. URL webhooka, który otrzymuje POST po zakończeniu zadania. |

## FAQ

### Czy mogę używać Veo 3 w Hermes Agent?

Tak. Hermes Agent wywołuje endpoint RunAPI Veo 3 text_to_video przez provider custom:runapi. Ustaw model na veo-3.1 i wyślij żądanie z tym samym RUNAPI_API_KEY, którego używasz do czatu. Nie jest wymagane konto Google Cloud ani osobne dane uwierzytelniające do API wideo.

### Jak provider custom:runapi obsługuje asynchroniczne zadania wideo?

RunAPI natychmiast zwraca task_id przy pierwszym żądaniu POST. Twój przepływ pracy Hermes Agent odpytuje endpoint statusu zadania, aż status będzie completed, a następnie odczytuje URL wyjściowego wideo. Możesz też ustawić callback_url, aby otrzymać webhook zamiast odpytywać.

### Jaka jest różnica między veo-3.1 a veo-3.1-fast?

Oba produkują wideo z natywnym audio w rozdzielczości do 1080p. veo-3.1 używa pełnego potoku jakościowego i kosztuje więcej za generowanie. veo-3.1-fast poświęca trochę wierności wizualnej na rzecz niższego kosztu i szybszego czasu realizacji — odpowiedni do szkiców i iteracji.

### Czy mogę kontrolować ruch kamery i audio w Veo 3?

Tak. Opisz ruch kamery w prompcie (najazd, ujęcie śledzące, panorama lotnicza) i Veo 3 interpretuje go z symulacją uwzględniającą fizykę. Dla audio umieść dialogi w cudzysłowie i opisz dźwięki otoczenia — model natywnie generuje zsynchronizowane audio, bez osobnego TTS ani biblioteki dźwięków.

### Czy mogę przedłużyć lub przeskalować wideo Veo 3 po wygenerowaniu?

Tak. RunAPI udostępnia endpointy extend_video i upscale_video dla Veo 3. Przekaż source_task_id z oryginalnego generowania, aby przedłużyć klip, lub skaluj do rozdzielczości 1080p lub 4K. Oba są asynchroniczne i rozliczane osobno.


## Links

- [Przewodnik konfiguracji Hermes Agent →](https://runapi.ai/pl/hermes-agent)
- [Veo 3 na RunAPI →](https://runapi.ai/pl/models/veo-3)
- [Model catalog](https://runapi.ai/pl/models)
- [API docs](https://runapi.ai/pl/docs)
