---
title: &quot;Hermes Agent에서 RunAPI로 Veo 3 사용하기 — 영상 API 가이드&quot;
url: &quot;https://runapi.ai/ko/hermes-veo-3.md&quot;
canonical: &quot;https://runapi.ai/ko/hermes-veo-3&quot;
locale: &quot;ko&quot;
model: &quot;veo-3&quot;
---

# Hermes Agent에서 Veo 3를 사용하세요.

Veo 3는 Google DeepMind의 영상 생성 모델로, 네이티브 오디오(동기화된 대화, 주변 소리, 음악)와 함께 최대 8초의 1080p 클립을 생성합니다. Hermes Agent는 채팅에서 설정한 것과 동일한 API key를 재사용하여 RunAPI 커스텀 프로바이더 엔드포인트를 통해 호출합니다.

## API example

```bash
curl -X POST https://runapi.ai/api/v1/veo_3_1/text_to_video \
  -H &quot;Authorization: Bearer $RUNAPI_API_KEY&quot; \
  -H &quot;Content-Type: application/json&quot; \
  -d &#39;{
    &quot;model&quot;: &quot;veo-3.1&quot;,
    &quot;prompt&quot;: &quot;A woman walks through a bustling Tokyo street at night, neon signs reflecting on wet pavement. She speaks into her phone: I just arrived. Ambient city noise, distant car horns, light rain.&quot;,
    &quot;duration_seconds&quot;: 8,
    &quot;aspect_ratio&quot;: &quot;16:9&quot;
  }&#39;

```

### Response

```json
{
  &quot;task_id&quot;: &quot;tsk_abc123&quot;,
  &quot;status&quot;: &quot;pending&quot;,
  &quot;model&quot;: &quot;veo-3.1&quot;
}

```

## How it works

1. **RunAPI 설정** — Hermes Agent가 실행되는 환경에 RUNAPI_API_KEY를 설정하세요. 채팅용 custom:runapi 프로바이더로 RunAPI를 이미 추가했다면, 동일한 key와 base_url이 영상 생성을 처리합니다 — 별도의 Google Cloud 자격증명이 필요 없습니다.
2. **Veo 3 text_to_video 호출** — model을 veo-3.1로 설정하여 text_to_video 엔드포인트에 POST 요청을 보내세요. 장면 설명과 오디오 큐(대화, 주변 소리)가 포함된 프롬프트를 포함하세요. duration_seconds를 4, 6, 또는 8로 설정하고 aspect_ratio를 16:9 또는 9:16으로 설정하세요. Hermes Agent는 custom:runapi 프로바이더를 통해 라우팅합니다.
3. **결과 가져오기** — 엔드포인트는 즉시 task_id를 반환합니다. 상태가 completed로 변경될 때까지 작업 상태 엔드포인트를 폴링한 후 출력 영상 URL을 가져오세요. 영상에는 프롬프트에서 생성된 동기화된 오디오가 포함됩니다.

## Parameters

| Parameter | Type | Description |
|-----------|------|-------------|
| `model` | `string` | 필수. veo-3.1 (표준 품질) 또는 veo-3.1-fast (저렴한 비용, 빠른 생성). |
| `prompt` | `string` | 필수. 시각적 액션, 카메라 움직임, 대화 또는 주변 소리를 위한 오디오 큐가 포함된 장면 설명. |
| `duration_seconds` | `integer` | 선택 사항. 영상 길이(초). 허용 값: 4, 6, 8. 기본값은 8. |
| `aspect_ratio` | `string` | 선택 사항. 출력 화면 비율. 허용 값: 16:9, 9:16, auto. |
| `input_mode` | `string` | 선택 사항. 생성 모드. text (기본값), first_and_last_frames (키프레임 가이드), 또는 reference (스타일 레퍼런스). |
| `first_frame_image_url` | `string` | 선택 사항. 첫 번째 프레임 이미지의 URL. input_mode가 first_and_last_frames일 때 사용합니다. |
| `last_frame_image_url` | `string` | 선택 사항. 마지막 프레임 이미지의 URL. input_mode가 first_and_last_frames일 때 사용합니다. |
| `reference_image_urls` | `array` | 선택 사항. 스타일 레퍼런스 이미지의 URL. input_mode가 reference일 때 사용합니다. |
| `callback_url` | `string` | 선택 사항. 작업 완료 시 POST를 수신하는 웹훅 URL. |

## FAQ

### Hermes Agent에서 Veo 3를 사용할 수 있나요?

네. Hermes Agent는 custom:runapi 프로바이더를 통해 RunAPI Veo 3 text_to_video 엔드포인트를 호출합니다. model을 veo-3.1로 설정하고 채팅에 사용하는 것과 동일한 RUNAPI_API_KEY로 요청을 보내세요. Google Cloud 계정이나 별도의 영상 API 자격증명이 필요 없습니다.

### custom:runapi 프로바이더는 비동기 영상 작업을 어떻게 처리하나요?

RunAPI는 초기 POST 시 즉시 task_id를 반환합니다. Hermes Agent 워크플로우는 상태가 completed가 될 때까지 작업 상태 엔드포인트를 폴링한 후 출력 영상 URL을 읽습니다. 폴링 대신 웹훅을 받으려면 callback_url을 설정할 수도 있습니다.

### veo-3.1과 veo-3.1-fast의 차이점은 무엇인가요?

두 모델 모두 최대 1080p의 네이티브 오디오가 포함된 영상을 생성합니다. veo-3.1은 전체 품질 파이프라인을 사용하며 생성당 비용이 더 높습니다. veo-3.1-fast는 일부 시각적 품질을 낮추는 대신 비용이 저렴하고 처리가 더 빠릅니다 — 초안 작업과 반복 작업에 적합합니다.

### Veo 3에서 카메라 움직임과 오디오를 제어할 수 있나요?

네. 프롬프트에 카메라 모션(달리인, 트래킹샷, 에어리얼 팬)을 설명하면 Veo 3가 물리 기반 시뮬레이션으로 해석합니다. 오디오의 경우, 대화를 따옴표로 포함하고 주변 소리를 설명하면 — 별도의 TTS나 사운드 라이브러리 없이 네이티브로 동기화된 오디오가 생성됩니다.

### 생성 후 Veo 3 영상을 확장하거나 업스케일할 수 있나요?

네. RunAPI는 Veo 3용 extend_video와 upscale_video 엔드포인트를 제공합니다. 클립을 확장하려면 원본 생성의 source_task_id를 전달하거나, 1080p 또는 4K 해상도로 업스케일하세요. 두 작업 모두 비동기로 처리되며 별도로 청구됩니다.


## Links

- [Hermes Agent 설정 가이드 →](https://runapi.ai/ko/hermes-agent)
- [RunAPI의 Veo 3 →](https://runapi.ai/ko/models/veo-3)
- [Model catalog](https://runapi.ai/ko/models)
- [API docs](https://runapi.ai/ko/docs)
