It looks like you may prefer a different language. Switch anytime.

Google

Gemini Omni text to video

Video

이미지, 오디오, 캐릭터, 소스 클립 참조가 포함된 멀티모달 비디오 생성

모델 상태 데이터 부족
curl -X POST https://runapi.ai/api/v1/gemini_omni/text_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-omni-text-to-video",
  "prompt": "침착한 나레이터가 말하는 동안 재사용 가능한 캐릭터가 빗속을 걷는 1080p 네온 도시 추적 영상을 만들어 주세요."
}'
https://runapi.ai 1 endpoint

사용 가능한 버전 5개

Playground

Gemini Omni text to video 체험하기

원하는 모델을 선택하고 몇 초 만에 생성해보세요.

지금 모델 체험하기

원하는 모델을 선택하고 몇 초 만에 생성해보세요.

모델
Mode
예상 금액: $2.52 / video
생성

RunAPI로 생성하려면 로그인하세요.

사양

스펙

제공자 Google
모델 ID gemini-omni-text-to-video
모달리티 Video
작업 유형 Asynchronous
API 엔드포인트 /api/v1/gemini_omni/text_to_video
청구 단위 call
입력 매개변수 aspect_ratio, audio_ids, callback_url, character_ids, duration_seconds, first_frame_image_url, last_frame_image_url, model, output_resolution, prompt, reference_image_urls, seed, video_list
최대 기간 4s, 6s, 8s, 10s
최대 해상도 720p, 1080p, 4k
종횡비 16:9, 9:16
카탈로그 상태 운영 중
사용 방법

이 모델을 3단계로 사용하기

  1. 키 받기

    무료로 가입하고 대시보드에서 gemini-omni-text-to-video용 API 키를 만드세요.

  2. 요청 보내기

    /api/v1/gemini_omni/text_to_video로 gemini-omni-text-to-video 모델 ID와 매개변수를 포함한 POST 요청을 보내세요.

  3. 결과 받기

    작업을 폴링하거나 콜백을 따라 완료된 gemini-omni-text-to-video 결과를 가져오세요.

이 모델이 제공하는 것

출력 해상도

공개된 endpoint 스키마의 720p, 1080p, 4k를 지원합니다.

유연한 파라미터

aspect_ratio, audio_ids, character_ids, duration_seconds, first_frame_image_url 포함 11개 문서화된 파라미터를 설정할 수 있습니다.

endpoint 구성

1개의 공개 endpoint를 제공합니다: text_to_video.

webhook 전달

비동기 태스크는 완료 알림을 위한 콜백 URL을 수락합니다.

Gemini Omni text to video 요금

엔드포인트
해상도
기간
가격
text_to_video
사용할 수 없음
call
$0.63-$2.52 / video
  • Input mode: video · Duration seconds: any · Output resolution: 4k: $2.52 / video
  • Input mode: video · Duration seconds: any · Output resolution: 720p: $1.68 / video
  • Input mode: video · Duration seconds: any · Output resolution: 1080p: $1.68 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 4k: $1.47 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 720p: $0.63 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 1080p: $0.63 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 4k: $1.68 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 720p: $0.84 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 1080p: $0.84 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 4k: $1.89 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 720p: $1.05 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 1080p: $1.05 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 4k: $2.10 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 720p: $1.26 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 1080p: $1.26 / video
API 레퍼런스

엔드포인트 사양

엔드포인트
POST /api/v1/gemini_omni/text_to_video
모델 ID
gemini-omni-text-to-video
작업 유형
text_to_video
최대 시간
10초
해상도
720p, 1080p, 4k
화면 비율
16:9, 9:16
출력 형식
사용할 수 없음
평균 생성 시간
사용할 수 없음

요청 매개변수

seed

선택 사항 value

Deterministic generation seed.

prompt

필수 value

Video generation prompt.

audio_ids

선택 사항 value

Audio preset IDs returned by create-audio.

video_list

선택 사항 array

Source video clips; each clip consumes two reference units.

aspect_ratio

선택 사항 value

Output aspect ratio. (16:9, 9:16)

callback_url

선택 사항 value

Webhook URL for terminal Task delivery.

character_ids

선택 사항 value

Character IDs returned by create-character; dual-image characters consume two of the shared seven reference units.

duration_seconds

필수 value

Output duration in seconds. (4, 6, 8, 10)

output_resolution

선택 사항 value

Output resolution. (720p, 1080p, 4k)

last_frame_image_url

선택 사항 string

Public last-frame image URL for supported models.

reference_image_urls

선택 사항 value

Public reference image URLs; images, video clips, and characters share a seven-unit reference limit.

first_frame_image_url

선택 사항 string

Public first-frame image URL for supported models.

사용 사례

제품 영상

prompt에서 바로 쓸 수 있는 짧은 클립을 생성합니다.

크리에이티브 반복

여러 방향을 빠르게 테스트합니다.

Skill 워크플로

개발 도구에 모델 컨텍스트를 제공해 영상 asset을 만들 수 있습니다.

FAQ

Gemini Omni text to video 자주 묻는 질문

gemini-omni-text-to-video는 어떻게 선택하나요?

quickstart에 표시된 모델 ID를 전달하세요.

가격은 사용량 기반인가요?

네. 호출 또는 단위 기준으로 측정됩니다.

팀과 함께 구축하고 계신가요?

엔터프라이즈 설정, 통합, 기술 문의를 도와드립니다.

문의하기