It looks like you may prefer a different language. Switch anytime.

Google

Gemini Omni text to video

Video

支持提示词、图片、音频、角色和源片段参考的多模态视频

模型健康状态 数据不足
curl -X POST https://runapi.ai/api/v1/gemini_omni/text_to_video \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "gemini-omni-text-to-video",
  "prompt": "生成一段 1080p 霓虹城市跟拍视频:可复用角色在雨中前行,并配合稳定旁白。"
}'
https://runapi.ai 1 endpoint
模型体验

体验 Gemini Omni text to video

选择任意模型,几秒内开始生成。

现在试用模型

选择任意模型,几秒内开始生成。

模型
Mode
预计: $2.52 / video
生成

登录后即可使用 RunAPI 生成。

规格

技术细节

提供商 Google
模型 ID gemini-omni-text-to-video
模态 Video
任务类型 Asynchronous
API 端点 /api/v1/gemini_omni/text_to_video
计费单位 call
输入参数 aspect_ratio, audio_ids, callback_url, character_ids, duration_seconds, first_frame_image_url, last_frame_image_url, model, output_resolution, prompt, reference_image_urls, seed, video_list
最大时长 4s, 6s, 8s, 10s
最大分辨率 720p, 1080p, 4k
宽高比 16:9, 9:16
目录状态 运行中
工作原理

3 步使用此模型

  1. 获取 API 密钥

    免费注册后,在控制台创建用于 gemini-omni-text-to-video 的 API 密钥。

  2. 发送请求

    向 /api/v1/gemini_omni/text_to_video 发送 POST 请求,并传入 gemini-omni-text-to-video 模型 ID 和参数。

  3. 获取结果

    轮询任务或按照回调获取已完成的 gemini-omni-text-to-video 结果。

该模型的核心能力

输出分辨率

根据已发布的 endpoint 规格,支持 720p, 1080p, 4k。

灵活的参数配置

可配置文档中列出的 11 个参数,包括 aspect_ratio, audio_ids, character_ids, duration_seconds, first_frame_image_url。

Endpoint 覆盖

提供 1 个公开 endpoint:text_to_video。

Webhook 推送

异步任务支持回调 URL,任务完成时发送通知。

Gemini Omni text to video 定价

端点
分辨率
时长
价格
text_to_video
暂不可用
call
$0.63-$2.52 / video
  • Input mode: video · Duration seconds: any · Output resolution: 4k: $2.52 / video
  • Input mode: video · Duration seconds: any · Output resolution: 720p: $1.68 / video
  • Input mode: video · Duration seconds: any · Output resolution: 1080p: $1.68 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 4k: $1.47 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 720p: $0.63 / video
  • Input mode: generated · Duration seconds: 4 · Output resolution: 1080p: $0.63 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 4k: $1.68 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 720p: $0.84 / video
  • Input mode: generated · Duration seconds: 6 · Output resolution: 1080p: $0.84 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 4k: $1.89 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 720p: $1.05 / video
  • Input mode: generated · Duration seconds: 8 · Output resolution: 1080p: $1.05 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 4k: $2.10 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 720p: $1.26 / video
  • Input mode: generated · Duration seconds: 10 · Output resolution: 1080p: $1.26 / video
API 参考

端点规格

端点
POST /api/v1/gemini_omni/text_to_video
模型 ID
gemini-omni-text-to-video
任务类型
text_to_video
最大时长
10 秒
分辨率
720p, 1080p, 4k
宽高比
16:9, 9:16
输出格式
暂无数据
平均生成时间
暂无数据

请求参数

seed

可选 value

Deterministic generation seed.

prompt

必填 value

Video generation prompt.

audio_ids

可选 value

Audio preset IDs returned by create-audio.

video_list

可选 array

Source video clips; each clip consumes two reference units.

aspect_ratio

可选 value

Output aspect ratio. (16:9, 9:16)

callback_url

可选 value

Webhook URL for terminal Task delivery.

character_ids

可选 value

Character IDs returned by create-character; dual-image characters consume two of the shared seven reference units.

duration_seconds

必填 value

Output duration in seconds. (4, 6, 8, 10)

output_resolution

可选 value

Output resolution. (720p, 1080p, 4k)

last_frame_image_url

可选 string

Public last-frame image URL for supported models.

reference_image_urls

可选 value

Public reference image URLs; images, video clips, and characters share a seven-unit reference limit.

first_frame_image_url

可选 string

Public first-frame image URL for supported models.

应用场景

广告与社交内容

从文字简报生成产品发布短视频和广告片段,将制作周期从数周缩短到数小时。

在线教育

将课程脚本批量转换为动画讲解视频,无需摄像设备和拍摄团队。

创作者工作流

直接从提示词生成社交平台短视频内容。

常见问题

Gemini Omni text to video 常见问题

如何选择 gemini-omni-text-to-video?

传入 quickstart 中显示的模型 ID。

该变体的限流?

Key 级限流随使用层级伸缩。当前限制见定价页。

能切到其它变体吗?

可以——变体只是参数,改 model 字段即可。

支持流式吗?

模型支持流式时,RunAPI 端到端流式。

质量问题在哪里报?

在公共 GitHub 仓库提 issue 或邮件联系 support。

需要团队接入支持?

我们可以协助团队接入、完成系统集成并解答技术问题。

联系我们