It looks like you may prefer a different language. Switch anytime.

Video Google

Gemini Omni API

通过 RunAPI 使用 Gemini Omni API,配套 model skill、统一认证和按需计费。

runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "生成一段 1080p 霓虹城市跟拍视频:可复用角色在雨中前行,并配合稳定旁白。",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "生成一段 1080p 霓虹城市跟拍视频:可复用角色在雨中前行,并配合稳定旁白。",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => '生成一段 1080p 霓虹城市跟拍视频:可复用角色在雨中前行,并配合稳定旁白。',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "生成一段 1080p 霓虹城市跟拍视频:可复用角色在雨中前行,并配合稳定旁白。",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
概览

关于 Gemini Omni

Gemini Omni 可创建可复用声音资源、可复用角色资源,以及可组合提示词、参考图、音频 ID、角色 ID 和源视频片段的多模态视频。

提供方
Google
模态
Video

对比全部 API 变体

变体 计费方式 价格
gemini-omni-audio call $0.0000 查看 →
gemini-omni-character call $0.0000 查看 →
gemini-omni-flash-1-1 call $2.52 查看 →
gemini-omni-flash-preview call $0.460 查看 →
gemini-omni-text-to-video call $2.52 查看 →
定价

Gemini Omni 定价

Endpoint 分辨率 时长 价格
create_audio Free / track

当前价格适用于 gemini-omni-audio。其他变体保留各自的 endpoint 定价。

Agent 集成

通过 Agent 运行 Gemini Omni

工作流程

开始使用 Gemini Omni

  1. 选择模型

    根据输出类型、质量要求和延迟目标选择模型与变体。

  2. 配置

    设置 RunAPI key,并在代码工作区安装对应 model skill。

  3. 调用

    按 skill 里的说明,把模型能力接入到你的应用里。

  4. 接收

    按 task ID 轮询、在支持时使用流式,或处理 webhook 回调。

背景

Gemini Omni API 是什么?

Gemini Omni 属于 RunAPI 的 Google catalog,音频、角色和视频变体共用同一个 SDK 包、CLI 命名空间和计费页面。

提供方
Google
查看全部 →
模态
Video
浏览模型 →

为什么用 RunAPI 调用 Gemini Omni API

统一认证,接入所有提供方

一把 RunAPI key 解锁整个模型目录。无需为每家提供方单独建账户。

统一的定价与账单

USD 按次定价,按月结算。失败的生成不计费。

Schema 优先的 SDK

Typed schema 和接入说明已打包进 model skill,让实现从正确契约开始。

Gemini Omni 常见问题

Gemini Omni 可以创建什么?

它可以创建可复用声音资源、可复用角色资源,以及组合提示词、图片、音频、角色或源视频参考的多模态视频。

什么时候应该创建角色资源?

当多个视频需要保持同一个视觉身份时,先创建角色资源,再把返回的 character ID 传入后续视频请求。

声音资源如何使用?

声音资源记录预设声音选择,可被需要稳定旁白或对白音色的视频请求引用。

Gemini Omni 视频价格由什么决定?

视频价格取决于请求模式、时长、分辨率,以及源媒体是否改变实际计费片段长度。

一个视频请求可以混合多种参考吗?

可以。Gemini Omni 视频可在文档限制内组合提示词、参考图、audio ID、character ID 和源视频。

应该从哪个变体开始?

选满足质量要求的最便宜变体。多数团队从 fast 起步,生产时升级到 pro。

相似模型

如果喜欢 Gemini Omni API,也可以试试这些

立即体验 Gemini Omni API。