Video · Google

Gemini Omni API

Acesso à API do Gemini Omni para recursos de voz, personagem e vídeo multimodal em workflows de mídia para agentes.

Operacional · 4 variants · a partir de $0.0000
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
VISÃO GERAL

Gemini Omni cria recursos de voz reutilizáveis, recursos de personagem reutilizáveis e vídeos multimodais que podem combinar prompts, imagens de referência, IDs de áudio, IDs de personagem e um clipe de vídeo-fonte.

  • Variantes para diferentes metas de qualidade e latência
  • API key unificada
  • O model skill inclui documentação, schemas e notas de setup
  • Gerações com falha não são cobradas
VARIANTES

Variantes

Variant Billing Pricing
gemini-omni-audio call $0.0000 Ver →
gemini-omni-character call $0.0000 Ver →
gemini-omni-flash-preview call $0.460 Ver →
gemini-omni-text-to-video call $2.52 Ver →
MODELS

Instale o skill Gemini Omni para desenvolver apps

Carregue documentação do modelo, schemas, notas de preço e etapas de setup no seu workspace de código.

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini Omni skill for this app:

1. Add runapi-ai/gemini-omni with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
COMO FUNCIONA

Como construir com este model skill

01

Escolha o modelo

Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.

02

Autentique uma vez

Use sua chave RunAPI para todos os modelos compatíveis.

03

Instale o skill

Adicione o model skill ao workspace de código antes de implementar a funcionalidade.

04

Receba a saída

Consulte por task ID ou trate o callback quando a geração terminar.

CONTEXTO

Onde Gemini Omni se encaixa

Gemini Omni pertence ao catálogo Google no RunAPI e compartilha o mesmo pacote SDK, namespace CLI e superfícies de cobrança em variants de áudio, personagem e vídeo.

Provider
Google
Modality
Video
POR QUE RUNAPI

Por que usar Gemini Omni pela RunAPI

Uma API key

Use as mesmas credenciais entre modelos e provedores.

Pronto para skills

O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.

Cobrança previsível

O preço por uso fica visível antes da chamada.

FAQ

Perguntas frequentes

O que o Gemini Omni pode criar?

Pode criar recursos de áudio reutilizáveis, recursos de personagem reutilizáveis e vídeos multimodais que combinam prompts com referências de imagem, áudio, personagem ou vídeo-fonte.

Quando devo criar um recurso de personagem?

Crie um recurso de personagem quando múltiplos vídeos precisam da mesma identidade visual; passe o ID do personagem retornado em requisições de vídeo que devem reutilizar esse sujeito.

Como funcionam os recursos de áudio?

Recursos de áudio capturam uma escolha de voz predefinida e podem ser referenciados por requisições de vídeo que precisam de narração ou diálogo com seleção de voz consistente.

O que afeta o preço do vídeo Gemini Omni?

O preço do vídeo depende do modo de requisição, duração, resolução e se a mídia-fonte muda o comprimento efetivo do clipe cobrado.

Uma requisição de vídeo pode combinar vários tipos de referência?

Sim. O vídeo Gemini Omni pode combinar texto de prompt com imagens de referência, IDs de áudio, IDs de personagem e um vídeo-fonte, dentro dos limites de referência documentados.

Como chamo este modelo?

Instale o model skill e siga as notas de setup com sua chave RunAPI.

Gerações com falha custam dinheiro?

Gerações com falha não são cobradas

Posso chamar a partir da minha aplicação?

Sim. Instale o model skill no workspace de código e use durante a implementação da funcionalidade.

COMEÇAR

Comece a construir com Gemini Omni.