Gemini Omni API
Acesso à API do Gemini Omni para recursos de voz, personagem e vídeo multimodal em workflows de mídia para agentes.
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"audio_id": "achernar",
"name": "Acher Narrator",
"voice_description": "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
"example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";
const client = new GeminiOmniClient();
const result = await client.createAudio.run({
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
example_dialogue: "Hello, I am achernar",
});
<?php
require __DIR__ . "/vendor/autoload.php";
use RunApi\GeminiOmni\GeminiOmniClient;
$client = new GeminiOmniClient();
$result = $client->createAudio->run([
'audio_id' => 'achernar',
'name' => 'Acher Narrator',
'voice_description' => 'Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.',
'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"
client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "Crie um tracking shot de cidade neon em 1080p com um personagem reutilizável caminhando sob chuva enquanto um narrador calmo fala.",
example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Gemini Omni cria recursos de voz reutilizáveis, recursos de personagem reutilizáveis e vídeos multimodais que podem combinar prompts, imagens de referência, IDs de áudio, IDs de personagem e um clipe de vídeo-fonte.
- Variantes para diferentes metas de qualidade e latência
- API key unificada
- O model skill inclui documentação, schemas e notas de setup
- Gerações com falha não são cobradas
Variantes
Instale o skill Gemini Omni para desenvolver apps
Carregue documentação do modelo, schemas, notas de preço e etapas de setup no seu workspace de código.
# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Install the Gemini Omni skill for this app: 1. Add runapi-ai/gemini-omni with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Como construir com este model skill
Escolha o modelo
Selecione o modelo e a variante que combinam com seu tipo de saída, meta de qualidade e latência.
Autentique uma vez
Use sua chave RunAPI para todos os modelos compatíveis.
Instale o skill
Adicione o model skill ao workspace de código antes de implementar a funcionalidade.
Receba a saída
Consulte por task ID ou trate o callback quando a geração terminar.
Onde Gemini Omni se encaixa
Gemini Omni pertence ao catálogo Google no RunAPI e compartilha o mesmo pacote SDK, namespace CLI e superfícies de cobrança em variants de áudio, personagem e vídeo.
Por que usar Gemini Omni pela RunAPI
Uma API key
Use as mesmas credenciais entre modelos e provedores.
Pronto para skills
O model skill inclui schemas, notas de setup, contexto de preços e IDs de modelo.
Cobrança previsível
O preço por uso fica visível antes da chamada.
Perguntas frequentes
O que o Gemini Omni pode criar?
Pode criar recursos de áudio reutilizáveis, recursos de personagem reutilizáveis e vídeos multimodais que combinam prompts com referências de imagem, áudio, personagem ou vídeo-fonte.
Quando devo criar um recurso de personagem?
Crie um recurso de personagem quando múltiplos vídeos precisam da mesma identidade visual; passe o ID do personagem retornado em requisições de vídeo que devem reutilizar esse sujeito.
Como funcionam os recursos de áudio?
Recursos de áudio capturam uma escolha de voz predefinida e podem ser referenciados por requisições de vídeo que precisam de narração ou diálogo com seleção de voz consistente.
O que afeta o preço do vídeo Gemini Omni?
O preço do vídeo depende do modo de requisição, duração, resolução e se a mídia-fonte muda o comprimento efetivo do clipe cobrado.
Uma requisição de vídeo pode combinar vários tipos de referência?
Sim. O vídeo Gemini Omni pode combinar texto de prompt com imagens de referência, IDs de áudio, IDs de personagem e um vídeo-fonte, dentro dos limites de referência documentados.
Como chamo este modelo?
Instale o model skill e siga as notas de setup com sua chave RunAPI.
Gerações com falha custam dinheiro?
Gerações com falha não são cobradas
Posso chamar a partir da minha aplicação?
Sim. Instale o model skill no workspace de código e use durante a implementação da funcionalidade.