It looks like you may prefer a different language. Switch anytime.

Video Google

Gemini Omni API

Accede a la API de Gemini Omni a través de RunAPI con una habilidad de modelo, autenticación unificada y precios de pago por uso.

runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
RESUMEN

Acerca de Gemini Omni

Gemini Omni crea recursos de voz reutilizables, recursos de personaje reutilizables y vídeos multimodales que pueden combinar prompts, imágenes de referencia, IDs de audio, IDs de personaje y un clip de vídeo fuente.

Proveedor
Google
Modalidad
Video

Variantes

Variante Facturación Precios
gemini-omni-audio call $0.0000 Ver →
gemini-omni-character call $0.0000 Ver →
gemini-omni-flash-1-1 call $2.52 Ver →
gemini-omni-flash-preview call $0.460 Ver →
gemini-omni-text-to-video call $2.52 Ver →
PRECIOS

Precios de Gemini Omni

Endpoint Resolución Duración Precio
create_audio Free / track

Precios mostrados para gemini-omni-audio. Otras variantes mantienen sus propios precios por endpoint.

Integración de agentes

Ejecuta Gemini Omni desde un agente

CÓMO FUNCIONA

Empieza con Gemini Omni

  1. Elige el modelo

    Selecciona el modelo y la variante que encajan con tu tipo de salida, calidad objetivo y latencia.

  2. Autentica una vez

    Usa tu clave RunAPI para todos los modelos compatibles.

  3. Instala el skill

    Añade el model skill a tu workspace de código antes de implementar la función.

  4. Recibe la salida

    Consulta por task ID o procesa el callback cuando termine la generación.

CONTEXTO

Dónde encaja Gemini Omni

Gemini Omni pertenece al catálogo de Google en RunAPI y comparte el mismo paquete SDK, espacio de nombres CLI y superficies de facturación en las variantes de audio, personaje y vídeo.

Proveedor
Google
Ver todo →
Modalidad
Video
Explorar modelos →

Por qué usar Gemini Omni mediante RunAPI

Una API key

Usa las mismas credenciales entre modelos y proveedores.

Listo para skills

El model skill incluye schemas, notas de setup, contexto de precios e IDs de modelo.

Facturación predecible

El precio por uso es visible antes de llamar.

Preguntas sobre Gemini Omni

¿Qué puede crear Gemini Omni?

Puede crear recursos de audio reutilizables, recursos de personaje reutilizables y vídeos multimodales que combinan prompts con referencias de imagen, audio, personaje o vídeo fuente.

¿Cuándo debo crear un recurso de personaje?

Crea un recurso de personaje cuando múltiples vídeos necesiten la misma identidad visual; pasa el ID de personaje devuelto a las solicitudes de vídeo que deban reutilizar ese sujeto.

¿Cómo funcionan los recursos de audio?

Los recursos de audio capturan una selección de voz predefinida y pueden ser referenciados por solicitudes de vídeo que necesiten narración o diálogo con una selección de voz consistente.

¿Qué afecta al precio del vídeo de Gemini Omni?

El precio del vídeo depende del modo de solicitud, la duración, la resolución y si los medios fuente cambian la duración efectiva del clip facturado.

¿Puede una sola solicitud de vídeo combinar varios tipos de referencia?

Sí. El vídeo de Gemini Omni puede combinar texto de prompt con imágenes de referencia, IDs de audio, IDs de personaje y un vídeo fuente, dentro de los límites de referencia documentados.

¿Cómo llamo a este modelo?

Instala el model skill y sigue sus notas de setup con tu clave RunAPI.

MODELOS SIMILARES

Modelos similares a Gemini Omni

Empieza a construir con Gemini Omni.