VARIANTE · Google / Gemini Omni

gemini-omni-audio API

Google / Gemini Omni

Usa gemini-omni-audio de la familia Gemini Omni mediante RunAPI. Pago por llamada, sin suscripción, y las generaciones fallidas no se cobran.

Operativo · audio_music · Uso comercial compatible
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Crea un plano de seguimiento en 1080p de una ciudad de neón con un personaje reutilizable caminando bajo la lluvia mientras un narrador tranquilo habla.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
Cambiar variante
RESUMEN

Gemini Omni gemini-omni-audio está disponible con la misma autenticación RunAPI, flujo de model skill y precios por uso.

  • API key unificada
  • Setup del model skill
  • Referencia de ID de modelo
  • Las generaciones fallidas no se cobran
PRECIOS

PRECIOS

Las generaciones fallidas no se cobran
Create audio
Free / track
FICHA TÉCNICA

FICHA TÉCNICA

ID de modelo gemini-omni-audio
Proveedor Google
Modalidad audio_music
Tipo de tarea synchronous
Facturación call
Endpoint /api/v1/gemini_omni/create_audio
Comercial
Estado del catálogo Operativo
MODELS

Habilidad de modelo — gemini-omni-audio

Instala la habilidad una vez y luego usa el ID de variante de esta página mientras construyes.

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini Omni skill for this app:

1. Add runapi-ai/gemini-omni with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
CÓMO FUNCIONA

Cómo usar gemini-omni-audio

01

Elige modelo

Selecciona el modelo y la variante que encajan con el flujo de tu app.

02

Pasa el ID de modelo

Usa este ID de variante en el cuerpo de la petición.

03

Ejecuta la tarea

Envía la petición y guarda el task ID devuelto.

04

Recoge la salida

Consulta o recibe el callback cuando termine la tarea.

DIFERENCIAS

Comparativa de gemini-omni-audio

VS GEMINI-OMNI-CHARACTER

Creación sincrónica de recursos de voz reutilizables desde voces predefinidas

Creación sincrónica de recursos de personaje reutilizables desde una imagen de referencia

VS GEMINI-OMNI-FLASH-PREVIEW

Creación sincrónica de recursos de voz reutilizables desde voces predefinidas

Generación de video rápida y conversacional para iteración creativa con lenguaje natural

VS GEMINI-OMNI-TEXT-TO-VIDEO

Creación sincrónica de recursos de voz reutilizables desde voces predefinidas

Vídeo multimodal con prompt con referencias de imagen, audio, personaje y clip fuente

CASOS DE USO

Dónde usar esta variante

Generación de música

Crea pistas y assets de audio.

Flujos de voz

Construye pipelines de voz y audio.

Creación asistida por tools

Expón herramientas de audio a tu entorno de desarrollo.

FAQ

Preguntas frecuentes sobre gemini-omni-audio

¿Cómo selecciono gemini-omni-audio?

Pasa el ID de modelo que aparece en el quickstart.

¿El precio es por uso?

Sí. El precio se mide por llamada o unidad.

EMPEZAR

Empieza con Gemini Omni hoy.