VARIANT · Google / Gemini Omni

gemini-omni-audio API

Google / Gemini Omni

Usa gemini-omni-audio dalla famiglia Gemini Omni tramite RunAPI. Prezzi per chiamata, nessun abbonamento e le generazioni fallite non vengono mai addebitate.

Operativo · audio_music · Uso commerciale consentito
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
Cambia variante
OVERVIEW

gemini-omni-audio punta al giusto equilibrio tra qualità e costo all’interno della famiglia Gemini Omni.

  • Prezzi pay-per-call in USD
  • Le generazioni fallite non vengono addebitate
  • Streaming quando supportato dal modello
  • Setup del model skill
PRICING

Prezzi

Le generazioni fallite non vengono addebitate
Create audio
Free / track
SCHEDA TECNICA

Dettagli tecnici

ID modello gemini-omni-audio
Provider Google
Modalità audio_music
Tipo di task synchronous
Unità di fatturazione call
API endpoint /api/v1/gemini_omni/create_audio
Licenza commerciale Sì — inclusa via API
Stato del catalogo Operativo
SKILLS

Quickstart — gemini-omni-audio

Stessa struttura · variante fissata nel model

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini Omni skill for this app:

1. Add runapi-ai/gemini-omni with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
COME FUNZIONA

Usa gemini-omni-audio in quattro passaggi

01

Installa

Installa il model skill per questa linea di modello.

02

Configura

Imposta il campo model con l'ID completo del model mostrato in questa pagina.

03

Invia

Invia una richiesta tipizzata con prompt, input e impostazioni di callback.

04

Ricevi

Leggi la risposta del task, il callback webhook o l'URL dell'output in cache da RunAPI.

DIFFERENCES

Cosa cambia in gemini-omni-audio

VS GEMINI-OMNI-CHARACTER

Synchronous reusable voice resource creation from preset voices

Synchronous reusable character resource creation from one reference image

VS GEMINI-OMNI-FLASH-PREVIEW

Synchronous reusable voice resource creation from preset voices

Generazione video rapida e conversazionale per iterazioni creative in linguaggio naturale

VS GEMINI-OMNI-TEXT-TO-VIDEO

Synchronous reusable voice resource creation from preset voices

Prompted multimodal video with image, audio, character, and source-clip references

CASI D'USO

Ideale per

Colonna sonora per podcast e video

Genera musica di sottofondo royalty-free in linea con il mood dell'episodio, senza costi di licenza.

Audio per game

Genera paesaggi sonori ambientali adattivi ed effetti per livelli generati proceduralmente.

Voiceover e SFX per adv

Genera voiceover e effetti sonori personalizzati per spot dei clienti senza uno studio di registrazione.

FAQ

Domande frequenti su gemini-omni-audio

L'ID del modello resta stabile tra le versioni?

RunAPI mantiene stabile l’ID del modello e gestisce gli aggiornamenti di versione compatibili senza modificare la forma della richiesta.

Qual è il rate limit di questa variante?

I limiti per chiave scalano in base al tier di utilizzo. Consulta la pagina prezzi per i limiti attuali.

Posso cambiare variante in seguito?

Sì — la variante è un flag. Puoi cambiarla modificando il parametro model.

Fa streaming?

Dove lo streaming è disponibile, RunAPI esegue lo streaming end-to-end.

Dove posso segnalare problemi di qualità?

Apri un issue nel repository GitHub pubblico oppure scrivi all’assistenza.

INIZIA ORA

Inizia a costruire con Gemini Omni.