It looks like you may prefer a different language. Switch anytime.

Video Google

Gemini Omni API

Nutze die Gemini Omni API über RunAPI mit einem Modell-Skill, einheitlicher Authentifizierung und Pay-as-you-go-Preisen.

runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Erstelle einen 1080p-Neon-City-Tracking-Shot mit einem wiederverwendbaren Charakter, der im Regen geht, während ein ruhiger Erzähler spricht.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Erstelle einen 1080p-Neon-City-Tracking-Shot mit einem wiederverwendbaren Charakter, der im Regen geht, während ein ruhiger Erzähler spricht.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Erstelle einen 1080p-Neon-City-Tracking-Shot mit einem wiederverwendbaren Charakter, der im Regen geht, während ein ruhiger Erzähler spricht.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Erstelle einen 1080p-Neon-City-Tracking-Shot mit einem wiederverwendbaren Charakter, der im Regen geht, während ein ruhiger Erzähler spricht.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
ÜBERBLICK

Über Gemini Omni

Gemini Omni erstellt wiederverwendbare Sprach-Ressourcen, wiederverwendbare Charakter-Ressourcen und multimodale Videos, die Prompts, Referenzbilder, Audio-IDs, Charakter-IDs und einen Quellvideoclip kombinieren können.

Anbieter
Google
Modalität
Video

Varianten

Variante Abrechnung Preise
gemini-omni-audio call $0.0000 Ansehen →
gemini-omni-character call $0.0000 Ansehen →
gemini-omni-flash-1-1 call $2.52 Ansehen →
gemini-omni-flash-preview call $0.460 Ansehen →
gemini-omni-text-to-video call $2.52 Ansehen →
PREISE

Gemini Omni-Preise

Endpoint Auflösung Dauer Preis
create_audio Free / track

Preise für gemini-omni-audio angezeigt. Andere Varianten behalten ihre eigenen Endpoint-Preise.

Agent-Integration

Gemini Omni mit einem Agenten ausführen

SO FUNKTIONIERT ES

Mit Gemini Omni starten

  1. Modell wählen

    Wähle Modell und Variante passend zu Ausgabetyp, Qualitätsziel und Latenz.

  2. Einmal authentifizieren

    Nutze deinen RunAPI Key für jedes unterstützte Modell.

  3. Skill installieren

    Füge den Model Skill deinem Coding-Workspace hinzu, bevor du das Feature implementierst.

  4. Ergebnis empfangen

    Frage per Task ID ab oder verarbeite den Callback, wenn die Generierung abgeschlossen ist.

KONTEXT

Wo Gemini Omni passt

Gemini Omni gehört zum Google-Katalog auf RunAPI und teilt dasselbe SDK-Paket, CLI-Namespace und Abrechnungs-Oberflächen über Audio-, Charakter- und Video-Varianten.

Anbieter
Google
Alle ansehen →
Modalität
Video
Modelle durchsuchen →

Warum Gemini Omni über RunAPI nutzen

Ein API Key

Nutze dieselben Zugangsdaten über Modelle und Anbieter hinweg.

Skill-ready

Der Model Skill enthält Schemas, Setup-Hinweise, Preiskontext und Modell-IDs.

Planbare Abrechnung

Nutzungsbasierte Preise sind vor dem Aufruf sichtbar.

Gemini Omni-Fragen

Was kann Gemini Omni erstellen?

Es kann wiederverwendbare Audio-Ressourcen, wiederverwendbare Charakter-Ressourcen und multimodale Videos erstellen, die Prompts mit Bild-, Audio-, Charakter- oder Quellvideo-Referenzen kombinieren.

Wann sollte ich eine Charakter-Ressource erstellen?

Erstelle eine Charakter-Ressource, wenn mehrere Videos dieselbe visuelle Identität benötigen; übergib die zurückgegebene Charakter-ID in Video-Requests, die dieses Motiv wiederverwenden sollen.

Wie funktionieren Audio-Ressourcen?

Audio-Ressourcen erfassen eine voreingestellte Stimmenwahl und können von Video-Requests referenziert werden, die Narration oder Dialoge mit konsistenter Stimmenwahl benötigen.

Was beeinflusst die Gemini Omni-Videopreise?

Der Videopreis hängt vom Request-Modus, der Dauer, der Auflösung und davon ab, ob Quellmaterial die effektiv abgerechnete Cliplänge verändert.

Kann ein Video-Request mehrere Referenztypen kombinieren?

Ja. Gemini Omni Video kann Prompt-Text mit Referenzbildern, Audio-IDs, Charakter-IDs und einem Quellvideo kombinieren, innerhalb der dokumentierten Referenzlimits.

Wie rufe ich dieses Modell auf?

Installiere den Model Skill und folge den Setup-Hinweisen mit deinem RunAPI Key.

ÄHNLICHE MODELLE

Ähnliche Modelle wie Gemini Omni

Mit Gemini Omni bauen.