VARIANT · Google / Gemini Omni

gemini-omni-audio API

Google / Gemini Omni

Korzystaj z gemini-omni-audio z rodziny Gemini Omni przez RunAPI. Cennik za wywołanie, bez subskrypcji — nieudane generacje nie są rozliczane.

Operacyjny · audio_music · Do użytku komercyjnego
runapi.ai
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
  -H "Authorization: Bearer $RUNAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "audio_id": "achernar",
  "name": "Acher Narrator",
  "voice_description": "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
  "example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";

const client = new GeminiOmniClient();
const result = await client.createAudio.run({
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
    example_dialogue: "Hello, I am achernar",
});
<?php

require __DIR__ . "/vendor/autoload.php";

use RunApi\GeminiOmni\GeminiOmniClient;

$client = new GeminiOmniClient();
$result = $client->createAudio->run([
        'audio_id' => 'achernar',
        'name' => 'Acher Narrator',
        'voice_description' => 'Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.',
        'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"

client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
    audio_id: "achernar",
    name: "Acher Narrator",
    voice_description: "Create a 1080p neon city tracking shot with a reusable character walking through rain while a calm narrator speaks.",
    example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp

# Codex
codex plugin install runapi-mcp@agents

# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
@runapi.ai/gemini-omni v1
Zmień wariant
OVERVIEW

gemini-omni-audio trafia w optymalny punkt między jakością a kosztem w rodzinie Gemini Omni.

  • Cennik za wywołanie w USD
  • Nieudane generacje nie są rozliczane
  • Streaming, gdy jest obsługiwany przez model
  • Setup model skilla
PRICING

Cennik

Nieudane generacje nie są rozliczane
Create audio
Free / track
SPECYFIKACJA

Szczegóły techniczne

ID modelu gemini-omni-audio
Dostawca Google
Modalność audio_music
Typ zadania synchronous
Jednostka rozliczeniowa call
API endpoint /api/v1/gemini_omni/create_audio
Licencja komercyjna Tak — wliczona przez API
Status katalogu Operacyjny
SKILLS

Szybki start — gemini-omni-audio

Ten sam format · wariant przypięty w modelu

# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Installs docs, schemas, pricing context, and setup notes into your developer workspace.
Or use this setup request in your coding tool:
Install the Gemini Omni skill for this app:

1. Add runapi-ai/gemini-omni with the skills installer.
2. Load SKILL.md in this workspace.
3. Use its docs, schemas, pricing notes, and setup steps when adding model features.
4. Confirm the install path when done.
JAK TO DZIAŁA

Użyj gemini-omni-audio w czterech krokach

01

Instalacja

Zainstaluj model skill dla tej linii modeli.

02

Konfiguracja

Ustaw pole model na pełny identyfikator modelu widoczny na tej stronie.

03

Wywołanie

Wyślij typowane żądanie z promptem, danymi wejściowymi i ustawieniami callbacku.

04

Odbiór

Odczytaj odpowiedź zadania, webhook callback lub adres URL zapisanego wyniku z RunAPI.

DIFFERENCES

Co wyróżnia gemini-omni-audio

VS GEMINI-OMNI-CHARACTER

Synchronous reusable voice resource creation from preset voices

Synchronous reusable character resource creation from one reference image

VS GEMINI-OMNI-FLASH-PREVIEW

Synchronous reusable voice resource creation from preset voices

Szybkie, konwersacyjne generowanie wideo do kreatywnych iteracji w języku naturalnym

VS GEMINI-OMNI-TEXT-TO-VIDEO

Synchronous reusable voice resource creation from preset voices

Prompted multimodal video with image, audio, character, and source-clip references

PRZYPADKI UŻYCIA

Najlepiej sprawdza się w

Muzyka do podcastów i wideo

Generuj muzykę w tle bez tantiem, dopasowaną do nastroju odcinka i bez opłat licencyjnych.

Audio do gier

Generuj adaptacyjne ambientowe pejzaże dźwiękowe i efekty do proceduralnie generowanych poziomów.

Lektor i SFX do reklam

Generuj niestandardowe lektorskie nagrania i efekty dźwiękowe do spotów klienta bez studia nagrań.

FAQ

Najczęściej zadawane pytania o gemini-omni-audio

Czy identyfikator modelu jest stały między wersjami?

RunAPI utrzymuje stały identyfikator modelu i obsługuje zgodne odświeżenia wersji bez zmiany kształtu żądania.

Jaki jest limit rate limit dla tej warianty?

Limity na klucz skalują się wraz z poziomem wykorzystania. Aktualne limity znajdziesz na stronie cennika.

Czy mogę później zmienić wariant?

Tak — wariant to flaga. Zmieniasz go, aktualizując parametr model.

Czy obsługuje streaming?

Tam, gdzie streaming jest dostępny, RunAPI streamuje end-to-end.

Gdzie zgłaszać problemy z jakością?

Otwórz issue w publicznym repo na GitHubie albo napisz do supportu.

ZACZNIJ TERAZ

Zacznij budować z Gemini Omni.