Gemini Omni API
Accès API Gemini Omni pour les ressources voix, personnages et vidéo multimodale dans les workflows de médias agentiques.
curl -X POST https://runapi.ai/api/v1/gemini_omni/create_audio \
-H "Authorization: Bearer $RUNAPI_KEY" \
-H "Content-Type: application/json" \
-d '{
"audio_id": "achernar",
"name": "Acher Narrator",
"voice_description": "Créez un plan de suivi en ville néon 1080p avec un personnage réutilisable marchant sous la pluie pendant qu'un narrateur calme parle.",
"example_dialogue": "Hello, I am achernar"
}'
import { GeminiOmniClient } from "@runapi.ai/gemini-omni";
const client = new GeminiOmniClient();
const result = await client.createAudio.run({
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "Créez un plan de suivi en ville néon 1080p avec un personnage réutilisable marchant sous la pluie pendant qu'un narrateur calme parle.",
example_dialogue: "Hello, I am achernar",
});
<?php
require __DIR__ . "/vendor/autoload.php";
use RunApi\GeminiOmni\GeminiOmniClient;
$client = new GeminiOmniClient();
$result = $client->createAudio->run([
'audio_id' => 'achernar',
'name' => 'Acher Narrator',
'voice_description' => 'Créez un plan de suivi en ville néon 1080p avec un personnage réutilisable marchant sous la pluie pendant qu\'un narrateur calme parle.',
'example_dialogue' => 'Hello, I am achernar',
]);
require "runapi/gemini_omni"
client = RunApi::GeminiOmni::Client.new
result = client.create_audio.run(
audio_id: "achernar",
name: "Acher Narrator",
voice_description: "Créez un plan de suivi en ville néon 1080p avec un personnage réutilisable marchant sous la pluie pendant qu'un narrateur calme parle.",
example_dialogue: "Hello, I am achernar"
)
npx skills add runapi-ai/gemini-omni -g
# Claude Code
claude mcp add runapi -s user -- npx -y @runapi.ai/mcp
# Codex
codex plugin install runapi-mcp@agents
# Cursor / Windsurf / VS Code
npx @runapi.ai/mcp init cursor
Gemini Omni crée des ressources vocales réutilisables, des ressources de personnages réutilisables et des vidéos multimodales qui peuvent combiner des prompts, des images de référence, des identifiants audio, des identifiants de personnage et un clip vidéo source.
- Variantes de modèle pour différents objectifs de qualité et de latence
- API key unifiée
- Le model skill inclut docs, schémas et notes de setup
- Les générations échouées ne sont pas facturées
Variantes
Installez le skill Gemini Omni pour développer des apps
Chargez les docs du modèle, les schémas, les notes de tarifs et les étapes de setup dans votre workspace de code.
# Install the model skill for app development workflows
npx skills add runapi-ai/gemini-omni -g
Install the Gemini Omni skill for this app: 1. Add runapi-ai/gemini-omni with the skills installer. 2. Load SKILL.md in this workspace. 3. Use its docs, schemas, pricing notes, and setup steps when adding model features. 4. Confirm the install path when done.
Construire avec ce model skill
Choisir le modèle
Sélectionnez le modèle et la variante adaptés au type de sortie, au niveau de qualité et à la latence cible.
S'authentifier une fois
Utilisez votre clé RunAPI pour tous les modèles pris en charge.
Installer le skill
Ajoutez le model skill à votre workspace de code avant d'implémenter la fonctionnalité.
Recevoir la sortie
Interrogez par task ID ou traitez le callback quand la génération se termine.
Où utiliser Gemini Omni
Gemini Omni appartient au catalogue Google sur RunAPI et partage le même package SDK, l'espace de noms CLI et les surfaces de facturation pour les variantes audio, personnage et vidéo.
Pourquoi utiliser Gemini Omni via RunAPI
Une API key
Utilisez les mêmes identifiants pour les modèles et les fournisseurs.
Prêt pour les skills
Le model skill inclut schémas, notes de setup, contexte tarifaire et IDs de modèle.
Facturation prévisible
Les tarifs à l'usage sont visibles avant l'appel.
Questions fréquentes
Que peut créer Gemini Omni ?
Il peut créer des ressources audio réutilisables, des ressources de personnages réutilisables et des vidéos multimodales qui combinent des prompts avec des références image, audio, personnage ou vidéo source.
Quand dois-je créer une ressource de personnage ?
Créez une ressource de personnage lorsque plusieurs vidéos ont besoin de la même identité visuelle ; passez l'identifiant de personnage retourné dans les requêtes vidéo qui doivent réutiliser ce sujet.
Comment fonctionnent les ressources audio ?
Les ressources audio capturent un choix de voix prédéfini et peuvent être référencées par les requêtes vidéo qui ont besoin d'une narration ou d'un dialogue avec une sélection de voix cohérente.
Qu'est-ce qui affecte la tarification vidéo de Gemini Omni ?
Le prix de la vidéo dépend du mode de requête, de la durée, de la résolution et du fait que le média source modifie ou non la longueur de clip facturée effective.
Un seul requête vidéo peut-elle mélanger plusieurs types de références ?
Oui. La vidéo Gemini Omni peut combiner un texte de prompt avec des images de référence, des identifiants audio, des identifiants de personnage et une vidéo source, dans les limites de référence documentées.
Comment appeler ce modèle ?
Installez le model skill et suivez ses notes de setup avec votre clé RunAPI.
Les générations échouées coûtent-elles quelque chose ?
Les générations échouées ne sont pas facturées
Puis-je l'appeler depuis mon application ?
Oui. Installez le model skill dans votre workspace de code et utilisez-le pendant l'ajout de la fonctionnalité.